Metin, kod, ses, görsel ve videoyu aynı anda anlayıp işleyebilen sistem, yapay zeka dünyasında yeni bir dönemin kapılarını aralıyor.
Sıfırdan "Çok Modlu" Olarak Tasarlandı
Geleneksel yapay zeka sistemleri metin veya görsel gibi tek bir veri türü üzerine eğitilip sonradan birleştirilirken, Gemini sıfırdan "çok modlu" (multimodal) olarak geliştirildi. Bu sayede model; karmaşık görsel verileri analiz edebiliyor, çizilen basit bir taslağı anında yazılım koduna dönüştürebiliyor ve videolar üzerindeki detayları insan hassasiyetiyle yorumlayabiliyor.
Her İhtiyaca Uygun 4 Farklı Boyut
Google, yeni yapay zeka ekosistemini farklı kullanım alanlarına göre 4 ana sürüme ayırdı:
- Gemini Nano: Akıllı telefonlar ve mobil cihazlarda internet bağlantısına ihtiyaç duymadan yerel olarak çalışıyor.
- Gemini Flash: Yüksek hız ve düşük maliyet odaklı yapısıyla anlık yanıt gerektiren süreçleri yönetiyor.
- Gemini Pro: Günlük karmaşık görevler, geniş veri analizleri ve genel kullanıcı ihtiyaçları için dengeli bir performans sunuyor.
- Gemini Ultra: En üst düzey mantık yürütme, ileri düzey kodlama ve veri analizi gerektiren zorlu işlemler için sistemin en güçlü motoru olarak öne çıkıyor.
Günlük Hayatın ve İş Dünyasının Parçası Olacak
Google Arama, Gmail, Google Docs ve Android işletim sistemine doğrudan entegre edilen Gemini; karmaşık matematik problemlerini çözmekten devasa raporları saniyeler içinde özetlemeye kadar pek çok alanda kullanıcıların dijital asistanı olmaya aday.
Yeni modelin önümüzdeki süreçte tüm Google ekosisteminde kademeli olarak daha fazla yetenekle aktif h))ale getirilmesi bekleniyor. (Haber Merkezi)