Yapay zeka yarışında dengeleri değiştirecek dev bir adım atıldı. Google DeepMind ve Google Araştırma ekiplerinin ortaklığıyla geliştirilen ve şirketin bugüne kadarki en gelişmiş yapay zeka modeli olan Gemini, resmi olarak tanıtıldı. Metin, kod, ses, görsel ve videoyu aynı anda anlayıp işleyebilen sistem, yapay zeka dünyasında yeni bir dönemin kapılarını aralıyor.
Sıfırdan "Çok Modlu" Olarak Tasarlandı
Geleneksel yapay zeka sistemleri metin veya görsel gibi tek bir veri türü üzerine eğitilip sonradan birleştirilirken, Gemini sıfırdan "çok modlu" (multimodal) olarak geliştirildi. Bu sayede model; karmaşık görsel verileri analiz edebiliyor, çizilen basit bir taslağı anında yazılım koduna dönüştürebiliyor ve videolar üzerindeki detayları insan hassasiyetiyle yorumlayabiliyor.
Her İhtiyaca Uygun 4 Farklı Boyut
Google, yeni yapay zeka ekosistemini farklı kullanım alanlarına göre 4 ana sürüme ayırdı:
Günlük Hayatın ve İş Dünyasının Parçası Olacak
Google Arama, Gmail, Google Docs ve Android işletim sistemine doğrudan entegre edilen Gemini; karmaşık matematik problemlerini çözmekten devasa raporları saniyeler içinde özetlemeye kadar pek çok alanda kullanıcıların dijital asistanı olmaya aday.
Yeni modelin önümüzdeki süreçte tüm Google ekosisteminde kademeli olarak daha fazla yetenekle aktif hale getirilmesi bekleniyor.