Google je službeno lansirao Gemini 2.0, novu generaciju svojih AI-modela, počevši s eksperimentalnim izdanjem Gemini 2.0 Flash. Ovaj inovativni AI sistem donosi multimodalne mogućnosti poput generisanja teksta, slika i govora, uz obradu više vrsta ulaza, uključujući tekst, slike, zvuk i video.
Gemini 2.0 predstavlja direktnog konkurenta multimodalnim modelima poput GPT-4o, koji pokreće OpenAI-jev ChatGPT, te donosi značajna poboljšanja u performansama i brzini odgovora.
Napredne funkcije Gemini 2.0 Flash
Gemini 2.0 Flash, najmanji model u porodici 2.0 po broju parametara, dostupan je putem Googleovih platformi kao što su Gemini API, AI Studio i Vertex AI. Njegove funkcije poput generisanja slika i konverzije teksta u govor trenutno su ograničene na partnere s ranim pristupom do januara 2025. godine.
Glavne karakteristike:
- Brže performanse u odnosu na prethodni model Gemini 1.5 Flash.
- Primjena SynthID tehnologije za označavanje svih AI-generisanih sadržaja.
- Integracija s alatima poput Android Studio, Chrome DevTools i Firebase.
SynthID tehnologija omogućava identifikaciju AI-generisanih audio i vizuelnih sadržaja, čime se smanjuje mogućnost zloupotrebe.
Agentni AI: Nova vizija za budućnost
Gemini 2.0 predstavlja korak prema “agentnoj AI” tehnologiji, koja omogućava sistemima da razmišljaju unaprijed, razumiju složenije kontekste i djeluju uz nadzor korisnika. Sundar Pichai, izvršni direktor Googlea, opisuje ovu novu eru kao prekretnicu u razvoju AI tehnologije.
Primjene Gemini 2.0
- Project Astra: Vizualni AI asistent za Android uređaje, sposoban da koristi Google Search, Maps i vodi konverzacije do 10 minuta.
- AI za Igre: Saradnja sa Supercellom za kreiranje AI-agenta koji razumije gameplay i nudi prijedloge u realnom vremenu.
- Project Mariner: Prototip Chrome ekstenzije koja pomaže korisnicima da izvršavaju zadatke analizirajući sadržaj na ekranu.
- Jules: Eksperimentalni AI alat za programere koji optimizira radne procese na GitHubu.
- Multimodal Live API: Alat za kreiranje aplikacija s mogućnostima real-time audio i video striminga.
Pogled unaprijed
Google ističe da je Gemini 2.0 još uvijek u fazi razvoja, s planovima za dodatna ažuriranja, veće modele i proširene funkcionalnosti. Kompanija se oslanja na povratne informacije od “pouzdanih testera” kako bi unaprijedila svoj AI sistem i učinila ga dostupnim širem krugu korisnika.
Gemini 2.0 označava početak nove ere u razvoju vještačke inteligencije, spajajući multimodalne funkcionalnosti s agentnim modelima. Ova tehnologija ima potencijal da revolucionira način na koji koristimo AI u svakodnevnom životu, od programiranja do igranja igara i upravljanja digitalnim zadacima.

