Gemini 2.5, najnoviji model umjetne inteligencije, predstavljen je kao značajan napredak u sposobnosti rješavanja sve složenijih problema. Prva verzija ove serije, eksperimentalni Gemini 2.5 Pro, premašuje dosadašnje standarde u relevantnim testovima i demonstrira izuzetne vještine rezonovanja i kodiranja.
Ovaj najnoviji model iz Gemini serije, Gemini 2.5, predstavlja vrhunac dosadašnjeg razvoja u oblasti umjetne inteligencije. Njegovo prvo izdanje, eksperimentalna verzija 2.5 Pro, zauzima vodeću poziciju na LMArena rang listi sa značajnom prednošću, što ukazuje na izuzetne performanse u poređenju sa drugim modelima.
Gemini 2.5 karakteriše se kao “model za razmišljanje”, što znači da je sposoban da detaljno analizira informacije i razmotri različite aspekte problema prije nego što generiše odgovor. Ovaj proces promišljanja rezultira poboljšanom preciznošću i sveukupnim performansama. U kontekstu umjetne inteligencije, “razmišljanje” podrazumijeva više od pukog prepoznavanja i predviđanja; ono uključuje sposobnost analize podataka, izvođenja logičkih zaključaka, uzimanja u obzir konteksta i nijansi, te donošenja informisanih odluka.
Dugi niz godina, istraživači su radili na tome da umjetna inteligencija postane inteligentnija i sposobnija za rezonovanje, koristeći tehnike kao što su samostalno učenje kroz interakciju i podsticanje lančanog razmišljanja. Nadovezujući se na ova dostignuća, nedavno je predstavljen Gemini 2.0 Flash Thinking, prvi model koji je eksplicitno dizajniran za razmišljanje.
Sada, Gemini 2.5 donosi novi nivo performansi zahvaljujući kombinaciji značajno unaprijeđenog osnovnog modela i poboljšanog procesa obuke nakon inicijalnog treniranja. Dalje, planirano je da se ove sposobnosti razmišljanja integriraju direktno u sve buduće modele, čime će se omogućiti rješavanje još složenijih problema i podrška naprednijim agentima koji su svjesni konteksta.
Gemini 2.5 Pro kao najnapredniji model u seriji
Gemini 2.5 Pro Experimental predstavlja najnapredniji model u seriji, namijenjen za rješavanje izuzetno složenih zadataka. Ovaj model trenutno je u vrhu na LMArena rang listi, koja mjeri preferencije korisnika, sa značajnom razlikom, što potvrđuje njegove izvanredne sposobnosti i visok kvalitet generisanog sadržaja. Pored toga, 2.5 Pro pokazuje izuzetne vještine u rezonovanju i kodiranju, postižući vrhunske rezultate na standardnim testovima za kodiranje, matematiku i nauku.
Gemini 2.5 Pro je sada dostupan za testiranje i upotrebu putem Google AI Studio i u Gemini aplikaciji za pretplatnike Gemini Advanced. Uskoro se očekuje i njegova integracija u Vertex AI platformu. Detalji o cijenama bit će objavljeni u narednim sedmicama, a korisnicima će biti omogućena upotreba 2.5 Pro sa većim limitima za obimnije produkcijske zadatke.
Unaprijeđene sposobnosti rezonovanja
Gemini 2.5 Pro postavlja nove standarde u nizu testova koji zahtijevaju napredno rezonovanje. Bez upotrebe tehnika koje povećavaju troškove testiranja, kao što je metoda većinskog glasanja, 2.5 Pro ostvaruje najbolje rezultate u matematičkim i naučnim testovima poput GPQA i AIME 2025. Također, postiže izvanredan rezultat od 18.8% među modelima koji ne koriste eksterne alate na testu Humanity’s Last Exam. Ovaj skup podataka kreiran je od strane stotina stručnjaka s ciljem da se uhvati trenutni nivo ljudskog znanja i sposobnosti rezonovanja.
Napredne vještine kodiranja
Veliki fokus stavljen je na poboljšanje performansi u oblasti kodiranja, a Gemini 2.5 donosi značajan napredak u odnosu na prethodnu verziju 2.0. Očekuju se i dalja poboljšanja u ovoj oblasti. Ovaj model se ističe u kreiranju vizuelno atraktivnih web aplikacija i inteligentnih aplikacija za automatizaciju koda, kao i u transformaciji i uređivanju postojećeg koda. Na SWE-Bench Verified, industrijskom standardu za procjenu agentnih performansi u kodiranju, Gemini 2.5 Pro postiže rezultat od 63.8% koristeći prilagođenu konfiguraciju agenta.
Primjer mogućnosti Gemini 2.5 Pro u demonstriranju rezonovanja u kreiranju video igre ilustruje se kroz generisanje izvršnog koda na osnovu jednostavne tekstualne instrukcije.
Gemini 2.5 nastavlja da pruža najbolje
Gemini 2.5 nastavlja da se gradi na ključnim prednostima prethodnih Gemini modela, uključujući nativnu multimodalnost i dugačak prozor konteksta. Ova verzija se trenutno isporučuje sa kontekstnim prozorom od 1 milion tokena (sa planovima za povećanje na 2 miliona uskoro), uz zadržavanje visokih performansi koje su poboljšane u odnosu na prethodne generacije. Ovaj model je sposoban da razumije obimne skupove podataka i rješava složene probleme koristeći informacije iz različitih izvora, uključujući tekst, audio, slike, video, pa čak i kompletne repozitorije koda.
Programeri i poslovni korisnici već mogu početi eksperimentirati sa Gemini 2.5 Pro putem Google AI Studio platfrome, dok korisnici Gemini Advanced mogu odabrati ovaj model u padajućem meniju na desktop i mobilnim uređajima. Očekuje se da će biti dostupan i na Vertex AI platformi u narednim sedmicama.

