Izpostavljeno

Preberite tudi

DomovTehnologijaUmetna inteligencaGoogle je predstavil Gemini 3.7 Flash: novi model ne...

Google je predstavil Gemini 3.7 Flash: novi model ne stavi na največjo inteligenco, ampak na nekaj bolj uporabnega

Google je predstavil Gemini 3.7 Flash, novi model, namenjen predvsem programiranju, agentom in zahtevnejšim večstopenjskim opravilom, kjer sta poleg kakovosti pomembni tudi hitrost in cena. Največja sprememba ni nov spektakularen način generiranja slik ali videa, temveč precej bolj praktična lastnost: Google trdi, da model bolje razume navodila, učinkoviteje uporablja orodja in potrebuje manj ponovnih poskusov pri kompleksnih nalogah. Hkrati je Gemini 3.7 Flash že začel prihajati v Gemini Spark in Googlov AI Mode v Iskanju.

Poudarki:

  • Gemini 3.7 Flash je namenjen predvsem programiranju, agentom in večstopenjskim nalogam, pri katerih mora AI sam uporabljati različna orodja.
  • Google obljublja boljše sledenje navodilom, manj ponavljanja nalog in učinkovitejše načrtovanje zapletenih delovnih tokov.
  • Novi model že poganja Gemini Spark, uporabniki Google AI Pro in Ultra pa ga dobivajo tudi v AI Mode v Iskanju.

Gemini 3.7 Flash ni Googlov najdražji model – in ravno v tem je njegova poanta

Pri novih modelih umetne inteligence se največ pozornosti običajno usmeri v vprašanje, kateri je trenutno »najpametnejši«. Pri Gemini 3.7 Flash Google poudarja nekaj drugega.

Model je zasnovan kot delovni konj za naloge, ki se izvajajo veliko in pogosto: programiranje, spletni agenti, avtomatizacija, povezovanje več orodij, delo z več koraki ter naloge, kjer morata biti odzivnost in strošek dovolj nizka za množično uporabo.

To je posebej pomembno pri agentih.

Klasični klepetalnik prejme vprašanje in vrne odgovor. Agent pa lahko najprej analizira zahtevo, nato pokliče eno orodje, preveri rezultat, uporabi drugo storitev, spremeni načrt in šele nato pripravi končni rezultat.

Vsak napačen korak pri takšnem procesu pomeni dodatno zakasnitev, več porabljenih žetonov in višje stroške.

Google zato pri 3.7 Flash poudarja bolj disciplinirano izvajanje nalog in manj potreb po človeškem posredovanju oziroma ponovnih poskusih.

Google pravi, da model bolje ve, kdaj se mora ustaviti in vprašati

Ena od manj opaznih, a praktično pomembnih izboljšav je način, kako model ravna z nejasnimi navodili.

Google navaja, da Gemini 3.7 Flash bolje prepozna ovire, natančneje sledi namenu uporabnika in pogosteje razjasni zahtevo, kadar nadaljevanje brez dodatnega podatka ne bi bilo smiselno.

To se sliši precej trivialno, vendar je pri agentih pomembno.

Predstavljajte si sistem, ki mora iz dokumenta izvleči podatke, pripraviti preglednico, napisati elektronsko sporočilo in posodobiti projektni dokument. Če napačno razume že prvi korak, lahko napačno izvede tudi vse naslednje.

Pri takšnih scenarijih lahko boljše razumevanje namena in manj napak pri zaporedju opravil pomeni večjo razliko kot nekoliko boljši rezultat na splošnem testu znanja.

Gemini Spark je med prvimi, ki prehajajo na novi model

Google je Gemini 3.7 Flash že vključil v Gemini Spark, svojega osebnega AI-agenta, ki lahko pod uporabnikovim nadzorom izvaja dolgotrajnejše naloge. Spark je na voljo naročnikom Google AI Pro in Ultra v več kot 160 državah.

Google kot primere omenja:

  • združevanje informacij iz več datotek,
  • pripravljanje elektronskih sporočil,
  • posodabljanje dokumentov o stanju projekta,
  • delo z aplikacijami Google Workspace,
  • izvajanje kompleksnih nalog, ki zahtevajo več različnih spretnosti.

Pri tem je pomemben širši trend.

Veliki tehnološki ponudniki umetno inteligenco vse manj predstavljajo kot okno za pogovor in vse bolj kot sistem, ki mora nekaj dejansko opraviti.

V takem okolju postaja sposobnost zanesljivega klicanja orodij skoraj tako pomembna kot samo generiranje besedila.

Novi Gemini prihaja tudi neposredno v Google Search

Gemini 3.7 Flash ni omejen samo na razvijalce.

Google ga je začel uvajati tudi v AI Mode v svojem iskalniku, kjer je na voljo kot možnost uporabnikom paketov Google AI Pro in Ultra.

Google pri tem izpostavlja boljše razumevanje namena vprašanja in natančnejše sledenje navodilom.

To je pomembno, ker AI Mode ni več zgolj generator kratkega povzetka nad rezultati iskanja. Google ga razvija v bolj interaktiven sistem, ki lahko razčleni zapleteno vprašanje, izvede več iskanj in uporabniku pomaga pri opravilih, ki so bližje raziskovanju kot klasičnemu vnosu nekaj ključnih besed.

Gemini 3.7 Flash je zato eden od modelov, s katerimi želi Google takšno uporabo pospešiti, ne da bi moral vsako vprašanje pošiljati najdražjemu modelu.

Programiranje je eno glavnih področij izboljšav

Google Gemini 3.7 Flash opisuje kot svoj najzmogljivejši »workhorse« model doslej za programiranje in agente.

Podjetje navaja izboljšave pri:

  • programskem inženirstvu,
  • izdelavi spletnih aplikacij,
  • večstopenjskem načrtovanju,
  • klicanju orodij,
  • izvajanju daljših programerskih opravil.

Google je ob predstavitvi pokazal tudi primere uporabe, kjer model sodeluje z drugimi sistemi. Med demonstracijami so bili generiranje igralnega okolja skupaj z Nano Banana, izdelava interaktivnih spletnih strani in uporaba modela znotraj večagentnega robotskega sistema.

Te demonstracije niso neodvisen dokaz, da bo model enako uspešen pri vsakem programerskem projektu, pokažejo pa vrsto nalog, za katere ga Google pozicionira.

Zakaj »Flash« postaja vedno pomembnejši od »Pro«?

Googlova družina Gemini je že nekaj generacij razdeljena na modele z različnimi kompromisi.

Modeli Flash so praviloma namenjeni scenarijem, kjer so pomembni visoka hitrost, veliko število zahtev in nižji stroški. Zmogljivejši modeli so smiselni za najtežje naloge, vendar so pogosto počasnejši in dražji.

Pri agentih je ta razlika še pomembnejša.

Ena uporabniška zahteva lahko sproži desetine notranjih korakov. Če vsak korak uporablja drag model, se strošek hitro poveča. Če lahko lažji model dovolj zanesljivo izvede večino delovnega toka, lahko podjetje zmogljivejši model uporabi le tam, kjer ga res potrebuje.

Prav zato je zanimiva Googloveva odločitev, da 3.7 Flash predstavlja kot model za produkcijske agente in ne zgolj kot hitrejšo različico klepetalnika.

Varnost je prilagojena tudi kibernetskim in biološkim tveganjem

Google pri novi različici omenja tudi posodobljene zaščite proti zlorabam na področjih kibernetskih napadov ter kemičnih, bioloških, radioloških in jedrskih tveganj.

To je posledica širšega razvoja zmogljivosti modelov.

Ko AI postaja boljši pri programiranju, uporabi orodij in dolgoročnem načrtovanju, isti napredek lahko koristi tudi pri nevarnejših nalogah. Modeli za agente zato potrebujejo drugačen varnostni profil kot preprosti sistemi za kratke odgovore.

Google je za Gemini 3.7 Flash objavil tudi ločeno modelno kartico z informacijami o zmogljivostih, omejitvah in varnostnih ocenah.

Cena bo za razvijalce skoraj tako pomembna kot kakovost

Google ob novi generaciji poudarja tudi izboljšano razmerje med kakovostjo in ceno.

Za končnega uporabnika naročnine to morda ni posebej vidno. Za podjetje, ki skozi API pošlje milijone zahtev, pa lahko že majhna razlika v ceni ali številu potrebnih ponovitev pomeni pomemben mesečni strošek.

Model, ki pri eni nalogi potrebuje tri poskuse, je lahko v praksi bistveno dražji od modela, ki je nekoliko dražji na posamezen žeton, vendar nalogo uspešno zaključi v prvem poskusu.

Google zato pri 3.7 Flash pogosto govori o manj ponavljanja, bolj discipliniranem načrtovanju in nižji potrebi po ročnem nadzoru.

Prav te lastnosti bo treba pri neodvisnih testih spremljati bolj kot eno samo številko na sintetičnem merilu.

Kaj to pomeni za običajnega uporabnika?

Če uporabljate Gemini samo za vprašanja, povzetke ali pisanje besedila, nova različica verjetno ne bo delovala kot dramatičen generacijski preskok.

Bolj opazna bo tam, kjer AI opravlja dejanja.

To vključuje:

  • daljše raziskovalne naloge,
  • avtomatizacijo dela v Workspace,
  • programiranje,
  • izdelovanje aplikacij,
  • izvajanje več korakov brez stalnega potrjevanja,
  • uporabo Gemini Spark in podobnih agentov.

Pri takšnih nalogah ni najpomembneje, ali zna model napisati nekoliko lepši odgovor. Pomembneje je, ali uspe nalogo izpeljati do konca, ne da bi se na tretjem koraku izgubil.

In prav to je osrednja obljuba Gemini 3.7 Flash.

Google z njim ne poskuša dokazati samo, da ima še en zelo pameten model. Poskuša pokazati, da je umetna inteligenca dovolj zanesljiva in dovolj poceni, da lahko začne opravljati več dejanskega dela.

Če se bo to potrdilo tudi zunaj Googlovih demonstracij, bo lahko ta sprememba za razvoj AI-agentov pomembnejša od naslednjega rekorda na lestvici testov.

.

Sorodne vsebine