Google a lansat Gemini 3.6 Flash și 3.5 Flash-Lite. Ce aduc în plus la cost, viteză și programare

Noi modele AI de la Google: mai ieftine și mai rapide pentru dezvoltatori și companii
Dezvoltatorii și companiile care folosesc inteligență artificială în aplicații, analiză financiară sau automatizare primesc de astăzi modele mai rapide și mai ieftine de la Google, odată cu lansarea Gemini 3.6 Flash, Gemini 3.5 Flash-Lite și Gemini 3.5 Flash-Cyber.
Începând de astăzi, Gemini 3.6 Flash și Gemini 3.5 Flash-Lite sunt disponibile prin Google AI Studio, Android Studio, Gemini Enterprise Agent Platform și aplicația Gemini. Pentru firme, miza este simplă: cost mai mic la rulare și timp de răspuns mai scurt, adică o integrare mai ușoară în produse și fluxuri de lucru fără o creștere similară a bugetului.
Modelul care mută cel mai clar discuția spre raportul cost-performanță este Gemini 3.6 Flash. Acesta folosește cu 17% mai puțini tokeni de ieșire decât modelul anterior, Gemini 3.5 Flash, și are un tarif de 1,5 dolari pentru un milion de tokeni de intrare și 7,50 dolari pentru un milion de tokeni de ieșire. Pentru companiile care plătesc la volum, diferența contează direct în costul final al unui asistent intern, al unui chatbot pentru clienți sau al unor instrumente de analiză.
Și partea de performanță urcă vizibil față de generația anterioară. La editarea de cod, Gemini 3.6 Flash a crescut de la 37% la 49% în benchmark-ul DeepSWE. În evaluările MLE Bench, modelul a urcat de la 49,7% la 63,9%, un salt de 14,2 puncte procentuale față de versiunea precedentă.
Modelul Lite țintește viteza și costul minim
Pentru proiectele în care contează în primul rând răspunsul rapid și costul redus, Google a lansat Gemini 3.5 Flash-Lite, prezentat drept cel mai rapid model din seria 3.5. Acesta procesează 350 de tokeni de ieșire pe secundă și costă 0,30 dolari pentru un milion de tokeni de intrare și 2,50 dolari pentru un milion de tokeni de ieșire.
Un model mai ieftin și mai rapid poate coborî pragul de intrare pentru funcții AI integrate în aplicații locale, servicii pentru clienți, analiză de documente sau instrumente interne. În plus, Gemini 3.5 Flash-Lite este integrat și în Google Search, potrivit Libertatea.
Google mută și spre modele specializate
Al treilea anunț este Gemini 3.5 Flash-Cyber, un model dedicat securității cibernetice. Accesul nu este public în această etapă: modelul va fi disponibil inițial doar guvernelor și partenerilor de încredere, printr-un program pilot cu acces limitat.
Lansarea arată direcția în care merge competiția din piața AI: pe lângă modelele generale, marile companii încearcă să câștige teren și cu instrumente specializate, unde cerințele sunt mai stricte.
În paralel, Google continuă testarea modelului Gemini 3.5 Pro și a început pre-antrenarea viitoarei generații, Gemini 4.






