Google a anuntat ca are in lucru un nou model de limbaj mare, sau LLM, numit Gemini 1.5. Prima versiune a acestei tehnologii, modelul AI Gemini 1.5 pro, va fi lansata in curand pentru teste timpurii, conform The Verge.

Anuntul CEO Google
Anuntul a fost facut de CEO-ul Google si Alphabet, Sundar Pichai, si CEO-ul Google DeepMind, Demis Hassabis, la doua luni dupa ce Google a prezentat originalul Gemini. Acesta este conceput ca raspuns la GPT-4 al OpenAI si la alte LLM-uri create de startup-uri si mari companii tech.
Modelul AI Gemini 1.5 Pro este un model A I multi-modal de noua generatie, ceea ce inseamna ca poate procesa mai mult de un tip de date, inclusiv o combinatie de imagini, text, audio, video si limbaje de programare. Modelul este destinat pentru a fi utilizat ca instrument de afaceri si asistent personal.
Google a redenumit toate aplicatiile sale de AI ca fiind Gemini. In Gemini 1.5, imbunatatirile aduse sunt salturi mari inclusiv peste ceea ce poate face Gemini originalul.
Gemini 1.5 promite sa fie mai rapid si mai eficient datorita unei tehnici de specializare numita „mixture of experts”, cunoscuta si sub numele de MoE. In loc sa ruleze intregul model de fiecare data cand primeste o interogare, MoE al lui Gemini poate folosi doar partile relevante ale puterii sale de procesare pentru a genera un raspuns bun.
Puterea unui model AI este data de fereastra sa de context, care este alcatuita din blocurile utilizate pentru procesarea informatiilor. Acestea pot include cuvinte, imagini, videoclipuri, audio sau cod. In lumea A.I., aceste blocuri sunt denumite token-uri.
Specificatii tehnice
Gemini-ul original putea rula pana la 32.000 de token-uri. Capacitatea ferestrei de context a lui Gemini 1.5 Pro, insa, poate gestiona pana la 1 milion de token-uri, ceea ce inseamna ca noul LLM poate analiza mai multe date decat versiunea anterioara: 1 ora de video, 11 ore de audio, baze de cod cu peste 30.000 de linii de cod sau peste 700.000 de cuvinte, potrivit postarii de pe blogul Google.
Modelului AI Gemini 1.5 Pro a depasit predecesorul sau in 87% din testele de referinta pe care Google le foloseste, a afirmat compania. In plus, in 99% din cazuri, Gemini 1.5 a reusit sa gaseasca un mic fragment de text in blocuri de date de pana la un milion de token-uri in timpul testelor cunoscute sub numele de evaluare „ace in carul cu fan”.
Gemini 1.5 devine, de asemenea, mai bun la generarea de raspunsuri bune din interogari super-lungi, fara ca un utilizator sa fie nevoit sa petreaca mult timp suplimentar ajustand interogarile sale.
Reprezentantii Google au declarat ca testerii i-au furnizat lui Gemini 1.5 un manual de gramatica pentru limbajul obscur, iar LLM-ul a fost capabil sa traduca textul in limba engleza la un nivel similar cu capacitatea umana.
Pe masura ce AI-ul devine mai puternic, cresc si preocuparile legate de rolul tehnologiei in probleme de siguranta, de la militarizare la frauda.
Reprezentantii Google afirma ca, in dezvoltarea lui, Gemini 1.5 a trecut printr-o testare extensiva a eticii si sigurantei, pentru a permite lansarea sa pe scara larga. Google a efectuat cercetari privind riscurile de siguranta ale AI-ului si a dezvoltat tehnici pentru a preveni aceste riscuri.
