Google a lansat Gemini 3 Deep Think – un serviciu AI avansat pentru sarcini științifice, care continuă să „regleze” răspunsurile în funcție de cereri
Google a prezentat o versiune actualizată a Gemini 3 Deep Think
Compania Google a anunțat o nouă actualizare majoră a platformei sale Gemini 3 Deep Think – inteligență artificială capabilă să raționeze și să rezolve probleme științifico‑ingineresti complexe.
Ce s-a schimbat
Parametru | Nou | Cum arată | Scop
---|---|---|---
De la teorie pură la aplicare practică | Rezolvarea problemelor fără limitări clare, cu date incomplete | Acces | Încorporat în aplicația Gemini; abonații Google AI Ultra pot folosi, iar prin API – ingineri și companii (se solicită cerere)
Parteneri de dezvoltare | Cercetători științifici | Colaborare la probleme complexe
Indicatori de performanță
Test | Rezultat | Comentariu
---|---|---
Examenul Ultim al Umanității | 48,4 % | Fără instrumente terțe
ARC‑AGI‑284,6 % | Benchmark pentru asistenți AI
Codeforces (Elo) | 3455 | Rating înalt printre soluțiile software
IMO 2025 | Medalie de aur | Echivalent nivel participanți olimpie internațională
Chimie/Fizică | Același rezultat | A demonstrat universalitate în diferite discipline
CMT‑Benchmark (fizică teoretică) | 50,5 % | Bună stăpânire a conceptelor complexe
Agentul AI „Aletheia”
În laboratorul DeepMind Google au creat agentul Aletheia pe baza Gemini 3 Deep Think. Caracteristici cheie:
1. Verificarea ipotezelor – agentul identifică punctele slabe ale soluțiilor propuse și le corectează iterativ.
2. Recunoașterea incertitudinii – poate spune că nu știe răspunsul.
3. Interacțiunea cu surse externe – folosește serviciul de căutare Google și navigarea pe web, evitând inventarea linkurilor.
Niveluri de realizare
Google a împărțit succesele Aletheia în cinci etape:
| Etapă | Descriere | Exemple |
|---|---|---|
| 0 – „inovație minoră” | Mod complet autonom, trei probleme ale lui P. Erdős rezolvate (primul nivel) | Trei probleme Erdős |
| 1 – „inovație minimă” | Un rezultat suplimentar în mod autonom | Problema a patra |
| 2 – „pregătire pentru publicare” | Rezultate atât autonome, cât și colaborative cu om, plus instrumente auxiliare | Date probleme 3–4 – „avans/descoperire semnificativă” |
Cum se descurcă Aletheia cu problemele Erdős
* Din cele 700 de probleme nerezolvate până acum, agentul a rezolvat 13.
* Totuși doar 4 dintre ele sunt cu adevărat noi – restul sunt deja cunoscute în comunitatea științifică.
* Dintre 212 soluții prezentate, doar 6,5 % au fost corecte substanțial; 68,5 % conțineau erori fundamentale, iar 31,5 % au interpretat greșit problema.
Dezvoltatorii menționează că AI tinde să „reinterpreteze întrebarea pentru a răspunde mai simplu” și rămâne „extrem de susceptibil la erori comparativ cu oamenii”. În consecință, încă nu se poate înlocui matematicienii cu inteligența artificială.
În concluzie: Gemini 3 Deep Think și agentul său Aletheia demonstrează rezultate impresionante în diverse domenii științifice, dar păstrează limitări semnificative în precizia și fiabilitatea soluțiilor. Google continuă să lucreze la îmbunătățirea capacității AI de raționament profund și verificare a propriilor concluzii.
Comentarii (0)
Împărtășește-ți opinia — te rugăm să fii politicos și să rămâi la subiect.
Autentifică-te pentru a comenta