Alibaba lansează modelele compacte Qwen 3.5, care funcționează direct pe laptopuri și depășesc echivalentele de la OpenAI.
Alibaba Qwen 3.5 — noua serie de modele AI compacte
În cadrul diviziei sale de inteligență artificială, Alibaba a anunțat lansarea unei linii de modele Qwen 3.5, care promit „dimensiune mică + eficiență ridicată”. În comparație cu echivalentele americane, acestea demonstrează o precizie mai bună la un volum de memorie mai redus.
| Model | Dimensiune | Caracteristici cheie |
|---|---|---|
| Qwen 3.5‑0.8B | 0,8 miliarde de parametri | „Miniatură” și „rapidă”, destinată prototipurilor și dispozitivelor mobile cu autonomie limitată |
| Qwen 3.5‑2B | 2 miliarde | Similar cu 0.8B, dar puțin mai puternic |
| Qwen 3.5‑4B | 4 miliarde | Multimodal, fereastră de context 262 144 de tokeni; potrivit pentru soluții ușoare de agenți |
| Qwen 3.5‑9B | 9 miliarde | Poate raționa, depășește OpenAI gpt‑oss‑120B (13,5× mai mulți parametri) și demonstrează nivelul unui postdoctorat în gândirea logică |
Toate modelele sunt disponibile sub licența Apache 2.0, permițând utilizarea lor în proiecte comerciale și reînvățarea dacă este necesar.
Ce e nou în arhitectură?
Alibaba a renunțat la Transformer-ii clasici și a adoptat un schelet hibrid:
* Gated Delta Networks (GDN) – asigură o capacitate mare de transfer și latență scăzută.
* Mixture‑of‑Experts (MoE) – rezolvă problema memoriei limitate, caracteristică modelelor mici.
Datorită acestui lucru, Qwen 3.5 poate lucra cu tokeni multimodali simultan, fără a „atașa” generatorii de imagini la modelele textuale, ca în generațiile anterioare. În consecință, versiunile 4B și 9B pot recunoaște elemente UI și număra obiecte în video.
Teste și rezultate
Benchmark | Qwen 3.5‑9B | Comparatie |
---|---|---
MMMU‑Pro (vizual) | 70,1 % | Depășește Google Gemini 2.5 Flash‑Lite (59,7) și Qwen 3‑VL‑30B‑A3B (63,0)
Gândire logică | 81,7 % | Mai mult decât OpenAI gpt‑oss‑120B (80,1), deși ultimul are 10× mai mulți parametri
HMMT Feb 2025 (matematică) | 83,2 % (9B), 74,0 % (4B) | Demonstrează că pentru sarcini complexe de științe exacte nu sunt necesare resurse cloud gigantice
OmniDocBench v1.58 | 7,87 % | Lider printre toate modelele
MMMLU (multilingvitate) | 81,2 % | Depășește gpt‑oss‑120B (78,2 %)
De ce contează?
Lansarea Qwen 3.5 a coincis cu creșterea cererii pentru agenți AI autonomi. Utilizatorul modern nu caută doar chatboturi, ci și sisteme care:
1. Gândește – raționează asupra problemelor.
2. Vede – procesează imagini, video și elemente UI.
3. Acționează – poate folosi instrumente (umple formulare, sortează fișiere).
Având în vedere că modelele mari (de la 3 la 5 miliarde de parametri) sunt costisitoare de operat, Qwen 3.5 reprezintă o soluție mai economică. Modelele pot fi rulate local fără conexiune la cloud și API; antrenamentul prin întărire le permite să ia „decizii umane” – de exemplu, să organizeze biroul sau să dezvolte cod pe baza unei înregistrări video.
Aplicații practice
* Dispozitive mobile – 0,8 miliarde de parametri se potrivesc cu ușurință într-un smartphone și asigură funcționare autonomă.
* Stații de lucru – 9 miliarde de parametri oferă un set complet de funcționalități ale agentului AI fără cloud.
* Agenție de interfață – datorită „legăturii la nivel de pixel”, modelele pot naviga UI, umple formulare și sorta fișiere, executând comenzi simple în limbaj natural cu precizie de aproximativ 90 %.
Astfel, Alibaba Qwen 3.5 deschide drumul către agenți AI mai accesibili, flexibili și puternici, care pot opera atât în cloud, cât și local, satisfăcând cerințele tot mai mari ale utilizatorului modern.
Comentarii (0)
Împărtășește-ți opinia — te rugăm să fii politicos și să rămâi la subiect.
Autentifică-te pentru a comenta