Alibaba lansează modelele compacte Qwen 3.5, care funcționează direct pe laptopuri și depășesc echivalentele de la OpenAI.

Alibaba lansează modelele compacte Qwen 3.5, care funcționează direct pe laptopuri și depășesc echivalentele de la OpenAI.

21 hardware

Alibaba Qwen 3.5 — noua serie de modele AI compacte

În cadrul diviziei sale de inteligență artificială, Alibaba a anunțat lansarea unei linii de modele Qwen 3.5, care promit „dimensiune mică + eficiență ridicată”. În comparație cu echivalentele americane, acestea demonstrează o precizie mai bună la un volum de memorie mai redus.

ModelDimensiuneCaracteristici cheie
Qwen 3.5‑0.8B0,8 miliarde de parametri„Miniatură” și „rapidă”, destinată prototipurilor și dispozitivelor mobile cu autonomie limitată
Qwen 3.5‑2B2 miliardeSimilar cu 0.8B, dar puțin mai puternic
Qwen 3.5‑4B4 miliardeMultimodal, fereastră de context 262 144 de tokeni; potrivit pentru soluții ușoare de agenți
Qwen 3.5‑9B9 miliardePoate raționa, depășește OpenAI gpt‑oss‑120B (13,5× mai mulți parametri) și demonstrează nivelul unui postdoctorat în gândirea logică

Toate modelele sunt disponibile sub licența Apache 2.0, permițând utilizarea lor în proiecte comerciale și reînvățarea dacă este necesar.

Ce e nou în arhitectură?
Alibaba a renunțat la Transformer-ii clasici și a adoptat un schelet hibrid:

* Gated Delta Networks (GDN) – asigură o capacitate mare de transfer și latență scăzută.
* Mixture‑of‑Experts (MoE) – rezolvă problema memoriei limitate, caracteristică modelelor mici.

Datorită acestui lucru, Qwen 3.5 poate lucra cu tokeni multimodali simultan, fără a „atașa” generatorii de imagini la modelele textuale, ca în generațiile anterioare. În consecință, versiunile 4B și 9B pot recunoaște elemente UI și număra obiecte în video.

Teste și rezultate
Benchmark | Qwen 3.5‑9B | Comparatie |
---|---|---
MMMU‑Pro (vizual) | 70,1 % | Depășește Google Gemini 2.5 Flash‑Lite (59,7) și Qwen 3‑VL‑30B‑A3B (63,0)
Gândire logică | 81,7 % | Mai mult decât OpenAI gpt‑oss‑120B (80,1), deși ultimul are 10× mai mulți parametri
HMMT Feb 2025 (matematică) | 83,2 % (9B), 74,0 % (4B) | Demonstrează că pentru sarcini complexe de științe exacte nu sunt necesare resurse cloud gigantice
OmniDocBench v1.58 | 7,87 % | Lider printre toate modelele
MMMLU (multilingvitate) | 81,2 % | Depășește gpt‑oss‑120B (78,2 %)

De ce contează?
Lansarea Qwen 3.5 a coincis cu creșterea cererii pentru agenți AI autonomi. Utilizatorul modern nu caută doar chatboturi, ci și sisteme care:

1. Gândește – raționează asupra problemelor.
2. Vede – procesează imagini, video și elemente UI.
3. Acționează – poate folosi instrumente (umple formulare, sortează fișiere).

Având în vedere că modelele mari (de la 3 la 5 miliarde de parametri) sunt costisitoare de operat, Qwen 3.5 reprezintă o soluție mai economică. Modelele pot fi rulate local fără conexiune la cloud și API; antrenamentul prin întărire le permite să ia „decizii umane” – de exemplu, să organizeze biroul sau să dezvolte cod pe baza unei înregistrări video.

Aplicații practice
* Dispozitive mobile – 0,8 miliarde de parametri se potrivesc cu ușurință într-un smartphone și asigură funcționare autonomă.
* Stații de lucru – 9 miliarde de parametri oferă un set complet de funcționalități ale agentului AI fără cloud.
* Agenție de interfață – datorită „legăturii la nivel de pixel”, modelele pot naviga UI, umple formulare și sorta fișiere, executând comenzi simple în limbaj natural cu precizie de aproximativ 90 %.

Astfel, Alibaba Qwen 3.5 deschide drumul către agenți AI mai accesibili, flexibili și puternici, care pot opera atât în cloud, cât și local, satisfăcând cerințele tot mai mari ale utilizatorului modern.

Comentarii (0)

Împărtășește-ți opinia — te rugăm să fii politicos și să rămâi la subiect.

Încă nu există comentarii. Lasă un comentariu și împărtășește-ți opinia!

Pentru a lăsa un comentariu, autentifică-te.

Autentifică-te pentru a comenta