Qwen3.5-9B sau Ministral-3-14B-Instruct-2512: cât de mult contează modelul IA locală?

My Wealth 1.6 oferă mai multe modele de inteligență artificială locală, adaptate resurselor fiecărui calculator. Qwen3.5-9B are 9 miliarde de parametri, iar Ministral-3-14B-Instruct-2512 are 14 miliarde.
Pe hârtie, Ministral are o capacitate mai mare. În practică, testele arată o realitate mai interesantă: modelul mai mare rezolvă mai des cererile complexe, dar nu este întotdeauna mai bun. Un model mai ușor poate fi mai direct, mai rapid și uneori mai fidel informațiilor structurate primite.
Comparația nu urmărește un câștigător absolut, ci înțelegerea modului în care raționează fiecare model și îmbunătățirea asistentului pentru toate profilurile.
Cum evaluăm modelele?
Folosim un patrimoniu de test reproductibil și întrebări formulate ca în aplicație. Scenariile acoperă valoarea și componența patrimoniului, alocarea și concentrarea, datoriile și activele finanțate, veniturile pasive, bugetele și operațiunile recurente, obiectivele și proiecțiile, corelarea mai multor surse și pregătirea modificărilor cu respectarea permisiunilor.
Modelul trebuie să înțeleagă cererea, să aleagă instrumentele MCP potrivite, să pregătească parametrii, să folosească rezultatele și să redacteze un răspuns conform datelor. Verificăm și că nu inventează valori și nu propune operațiuni nesolicitate.
Eșecurile sunt clasificate după prima cauză: instrument greșit, parametru inventat, valoare funcțională incorectă, răspuns insuficient fundamentat sau problemă de execuție. Adăugăm o corecție numai când urmele demonstrează necesitatea ei.
Rezultatele în cifre
Pentru o comparație echitabilă, ambele modele au primit aceleași 46 de întrebări despre același patrimoniu de referință și aceleași instrumente:
| Rezultat în cele 46 de scenarii comune | Qwen3.5-9B | Ministral-3-14B-Instruct-2512 |
|---|---|---|
| Teste reușite | 33 / 46 — 71,7% | 37 / 46 — 80,4% |
| Teste eșuate | 13 / 46 — 28,3% | 9 / 46 — 19,6% |
| Durată mediană observată | 2 min 52 s | 3 min 44 s |
Aceste cifre reprezintă o imagine din dezvoltare, nu un benchmark universal. Testele au rulat pe un Intel Core Ultra 7 165U, cu grafică Intel integrată și 18 GB de memorie partajată, fără placă grafică dedicată sau memorie video proprie. Chiar și așa, Qwen răspunde în câteva minute și procesează unele întrebări obișnuite în puțin peste un minut.
Ambele modele au folosit în practică partea Compute a GPU-ului Intel. Pentru Ministral, Vulkan poate raporta o aparentă trecere pe procesor, însă monitorizarea arată CPU-ul inactiv și sarcina pe GPU. Testele au însoțit și mai multe îmbunătățiri ale orchestratorului, astfel încât duratele nu izolează numai arhitectura modelelor.
În această campanie, Ministral a reușit mai multe scenarii, iar Qwen a rămas sensibil mai rapid. Modelul mai mare îmbunătățește anumite cereri complexe în schimbul mai multor resurse și al unui timp mai lung.
Unde are Ministral avantaj
Ministral s-a descurcat mai bine când trebuiau legate mai multe informații: comparații între proprietari, valoarea unei familii de active față de datorie, ponderea veniturilor din active financiare, active valoroase dar cu randament mic, active finanțate și pasive asociate, investiții recurente în bugete și obiectivele cele mai îndepărtate de țintă.
Acest lucru corespunde utilizării sale: comparații mai bogate, relații între entități și cereri cu mai multe etape.
Unde surprinde Qwen
Qwen nu este doar o alternativă mai ușoară. Se comportă adesea mai direct și nu reinterpretează inutil un rezumat clar sau un rezultat canonic.
Un lot recent a inclus cele patru întrebări implicite din panoul IA:
- Care este situația patrimoniului meu?
- Unde este patrimoniul meu cel mai concentrat?
- Ce activ are cea mai bună performanță?
- Ce parte din patrimoniu pot mobiliza rapid?
Qwen le-a rezolvat pe toate. Ministral a reușit trei la prima rulare completă, dar a omis concentrarea maximă deși informația era disponibilă. Selectase analiza MCP corectă; eroarea a apărut la reinterpretarea dimensiunilor returnate.
Un raționament mai elaborat poate rezolva o cerere complexă, dar poate și reclasifica sau îmbogăți inutil un răspuns deja calculat.
Modelul nu lucrează singur
Calitatea nu depinde doar de numărul parametrilor. My Wealth introduce un strat de orchestrare între întrebare și date. Acesta prezintă un catalog compact de instrumente, lasă modelul să le aleagă și să pregătească parametrii, validează apelurile, returnează erori structurate corectabile, calculează relații canonice din rezultatele MCP și păstrează modelul responsabil pentru înțelegere și redactare.
LLM-ul interpretează și explică, iar aplicația securizează accesul și stabilizează faptele exacte. Deoarece o instrucțiune eficientă pentru Qwen poate fi ignorată sau suprainterpretată de Ministral — și invers — My Wealth aplică politici adaptate fiecărui model, nu un singur prompt universal.
Ce profil să alegeți?
Qwen este cel mai bun punct de plecare pentru întrebări obișnuite, sinteze patrimoniale și calculatoare cu resurse limitate. Ministral este util când analizați simultan mai multe dimensiuni, comparați entități sau cereți mai multe etape. Nu garantează un răspuns perfect și poate dura mai mult, mai ales fără accelerare GPU.
Alegerea depinde de întrebări, resursele calculatorului și timpul de răspuns acceptabil.
Evaluarea continuă după lansare
Lansarea My Wealth 1.6 nu încheie această campanie. Orice eroare reproductibilă poate dezvălui un instrument ambiguu, o relație funcțională insuficient de clară sau un comportament specific modelului. Concluziile îmbunătățesc orchestratorul, contractele MCP și politicile și vor ghida viitoarele LLM-uri.
Ca orice inteligență artificială, asistentul poate greși. Informațiile financiare importante trebuie verificate întotdeauna, indiferent de profil.
