Qwen3.5-9B ili Ministral-3-14B-Instruct-2512: koliko lokalni AI model doista mijenja iskustvo?

Odabir i konfiguracija lokalnog modela umjetne inteligencije u aplikaciji My Wealth
Odabir i konfiguracija lokalnog modela umjetne inteligencije u aplikaciji My Wealth

My Wealth 1.6 nudi više lokalnih AI modela prilagođenih resursima računala. Qwen3.5-9B ima 9 milijardi parametara, a Ministral-3-14B-Instruct-2512 njih 14 milijardi.

Na papiru Ministral ima veći kapacitet. U praksi testovi pokazuju zanimljiviju sliku: veći model češće rješava složene zahtjeve, ali nije uvijek bolji. Lakši model može biti izravniji, brži i ponekad vjerniji dostavljenim strukturiranim informacijama.

Ova usporedba zato ne traži apsolutnog pobjednika. Pomaže nam razumjeti način zaključivanja svakog modela i poboljšati asistenta za sve profile.

Kako ocjenjujemo modele?

Koristimo ponovljivi testni portfelj i pitanja oblikovana kao u aplikaciji. Scenariji obuhvaćaju vrijednost i sastav imovine, raspodjelu i koncentraciju, dugove i financiranu imovinu, pasivne prihode, proračune i ponavljajuće operacije, investicijske ciljeve i projekcije, povezivanje više izvora te pripremu izmjena uz poštovanje dopuštenja.

Model mora razumjeti zahtjev, odabrati odgovarajuće MCP alate, pripremiti parametre, iskoristiti rezultate i sastaviti odgovor usklađen s podacima. Provjeravamo i da ne izmišlja vrijednosti niti predlaže nezatražene operacije.

Neuspjehe razvrstavamo prema prvom uzroku: pogrešan alat, izmišljeni parametar, netočna poslovna vrijednost, nedovoljno utemeljen odgovor ili problem izvršavanja. Ispravak dodajemo samo kada zapisi potvrde da je potreban.

Rezultati u brojkama

Za poštenu usporedbu oba su modela dobila istih 46 pitanja o istom referentnom portfelju i iste alate:

Rezultat u 46 zajedničkih scenarijaQwen3.5-9BMinistral-3-14B-Instruct-2512
Uspješni testovi33 / 46 — 71,7 %37 / 46 — 80,4 %
Neuspješni testovi13 / 46 — 28,3 %9 / 46 — 19,6 %
Zabilježeno medijalno trajanje2 min 52 s3 min 44 s

Ove su brojke razvojna snimka, a ne univerzalni benchmark. Testovi su provedeni na računalu s procesorom Intel Core Ultra 7 165U, integriranom Intel grafikom i 18 GB dijeljene memorije, bez zasebne grafičke kartice i vlastite videomemorije. Unatoč tome Qwen odgovara za nekoliko minuta, a neka uobičajena pitanja obrađuje za nešto više od minute.

Oba su modela u praksi koristila Compute dio Intelova GPU-a. Kod Ministrala Vulkan može prijaviti prividni prelazak na CPU, ali praćenje resursa pokazuje da procesor miruje dok opterećenje ostaje na GPU-u. Testovi su pratili i više poboljšanja orkestratora, pa vremena ne izdvajaju samo arhitekturu modela.

U ovoj je kampanji Ministral riješio više scenarija, dok je Qwen ostao osjetno brži. Veći model poboljšava neke složene zahtjeve uz veću potrošnju resursa i vremena.

Gdje Ministral ima prednost

Ministral je bio uspješniji kada je trebalo povezati više podataka: uspoređivati vlasnike, vrijednost obitelji imovine s dugom, udio prihoda iz financijske imovine, vrijednu ali slabo prihodovnu imovinu, financiranu imovinu s povezanim obvezama, ponavljajuća ulaganja u proračunima te ciljeve najudaljenije od zadane vrijednosti.

To odgovara njegovoj namjeni: bogatije usporedbe, odnosi između više entiteta i zahtjevi s više koraka.

Gdje Qwen iznenađuje

Qwen nije samo lakša alternativa. Često je izravniji i ne reinterpretira nepotrebno jasan sažetak ili kanonski rezultat.

Nedavna serija sadržavala je četiri zadana pitanja AI panela:

  1. Kakvo je stanje moje imovine?
  2. Gdje je moja imovina najviše koncentrirana?
  3. Koja imovina ima najbolji rezultat?
  4. Koliki dio imovine mogu brzo mobilizirati?

Qwen je uspješno odgovorio na sva četiri. Ministral je u prvom potpunom izvođenju uspio u tri, ali je izostavio najveću koncentraciju premda je podatak bio dostupan. Odabrao je ispravnu MCP analizu; pogreška je nastala pri ponovnoj interpretaciji vraćenih dimenzija.

Razvijenije zaključivanje može riješiti složen zahtjev, ali i nepotrebno preurediti već izračunani odgovor.

Model ne radi sam

Kvaliteta ne ovisi samo o broju parametara. My Wealth između pitanja i podataka dodaje orkestracijski sloj. On prikazuje sažet katalog alata, dopušta modelu izbor alata i parametara, provjerava pozive, vraća ispravljive strukturirane pogreške, izračunava kanonske odnose iz MCP rezultata te modelu ostavlja razumijevanje i sastavljanje odgovora.

LLM tumači i objašnjava, a aplikacija štiti pristup i stabilizira točne činjenice. Budući da uputu učinkovitu za Qwen Ministral može zanemariti ili pretjerano protumačiti — i obratno — My Wealth koristi pravila prilagođena svakom modelu umjesto jednog univerzalnog prompta.

Koji profil odabrati?

Qwen je najbolje polazište za uobičajena pitanja, sažetke imovine i računala ograničenih resursa. Ministral je koristan kada analizirate više dimenzija, uspoređujete entitete ili tražite više koraka. Ne jamči savršen odgovor i može trajati dulje, osobito bez GPU ubrzanja.

Odabir ovisi o pitanjima, resursima računala i prihvatljivom vremenu odgovora.

Ocjenjivanje se nastavlja nakon izdanja

Izdanje My Wealth 1.6 ne završava ovu kampanju. Svaka ponovljiva pogreška može otkriti dvosmislen alat, nedovoljno jasan poslovni odnos ili ponašanje određenog modela. Zaključci poboljšavaju orkestrator, MCP ugovore i pravila modela te usmjeravaju izbor budućih LLM-ova.

Kao i svaka umjetna inteligencija, asistent može pogriješiti. Važne financijske informacije uvijek treba provjeriti, bez obzira na profil.

Otkrijte My Wealth 1.6.0

Ažurirano