Qwen3.5-9B nebo Ministral-3-14B-Instruct-2512: jaký rozdíl lokální model AI skutečně přináší?

Výběr a konfigurace lokálního modelu umělé inteligence v My Wealth
Výběr a konfigurace lokálního modelu umělé inteligence v My Wealth

My Wealth 1.6 nabízí několik lokálních modelů AI podle prostředků počítače. Qwen3.5-9B má 9 miliard parametrů, Ministral-3-14B-Instruct-2512 jich má 14 miliard.

Na papíře má Ministral větší kapacitu. Testy však ukazují zajímavější skutečnost: větší model častěji zvládá složité požadavky, ale není vždy lepší. Lehčí model může být přímočařejší, rychlejší a někdy věrnější dodaným strukturovaným informacím.

Cílem tedy není určit absolutního vítěze, ale pochopit uvažování obou modelů a zlepšit asistenta pro všechny profily.

Jak modely hodnotíme?

Používáme reprodukovatelné testovací portfolio a otázky formulované jako v aplikaci. Scénáře pokrývají hodnotu a složení majetku, rozdělení a koncentraci, dluhy a financovaná aktiva, pasivní příjmy, rozpočty a opakované operace, investiční cíle a projekce, propojení více zdrojů i přípravu změn při dodržení oprávnění.

Model musí pochopit požadavek, vybrat správné nástroje MCP, připravit parametry, využít výsledky a napsat odpověď odpovídající datům. Kontrolujeme také, že nevymýšlí hodnoty ani nenavrhuje nevyžádanou operaci.

Selhání třídíme podle první příčiny: chybný nástroj, vymyšlený parametr, nesprávná věcná hodnota, nedostatečně podložená odpověď nebo problém provedení. Opravu přidáváme pouze tehdy, když její potřebu dokazují záznamy.

Výsledky v číslech

Pro spravedlivé porovnání dostaly oba modely stejných 46 otázek nad stejným referenčním portfoliem a stejné nástroje:

Výsledek ve 46 společných scénáříchQwen3.5-9BMinistral-3-14B-Instruct-2512
Úspěšné testy33 / 46 — 71,7 %37 / 46 — 80,4 %
Neúspěšné testy13 / 46 — 28,3 %9 / 46 — 19,6 %
Pozorovaný medián doby2 min 52 s3 min 44 s

Jde o snímek vývoje, nikoli univerzální benchmark. Testy proběhly na Intel Core Ultra 7 165U s integrovanou grafikou Intel a 18 GB sdílené paměti, bez samostatné grafické karty a vlastní videopaměti. Přesto Qwen odpovídá během několika minut a některé běžné otázky zvládá za něco přes minutu.

Oba modely ve skutečnosti využívaly část Compute grafického čipu Intel. U Ministralu může Vulkan hlásit zdánlivý přechod na CPU, sledování prostředků ale ukazuje nečinný procesor a zatíženou GPU. Testy navíc doprovázely postupná vylepšení orchestrátoru, takže časy neizolují pouze architekturu modelů.

Ministral v této kampani zvládl více scénářů, zatímco Qwen zůstal citelně rychlejší. Větší model zlepšuje některé složité požadavky za cenu více prostředků a času.

Kde má Ministral náskok

Ministral lépe propojoval více informací: porovnání vlastníků, hodnotu skupiny aktiv vůči dluhu, podíl příjmů z finančních aktiv, hodnotná ale málo výnosná aktiva, financovaná aktiva a související závazky, opakované rozpočtové investice a cíle nejvzdálenější od požadované hodnoty.

To odpovídá jeho určení: bohatší porovnání, vztahy mezi entitami a vícekrokové požadavky.

Kde Qwen překvapuje

Qwen není jen lehčí alternativa. Často odpovídá přímočařeji a jasný souhrn nebo kanonický výsledek zbytečně nepřehodnocuje.

Nedávná série obsahovala čtyři výchozí otázky panelu AI:

  1. Jaká je situace mého majetku?
  2. Kde je můj majetek nejvíce koncentrován?
  3. Které aktivum má nejlepší výkonnost?
  4. Jakou část majetku mohu rychle uvolnit?

Qwen zvládl všechny čtyři. Ministral při prvním úplném běhu zvládl tři, ale vynechal nejvyšší koncentraci, přestože údaj měl k dispozici. Vybral správnou analýzu MCP; chyba vznikla při nové interpretaci vrácených rozměrů.

Podrobnější uvažování může složitý požadavek vyřešit, ale také zbytečně přeskupit již vypočtenou odpověď.

Model nepracuje sám

Kvalita nezávisí jen na počtu parametrů. My Wealth přidává mezi otázku a data orchestrační vrstvu. Ta poskytuje kompaktní katalog nástrojů, nechává model vybírat nástroje a parametry, ověřuje volání, vrací opravitelné strukturované chyby, počítá kanonické vztahy z výsledků MCP a ponechává modelu pochopení i formulaci odpovědi.

LLM interpretuje a vysvětluje, aplikace zabezpečuje přístup a stabilizuje přesná fakta. Protože pokyn účinný pro Qwen může Ministral ignorovat nebo přehnaně vyložit — a naopak — používá My Wealth zásady přizpůsobené jednotlivým modelům namísto jediného univerzálního promptu.

Který profil zvolit?

Qwen je nejlepší výchozí volbou pro běžné otázky, souhrny majetku a počítače s omezenými prostředky. Ministral je zajímavý při práci s více rozměry, porovnávání entit a vícekrokových analýzách. Dokonalou odpověď však nezaručuje a zejména bez akcelerace GPU může být pomalejší.

Volba závisí na vašich otázkách, prostředcích počítače a přijatelné době odpovědi.

Hodnocení pokračuje i po vydání

Vydáním My Wealth 1.6 kampaň nekončí. Každá reprodukovatelná chyba může odhalit nejednoznačný nástroj, málo jasný věcný vztah nebo chování konkrétního modelu. Poznatky zlepšují orchestrátor, smlouvy MCP a zásady modelů a pomohou při výběru budoucích LLM.

Jako každá AI se může asistent mýlit. Důležité finanční informace je třeba vždy ověřit bez ohledu na profil.

Objevte My Wealth 1.6.0

Aktualizováno