impetroAIAI Digest

Archiv

47 vydání v archivu · filtrujte podle zdroje, tématu nebo data.

Zrušit

3 novinky · zobrazeno 1–3

pátek 25. září 2026

Extract, now 4x faster ⚡️ | LlamaIndex Newsletter

LlamaIndex vydal aktualizaci nástroje Extract, který nyní zpracovává dokumenty až 4x rychleji než dříve, konkrétně 3,7 sekundy na stránku, přičemž latence zůstává téměř konstantní i u delších dokumentů. Zároveň vyšel LiteParse v2.14.6, který parsuje textová PDF o 25 % rychleji a stále běží lokálně v Pythonu, Node.js, Rustu nebo přímo v prohlížeči. LlamaParse nově čte tabulky ze spreadsheetů nativně z buněk místo převodu na text, takže hodnoty si zachovávají svůj kontext. Firma dále experimentálně postavila nástroj DocJev na modelu Jev, který klasifikuje a rozděluje dokumenty 6x rychleji než GPT-5.6 Luna při srovnatelné přesnosti. Newsletter také shrnuje, že Anthropic a OpenAI ve stejný den snížily ceny modelů (Claude Opus 5.5 na 4/20 USD za milion tokenů, GPT-6 Sol na 2/10 USD, Luna na 0,10/0,50 USD) a že Xiaomi open-sourcovala model MiMo-V2.6 pod licencí MIT.

Proč to je důležité: Rychlejší a přesnější extrakce dat z dokumentů snižuje náklady firmám zpracovávajícím velké objemy smluv, faktur nebo pojistných zpráv a urychluje nasazení AI agentů do produkce; současné cenové války mezi Anthropic a OpenAI navíc dále snižují vstupní náklady na provoz LLM v byznysu.

pátek 4. září 2026

Gemini 3.8 Flash makes efficiency its calling card

Google ve středu uvedl Gemini 3.8 Flash, třetí model řady Flash za posledních šest týdnů, který má být jeho nejlepší model pro reasoning a programování při stejné rychlosti a ceně jako předchůdce Gemini 3.7 Flash. Úvodní ceny jsou 0,75 USD za milion vstupních a 3,75 USD za milion výstupních tokenů, model zlepšuje softwarové inženýrství, agentní úlohy a víceúrovňové uvažování. Souběžně Google spustil i Gemini 3.8 Flash Cyber, specializovaný bezpečnostní model s frontier úrovní výkonu v detekci zranitelností a automatizovaném patchování. Google tak sází na poměr cena/výkon v době, kdy ceny tokenů celkově klesají díky přechodu firem na open-source a menší modely.

Proč to je důležité: Levnější a rychlejší modely s dobrým poměrem výkon/cena umožňují firmám nasazovat AI agenty do produkce bez extrémních nákladů na tokeny, což je pro české B2B firmy prakticky využitelné hned – nejde jen o hype kolem frontier modelů.

čtvrtek 3. září 2026

🛎️ A Leader's Curse

Anthropic vydal Fable 5.1 a Mythos 5.1 – skóre na Terminal-Bench vyskočilo z 24,7 % na 52,6 %, respektive 60,9 % u Mythos 5.1, oproti 22,4 % u GPT-5.6 Sol. Cena za cache read klesla o 75 % na 0,25 USD, celkové náklady o 25 %, přesto je model šestkrát dražší než konkurence a zákazníci masově přecházejí na levnější Opus 5 (6% podíl na enterprise trhu). Souběžně podala žádost o IPO firma SB Energy (podpořená Softbank, OpenAI a Nvidia) s nulovými tržbami z datacenter, ztrátou 3,2 miliardy USD za první pololetí 2026 a financováním 105 miliard USD od Nvidie. Google a NASA JPL zveřejnili open-source model MAPL-EMIT, který ze satelitních dat detekuje o 50 % více úniků metanu než dosavadní metoda NASA. Profesor informatiky na Nanjing University zároveň řekl studentům, že bez placených API tokenů by měli školu opustit.

Proč to je důležité: Pro české B2B firmy je klíčové sledovat cenovou válku mezi Anthropic a OpenAI, protože rozhoduje o skutečných nákladech na nasazení AI agentů a modelů ve firemních procesech; bublina kolem AI infrastruktury (SB Energy) navíc ukazuje riziko přeinvestování do datacenter bez reálné poptávky.