impetroAIAI Digest

Archiv

47 vydání v archivu · filtrujte podle zdroje, tématu nebo data.

Zrušit

6 novinek · zobrazeno 1–6

pátek 25. září 2026

Extract, now 4x faster ⚡️ | LlamaIndex Newsletter

LlamaIndex vydal aktualizaci nástroje Extract, který nyní zpracovává dokumenty až 4x rychleji než dříve, konkrétně 3,7 sekundy na stránku, přičemž latence zůstává téměř konstantní i u delších dokumentů. Zároveň vyšel LiteParse v2.14.6, který parsuje textová PDF o 25 % rychleji a stále běží lokálně v Pythonu, Node.js, Rustu nebo přímo v prohlížeči. LlamaParse nově čte tabulky ze spreadsheetů nativně z buněk místo převodu na text, takže hodnoty si zachovávají svůj kontext. Firma dále experimentálně postavila nástroj DocJev na modelu Jev, který klasifikuje a rozděluje dokumenty 6x rychleji než GPT-5.6 Luna při srovnatelné přesnosti. Newsletter také shrnuje, že Anthropic a OpenAI ve stejný den snížily ceny modelů (Claude Opus 5.5 na 4/20 USD za milion tokenů, GPT-6 Sol na 2/10 USD, Luna na 0,10/0,50 USD) a že Xiaomi open-sourcovala model MiMo-V2.6 pod licencí MIT.

Proč to je důležité: Rychlejší a přesnější extrakce dat z dokumentů snižuje náklady firmám zpracovávajícím velké objemy smluv, faktur nebo pojistných zpráv a urychluje nasazení AI agentů do produkce; současné cenové války mezi Anthropic a OpenAI navíc dále snižují vstupní náklady na provoz LLM v byznysu.

pátek 4. září 2026

Gemini 3.8 Flash makes efficiency its calling card

Google ve středu uvedl Gemini 3.8 Flash, třetí model řady Flash za posledních šest týdnů, který má být jeho nejlepší model pro reasoning a programování při stejné rychlosti a ceně jako předchůdce Gemini 3.7 Flash. Úvodní ceny jsou 0,75 USD za milion vstupních a 3,75 USD za milion výstupních tokenů, model zlepšuje softwarové inženýrství, agentní úlohy a víceúrovňové uvažování. Souběžně Google spustil i Gemini 3.8 Flash Cyber, specializovaný bezpečnostní model s frontier úrovní výkonu v detekci zranitelností a automatizovaném patchování. Google tak sází na poměr cena/výkon v době, kdy ceny tokenů celkově klesají díky přechodu firem na open-source a menší modely.

Proč to je důležité: Levnější a rychlejší modely s dobrým poměrem výkon/cena umožňují firmám nasazovat AI agenty do produkce bez extrémních nákladů na tokeny, což je pro české B2B firmy prakticky využitelné hned – nejde jen o hype kolem frontier modelů.

čtvrtek 3. září 2026

🛎️ A Leader's Curse

Anthropic vydal Fable 5.1 a Mythos 5.1 – skóre na Terminal-Bench vyskočilo z 24,7 % na 52,6 %, respektive 60,9 % u Mythos 5.1, oproti 22,4 % u GPT-5.6 Sol. Cena za cache read klesla o 75 % na 0,25 USD, celkové náklady o 25 %, přesto je model šestkrát dražší než konkurence a zákazníci masově přecházejí na levnější Opus 5 (6% podíl na enterprise trhu). Souběžně podala žádost o IPO firma SB Energy (podpořená Softbank, OpenAI a Nvidia) s nulovými tržbami z datacenter, ztrátou 3,2 miliardy USD za první pololetí 2026 a financováním 105 miliard USD od Nvidie. Google a NASA JPL zveřejnili open-source model MAPL-EMIT, který ze satelitních dat detekuje o 50 % více úniků metanu než dosavadní metoda NASA. Profesor informatiky na Nanjing University zároveň řekl studentům, že bez placených API tokenů by měli školu opustit.

Proč to je důležité: Pro české B2B firmy je klíčové sledovat cenovou válku mezi Anthropic a OpenAI, protože rozhoduje o skutečných nákladech na nasazení AI agentů a modelů ve firemních procesech; bublina kolem AI infrastruktury (SB Energy) navíc ukazuje riziko přeinvestování do datacenter bez reálné poptávky.

pondělí 17. srpna 2026

[AINews] Gemini 3.7 Flash brings GDM back to the forefront

Google vydalo Gemini 3.7 Flash jen tři týdny po verzi 3.6 – nový výkonný model pro coding, agentní úlohy a běžnou práci se znatelně lepšími benchmarky (DeepSWE 65,3 % vs 49,0 %, FrontierCode 43,6 % vs 34,4 %, Code Arena Elo 1588) a zaváděcí slevou 50 % do konce roku (0,75 USD / 3,75 USD za 1M tokenů vstup/výstup, později 1,50 USD / 7,50 USD). Model se okamžitě rozšířil do Gemini API, AI Studia, Android Studia, Antigravity, Gemini Enterprise i externích nástrojů (Cline, Devin, VS Code Agents). Navzdory zlepšení chybí už 6 měsíců update modelu Gemini Pro, což vyvolává otázky o budoucím směřování Google DeepMind. Newsletter dále shrnuje: OpenAI + Cerebras spustili GPT-5.6 Sol „Ultrafast” (až 750 tokenů/s), DeepSeek open-sourcoval agentní harness pod MIT licencí a zároveň zdražil API až o 1114 % u cache-hitů (od 16. 8. 2026), a xAI představil Grok 4.6 srovnatelný s GPT-5.6 Sol za výrazně nižší cenu.

Proč to je důležité: Pro české B2B firmy je to okamžitě akční signál – 50% sleva na Gemini 3.7 Flash a jeho rychlá integrace do běžných vývojářských nástrojů snižují náklady na nasazení AI do coding a agentních workflow ještě letos. Zároveň prudké zdražení DeepSeek API ukazuje, že levné čínské modely nejsou spolehlivá dlouhodobá cenová kotva pro produkční nasazení.

pátek 14. srpna 2026

[AINews] Gemini 3.7 Flash brings GDM back to the forefront

Google vydal Gemini 3.7 Flash jen tři týdny po verzi 3.6 jako pracovní koník pro kódování a agentní úlohy, s výrazným nárůstem výkonu (DeepSWE 65,3 % vs 49,0 %, FrontierCode 43,6 % vs 34,4 %, AutomationBench 30,4 % vs 17,0 %) a zaváděcí slevou 50 % do konce roku (0,75 $/3,75 $ za 1M tokenů vstup/výstup, později 1,50 $/7,50 $). Model se hned objevil v Gemini API, AI Studiu, Antigravity, Gemini Enterprise i nástrojích třetích stran (Cline, Devin, VS Code). Artificial Analysis mu dala skóre inteligence 56 (+4 body) a umístila jej mezi TOP modely v Code a Agent Arene, přesto Google už 6 měsíců nevydal aktualizaci vlajkové řady Pro. Vedle toho OpenAI s Cerebrasem představili GPT-5.6 Sol „Ultrafast“ (až 750 tokenů/s, 14x rychlejší), DeepSeek open-sourcoval agentní harness „DeepSeek Harness“ pod MIT licencí a od 16. srpna 2026 zdražuje API (cache hit až o 1114 %), a EU Code of Practice o transparentnosti AI obsahu podepsaly Anthropic, OpenAI, Google, Meta, Microsoft i Mistral.

Proč to je důležité: Levnější a rychlejší Gemini 3.7 Flash i GPT-5.6 Ultrafast snižují náklady na agentní a kódovací workflow – firmy mohou hned přehodnotit poměr cena/výkon u dodavatele LLM. Naopak skokové zdražení DeepSeek API je varováním, že levné čínské modely nejsou dlouhodobě cenově stabilní pro produkční nasazení.

🛎️ The Frontier Lost Its Excuse

DeepSeek V4 Pro a Grok 4.6 vyšly během jedné noci s odstupem dvou hodin a oba se přiblížily úrovni Claude Fable 5: DeepSeek srovnal Fable v Terminal Bench (87,9 vs. 88,0) za zlomek ceny (výstup cca 0,87 USD/M tokenů oproti 50 USD u Fable, i když avizoval budoucí zdražení), Grok 4.6 dokončil kódovací úlohy trvající přes 30 minut na GPT-5.6 Sol za méně než 20 minut (někdy 3) za 2 USD/6 USD za milion tokenů. Google DeepMind zároveň spustil SL2T, model překládající znakový jazyk na text v Gboardu a Live Transcribe na Pixelu 11 (zatím jen ASL do angličtiny), trénovaný na 100 000+ hodinách z 50+ znakových jazyků. Výzkumníci z Tübingenu a Max Planck Institute prolomili šifrované "reasoning traces" API modelů OpenAI, Anthropic a Google pomocí menšího sesterského modelu se stejným klíčem, čímž odhalili i hesla a API klíče v datech; poskytovatelé záplatu vydali minulý měsíc, únik ale prý stále částečně přetrvává. Australan Paul Conyngham založil s podporou Y Combinatoru startup Gamgee na personalizované mRNA vakcíny proti rakovině pro psy poté, co s ChatGPT a Grokem navrhl léčbu pro svého psa – přičemž souvislost mezi vakcínou a zlepšením psa nebyla prokázána.

Proč to je důležité: Cenový a rychlostní tlak od DeepSeeku a Groku mění nákupní rozhodování firem – dražší modely už nelze obhájit jen kvalitou, takže má smysl přehodnotit dodavatele LLM podle poměru cena/výkon/rychlost pro konkrétní use case. Únik reasoning traces je bezpečnostní riziko pro firmy posílající citlivá data přes API (hesla, klíče), na které by se mělo reagovat auditem, ne čekat na plné zalepení architektury.