impetroAIAI Digest

Archiv

47 vydání v archivu · filtrujte podle zdroje, tématu nebo data.

Zrušit

2 novinky · zobrazeno 1–2

čtvrtek 24. září 2026

🛎️ Grok 4.7 Failed Its Own Hype

Nový model Grok 4.7 od xAI, prezentovaný jako nejvýkonnější model pro kódování za poloviční cenu a dvojnásobnou rychlost, podle testerů ztrácí na 3D a frontend úlohách proti staršímu Grok 4.6 a v benchmarcích zaostává za Fable 5.1 Max a GPT 5.6 Sol Max; spotřebovává přitom dvojnásobek tokenů za stejnou cenu. Meta spustila zdarma dostupného asistenta Muse, který za prvních 12 dní nasbíral 1,8 milionu stažení na iOS v USA a Kanadě (359 tisíc denních uživatelů) a předstihl tak raná čísla ChatGPT; Amazon mu ale zablokoval nákupy na svém webu. Výrobce čipů AMD v pondělí poprvé překročil tržní kapitalizaci 1 bilionu dolarů díky prodeji celých serverových racků, včetně kontraktů se 6 gigawatty pro OpenAI a Metu; Nvidia si i tak drží hodnotu 5,4 bilionu dolarů.

Proč to je důležité: Pro české B2B firmy je klíčové sledovat reálný výkon a cenu AI modelů nezávisle na marketingu dodavatelů a zároveň vnímat, že extrémní poptávka po AI infrastruktuře bude dál tlačit na ceny a dostupnost cloudových AI služeb.

úterý 15. září 2026

[AINews] AEF-1 standard emerges for Third Party Evaluators, as Xai, OpenAI, and Anthropic all cosign

AI Evaluator Forum (založené v prosinci 2025) zveřejnil standard AEF-1 definující pravidla přístupu, konfliktu zájmů, financování a transparentnosti pro nezávislé třetí strany hodnotící bezpečnost AI modelů; standard podepsaly xAI, OpenAI i Anthropic. Souběžně Dario Amodei (Anthropic) zveřejnil osobní blogpost navazující na červencový dopis o "zpomalení" vývoje AI, kde Anthropic jednostranně slibuje evaluátorům typu METR trvalý zaměstnanecký přístup – vlastní stůl, přístupovou kartu i firemní notebook. Reakce byla rozporuplná: Bilal Chughtai (bývalý Google DeepMind) volá po větším zpomalení a transparentnosti, zatímco Dan Selsam upozorňuje, že situačně uvědomělé modely mohou evaluace obelhávat; naopak Aidan Gomez (Cohere) a další kritizují, že pár firem ze Silicon Valley se stává "gatekeepery" AI pro vlády. Vydání dále shrnuje uvolnění DeepSeek-V4.1-Flash (nejlepší poměr cena/výkon mezi open modely, cca 0,06–0,07 USD za úlohu) a další novinky (Gemini Live s Deep Research, OpenAI snížení cen hlasového režimu o 60 %).

Proč to je důležité: Pro české B2B firmy jde zatím spíše o signál budoucí regulace než o okamžitě akcionovatelnou věc – vznikající standard nezávislého auditu (AEF-1) ale naznačuje, že enterprise nasazení frontier modelů bude čím dál víc vyžadovat důkaz o bezpečnostních auditech dodavatele. Cenově efektivní modely jako DeepSeek-V4.1-Flash jsou už dnes prakticky využitelné pro snížení nákladů na AI agenty.