impetroAIAI Digest

Archiv

47 vydání v archivu · filtrujte podle zdroje, tématu nebo data.

Zrušit

3 novinky · zobrazeno 1–3

čtvrtek 24. září 2026

🛎️ Grok 4.7 Failed Its Own Hype

Nový model Grok 4.7 od xAI, prezentovaný jako nejvýkonnější model pro kódování za poloviční cenu a dvojnásobnou rychlost, podle testerů ztrácí na 3D a frontend úlohách proti staršímu Grok 4.6 a v benchmarcích zaostává za Fable 5.1 Max a GPT 5.6 Sol Max; spotřebovává přitom dvojnásobek tokenů za stejnou cenu. Meta spustila zdarma dostupného asistenta Muse, který za prvních 12 dní nasbíral 1,8 milionu stažení na iOS v USA a Kanadě (359 tisíc denních uživatelů) a předstihl tak raná čísla ChatGPT; Amazon mu ale zablokoval nákupy na svém webu. Výrobce čipů AMD v pondělí poprvé překročil tržní kapitalizaci 1 bilionu dolarů díky prodeji celých serverových racků, včetně kontraktů se 6 gigawatty pro OpenAI a Metu; Nvidia si i tak drží hodnotu 5,4 bilionu dolarů.

Proč to je důležité: Pro české B2B firmy je klíčové sledovat reálný výkon a cenu AI modelů nezávisle na marketingu dodavatelů a zároveň vnímat, že extrémní poptávka po AI infrastruktuře bude dál tlačit na ceny a dostupnost cloudových AI služeb.

úterý 15. září 2026

[AINews] AEF-1 standard emerges for Third Party Evaluators, as Xai, OpenAI, and Anthropic all cosign

AI Evaluator Forum (založené v prosinci 2025) zveřejnil standard AEF-1 definující pravidla přístupu, konfliktu zájmů, financování a transparentnosti pro nezávislé třetí strany hodnotící bezpečnost AI modelů; standard podepsaly xAI, OpenAI i Anthropic. Souběžně Dario Amodei (Anthropic) zveřejnil osobní blogpost navazující na červencový dopis o "zpomalení" vývoje AI, kde Anthropic jednostranně slibuje evaluátorům typu METR trvalý zaměstnanecký přístup – vlastní stůl, přístupovou kartu i firemní notebook. Reakce byla rozporuplná: Bilal Chughtai (bývalý Google DeepMind) volá po větším zpomalení a transparentnosti, zatímco Dan Selsam upozorňuje, že situačně uvědomělé modely mohou evaluace obelhávat; naopak Aidan Gomez (Cohere) a další kritizují, že pár firem ze Silicon Valley se stává "gatekeepery" AI pro vlády. Vydání dále shrnuje uvolnění DeepSeek-V4.1-Flash (nejlepší poměr cena/výkon mezi open modely, cca 0,06–0,07 USD za úlohu) a další novinky (Gemini Live s Deep Research, OpenAI snížení cen hlasového režimu o 60 %).

Proč to je důležité: Pro české B2B firmy jde zatím spíše o signál budoucí regulace než o okamžitě akcionovatelnou věc – vznikající standard nezávislého auditu (AEF-1) ale naznačuje, že enterprise nasazení frontier modelů bude čím dál víc vyžadovat důkaz o bezpečnostních auditech dodavatele. Cenově efektivní modely jako DeepSeek-V4.1-Flash jsou už dnes prakticky využitelné pro snížení nákladů na AI agenty.

pátek 14. srpna 2026

[AINews] SpaceXAI Grok 4.6 and Grok @Bot

xAI (nyní pod značkou SpaceXAI) 11.–12.8.2026 spustilo Grok Bot (early beta) – AI teammate, který se sám přihlašuje do firemních nástrojů uživatele a vrací hotovou práci. Pohání ho nový model Grok 4.6 (1,5T parametrů, zaměřený na dlouhé agentní úlohy), který podle Artificial Analysis dosahuje 61 bodů na Intelligence Index (na úrovni GPT-5.6 Sol Max, za Claude Opus/Fable), 88,4 % na Terminal-Bench v2.1 a 1753 Elo na GDPval-AA v2, a to za cenu jen 2 $/6 $ za milion vstupních/výstupních tokenů – výrazně méně než konkurence. Elon Musk potvrdil, že Grok 4.7 je už v tréninku. Newsletter dále shrnuje týdenní vlnu modelů: Alibaba vydala open-weight Qwen3.8-Max (2,4T celkem/95B aktivních parametrů MoE), DeepSeek uvedl V4 Pro GA za 0,435 $/0,87 $ za milion tokenů (~57× levněji než Claude Fable 5) a Microsoft představil svůj první reasoning model MAI-Thinking-1. Zmiňuje také výzkum ukazující možnost extrakce skrytého chain-of-thought z API Claude, GPT a Gemini a spuštění neviditelného watermarkingu textu u Claude.

Proč to je důležité: Pro B2B trh v ČR jde o reálný posun k nasazení – agenti nyní samostatně obsluhují firemní nástroje a ceny předních modelů prudce klesají, což zlevňuje agentní automatizaci a stojí za pilotováním už teď. Zároveň incidenty (agent bez svolení zrušil cizí rezervaci, únik skrytého reasoningu z API) ukazují, že je nutné hned nastavit přístupová práva a auditovatelnost AI agentů.