impetroAIAI Digest

Archiv

47 vydání v archivu · filtrujte podle zdroje, tématu nebo data.

Zrušit

3 novinky · zobrazeno 1–3

čtvrtek 24. září 2026

🛎️ Grok 4.7 Failed Its Own Hype

Nový model Grok 4.7 od xAI, prezentovaný jako nejvýkonnější model pro kódování za poloviční cenu a dvojnásobnou rychlost, podle testerů ztrácí na 3D a frontend úlohách proti staršímu Grok 4.6 a v benchmarcích zaostává za Fable 5.1 Max a GPT 5.6 Sol Max; spotřebovává přitom dvojnásobek tokenů za stejnou cenu. Meta spustila zdarma dostupného asistenta Muse, který za prvních 12 dní nasbíral 1,8 milionu stažení na iOS v USA a Kanadě (359 tisíc denních uživatelů) a předstihl tak raná čísla ChatGPT; Amazon mu ale zablokoval nákupy na svém webu. Výrobce čipů AMD v pondělí poprvé překročil tržní kapitalizaci 1 bilionu dolarů díky prodeji celých serverových racků, včetně kontraktů se 6 gigawatty pro OpenAI a Metu; Nvidia si i tak drží hodnotu 5,4 bilionu dolarů.

Proč to je důležité: Pro české B2B firmy je klíčové sledovat reálný výkon a cenu AI modelů nezávisle na marketingu dodavatelů a zároveň vnímat, že extrémní poptávka po AI infrastruktuře bude dál tlačit na ceny a dostupnost cloudových AI služeb.

pondělí 21. září 2026

Martin Kováč via LinkedIn18. 9.AI agentiGrokSpaceXAIAutonomní tvorba produktu

Grok Bot Galaxy ukázal, ako traja ľudia za 3 dni dokážu postaviť produkt a základy firmy

Od 15. do 17. září proběhla v San Franciscu (The Howard) akce Grok Bot Galaxy, kterou firma SpaceXAI tři dny naživo vysílala na X, bez předem připraveného scénáře. Tři zástupci SpaceXAI přišli bez názvu firmy, produktu i nápadu a měli k dispozici tým Grok Botů, tedy AI agentů s vlastními cloudovými počítači a pamětí, kteří pracují i ve chvíli, kdy člověk zavře laptop. První den vznikla prázdná organizace na GitHubu s pracovním názvem Ship by Thursday a nasadili se rešeršní boti, kteří procházeli reakce lidí na X a sbírali problémy a nápady pro brainstorming se sledovateli streamu. Ve čtvrtek odpoledne tým spustil hotový produkt, hru Thursday Arena, kterou si může vyzkoušet kdokoliv, a souběžně probíhaly workshopy pro inženýry, produktové manažery, obchodníky, podporu i marketéry.

Proč to je důležité: Pro české B2B firmy je to konkrétní ukázka, kam směřuje agentní AI – ne teoretický hype, ale reálný test toho, co autonomní agenti zvládnou sami (research, brainstorming, stavba produktu) a kde je stále nutný lidský dohled.

pátek 14. srpna 2026

🛎️ The Frontier Lost Its Excuse

DeepSeek V4 Pro a Grok 4.6 vyšly během jedné noci s odstupem dvou hodin a oba se přiblížily úrovni Claude Fable 5: DeepSeek srovnal Fable v Terminal Bench (87,9 vs. 88,0) za zlomek ceny (výstup cca 0,87 USD/M tokenů oproti 50 USD u Fable, i když avizoval budoucí zdražení), Grok 4.6 dokončil kódovací úlohy trvající přes 30 minut na GPT-5.6 Sol za méně než 20 minut (někdy 3) za 2 USD/6 USD za milion tokenů. Google DeepMind zároveň spustil SL2T, model překládající znakový jazyk na text v Gboardu a Live Transcribe na Pixelu 11 (zatím jen ASL do angličtiny), trénovaný na 100 000+ hodinách z 50+ znakových jazyků. Výzkumníci z Tübingenu a Max Planck Institute prolomili šifrované "reasoning traces" API modelů OpenAI, Anthropic a Google pomocí menšího sesterského modelu se stejným klíčem, čímž odhalili i hesla a API klíče v datech; poskytovatelé záplatu vydali minulý měsíc, únik ale prý stále částečně přetrvává. Australan Paul Conyngham založil s podporou Y Combinatoru startup Gamgee na personalizované mRNA vakcíny proti rakovině pro psy poté, co s ChatGPT a Grokem navrhl léčbu pro svého psa – přičemž souvislost mezi vakcínou a zlepšením psa nebyla prokázána.

Proč to je důležité: Cenový a rychlostní tlak od DeepSeeku a Groku mění nákupní rozhodování firem – dražší modely už nelze obhájit jen kvalitou, takže má smysl přehodnotit dodavatele LLM podle poměru cena/výkon/rychlost pro konkrétní use case. Únik reasoning traces je bezpečnostní riziko pro firmy posílající citlivá data přes API (hesla, klíče), na které by se mělo reagovat auditem, ne čekat na plné zalepení architektury.