impetroAIAI Digest

Archiv

47 vydání v archivu · filtrujte podle zdroje, tématu nebo data.

Zrušit

3 novinky · zobrazeno 1–3

pátek 2. října 2026

[AINews] Gemini 4 Argon: GDM's answer to Astra/Fable, with 1M output

Google DeepMind představil 30. září 2026 model Gemini 4 Argon, svou odpověď na konkurenční modely třídy Astra/Fable, zatím jen v omezeném přístupu pro vládní uživatele a kyberbezpečnostní experty v programu Fairwind. Model díky funkci Long Decode Continuation jako první v oboru zvládá výstup až 1 milion tokenů (oproti dřívějším 64 tisícům) a podle Google obsadil první místo v 13 z 19 sledovaných benchmarků proti GPT-6 Astra a Claude Opus 5.5 (např. 77,9 % na DeepSWE). Standardní cena je 4 USD/20 USD za milion vstupních/výstupních tokenů, se zaváděcí 50% slevou na 2/10 USD. Interně Google uvádí, že agenti na bázi Argonu uvolnili přes 300 TiB paměti datacenter a migrují přes 800 tisíc řádků C/C++ kódu do Rustu; nezávislí pozorovatelé ale zpochybňují některé publikované výsledky (např. nižší skóre v právním benchmarku Harvey oproti Muse Spark 1.2).

Proč to je důležité: Pro české firmy jde o signál, že do enterprise segmentu (kódování, znalostní práce, kybernetická obrana) přichází další silný a cenově konkurenční model, což zvyšuje tlak na ceny API a nabízí nové možnosti pro firemní AI nasazení, byť zatím jen v omezeném přístupu.

🛎️ Google Crowned Itself the GOAT

Google DeepMind vydal model Gemini 4 Argon, nejprve kyberbezpečnostním obráncům v programu Fairwind, poté placeným API zákazníkům. Google tvrdí, že model vede v benchmarcích pro programování, agenty a dlouhá videa, před OpenAI Astra a Anthropic Opus 5.5. Bloomberg ale cituje zaměstnance Google, podle kterých model selhává na produkčním kódu a je slabý ve front-endovém designu – interně se tomu říká „benchmaxxing“. Vydání přichází po tom, co slibovaný Gemini 3.5 Pro z května 2026 nikdy nevyšel, přestože šéf DeepMind Koray Kavukcuoglu týden předtím prohlásil, že týmu bezvýhradně věří a že zůstane na špici.

Proč to je důležité: Firmy by měly brát vlastní prohlášení AI labů o „nejlepším modelu“ s rezervou a před nasazením testovat modely na reálném produkčním kódu, ne jen podle benchmarků. Ukazuje to i širší riziko marketingového zkreslování výkonu AI nástrojů, které může ovlivnit nákupní rozhodnutí firem.

pondělí 28. září 2026

Claude objevil nový enzym, GPT-6 Sol zdražuje AI závod a česká hvězda Nápadu roku

Anthropic nasadil Claude do vlastní mokré laboratoře v Bay Area, kde model přes 950 agentů za 21 hodin prohledal databáze DNA a identifikoval nový enzymatický systém se znaky podobnými CRISPR; fyzické experimenty pak provedli lidé a výsledek čeká na ověření, i když MIT a Broad Institute jej označují za podnětný. Ve stejném týdnu, 22. září, Anthropic vydal Claude Opus 5.5 (rychlejší a o 20 procent levnější než Opus 5) a OpenAI o hodinu později odpověděla modely GPT-6 Sol (kódování, agenti) a Luna (rutinní úlohy), oba za poloviční cenu předchůdců - cenová válka mezi předními AI firmami tak zrychluje. Bezpečnostní firma Irregular navíc zjistila, že Gemini kvůli konfigurační chybě při testu v květnu 2026 pronikl do tří reálných firem, protože fiktivní testovací cíl sdílel jméno se skutečnou společností; Google incident zveřejnil až po sedmi týdnech, po dotazech Wall Street Journal. Na Meta Connect Zuckerberg představil rozšíření AI agenta Muse do chytrých brýlí a nový přívěskový gadget Muse Charm. Český startup PangeAI Marka Miltnera vyhrál soutěž Nápad roku a získal 300 000 Kč za AI model planety Země pro pojišťovny a energetické firmy.

Proč to je důležité: Pro české B2B firmy je klíčový hlavně cenový tlak (levnější a rychlejší modely Claude i GPT-6) a bezpečnostní incident Gemini jako varování před nedostatečně izolovaným testováním agentů s přístupem k internetu - objev enzymu je zatím spíše vědecký příslib než okamžitě využitelný byznys case.