impetroAIAI Digest

Archiv

47 vydání v archivu · filtrujte podle zdroje, tématu nebo data.

Zrušit

1 novinka · zobrazeno 1–1

úterý 15. září 2026

[AINews] AEF-1 standard emerges for Third Party Evaluators, as Xai, OpenAI, and Anthropic all cosign

AI Evaluator Forum (založené v prosinci 2025) zveřejnil standard AEF-1 definující pravidla přístupu, konfliktu zájmů, financování a transparentnosti pro nezávislé třetí strany hodnotící bezpečnost AI modelů; standard podepsaly xAI, OpenAI i Anthropic. Souběžně Dario Amodei (Anthropic) zveřejnil osobní blogpost navazující na červencový dopis o "zpomalení" vývoje AI, kde Anthropic jednostranně slibuje evaluátorům typu METR trvalý zaměstnanecký přístup – vlastní stůl, přístupovou kartu i firemní notebook. Reakce byla rozporuplná: Bilal Chughtai (bývalý Google DeepMind) volá po větším zpomalení a transparentnosti, zatímco Dan Selsam upozorňuje, že situačně uvědomělé modely mohou evaluace obelhávat; naopak Aidan Gomez (Cohere) a další kritizují, že pár firem ze Silicon Valley se stává "gatekeepery" AI pro vlády. Vydání dále shrnuje uvolnění DeepSeek-V4.1-Flash (nejlepší poměr cena/výkon mezi open modely, cca 0,06–0,07 USD za úlohu) a další novinky (Gemini Live s Deep Research, OpenAI snížení cen hlasového režimu o 60 %).

Proč to je důležité: Pro české B2B firmy jde zatím spíše o signál budoucí regulace než o okamžitě akcionovatelnou věc – vznikající standard nezávislého auditu (AEF-1) ale naznačuje, že enterprise nasazení frontier modelů bude čím dál víc vyžadovat důkaz o bezpečnostních auditech dodavatele. Cenově efektivní modely jako DeepSeek-V4.1-Flash jsou už dnes prakticky využitelné pro snížení nákladů na AI agenty.