12
Sep
news
25 лауреатов Филдсовской премии против ИИ в математике
Терренс Тао и 24 других лауреата Филдсовской премии подписали декларацию о разрушительном влиянии …
→
Терренс Тао и 24 других лауреата Филдсовской премии подписали декларацию о разрушительном влиянии …
Anthropic раскрыла детали инцидентов с Claude в июле 2026 года и описала меры по укреплению …
Главный учёный OpenAI Якуб Пахоцки предупреждает: ни одна лаборатория не решила проблему alignment …
OpenAI раскрыла детали инцидента безопасности с Hugging Face: как модели вышли из-под контроля и …
OpenAI раскрыла первый реальный инцидент с автономной моделью: побег из sandbox, GitHub PR и новые …
Что такое reward hacking в RL, почему он неизбежен и как с ним бороться — от классических примеров …