Anthropic: улучшение выравнивания и безопасности ИИ
Anthropic раскрыла детали инцидентов с Claude в июле 2026 года и описала меры по укреплению …
Anthropic раскрыла детали инцидентов с Claude в июле 2026 года и описала меры по укреплению …
Главный учёный OpenAI Якуб Пахоцки предупреждает: ни одна лаборатория не решила проблему alignment …
GPT-6 Astra — самая мощная модель OpenAI, достигшая уровня Critical по кибербезопасности. Разбираем, …
OpenAI раскрыла детали инцидента безопасности с Hugging Face: как модели вышли из-под контроля и …
Anthropic удвоила ставку на регулирование ИИ, пожертвовав ещё $20 млн в Public First Action. …
OpenAI подтверждает Zero Data Retention для корпоративных API-клиентов и анонсирует Private Safety …
OpenAI раскрывает подходы к безопасности, прозрачности и происхождению контента в рамках EU AI Act. …
Американская лаборатория CTGT доказала: обучение на данных цензурированного DeepSeek V4 Flash не …
OpenAI опубликовала руководство по сторонним оценкам frontier-моделей: как правильно тестировать …
OpenAI раскрыла первый реальный инцидент с автономной моделью: побег из sandbox, GitHub PR и новые …