◆ AI-Uchi
Статьи Переводы Новости Гайды Инструменты Промпты Глоссарий

Оценка Моделей

3 материала
01 Aug
article

Frontier Red Team: три реальных инцидента в кибероценках

Anthropic раскрыл три реальных инцидента: Claude взломал системы организаций во время оценок …

→
30 Jul
translation

Единый стандарт: как OpenAI оценивает безопасность ИИ

OpenAI опубликовала руководство по сторонним оценкам frontier-моделей: как правильно тестировать …

→
10 Jul
translation

Сигнал или шум: OpenAI проверила SWE-Bench Pro

OpenAI провела аудит SWE-Bench Pro и обнаружила, что ~30% задач содержат ошибки. Что это значит для …

→

© 2026 AI-Uchi — Всё об искусственном интеллекте