<?xml version="1.0" encoding="utf-8" standalone="yes"?><rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom"><channel><title>Misalignment on AI-Uchi — Всё об искусственном интеллекте</title><link>https://ai-uchi.ru/tags/misalignment/</link><description>Recent content in Misalignment on AI-Uchi — Всё об искусственном интеллекте</description><generator>Hugo</generator><language>ru</language><lastBuildDate>Sat, 19 Sep 2026 11:00:00 +0300</lastBuildDate><atom:link href="https://ai-uchi.ru/tags/misalignment/index.xml" rel="self" type="application/rss+xml"/><item><title>OpenAI раскрывает систему отчётности о рассогласовании моделей</title><link>https://ai-uchi.ru/translations/openai-model-misalignment-reporting-framework/</link><pubDate>Sat, 19 Sep 2026 11:00:00 +0300</pubDate><guid>https://ai-uchi.ru/translations/openai-model-misalignment-reporting-framework/</guid><description>&lt;h2 id="что-случилось-и-почему-это-важно"&gt;Что случилось и почему это важно&lt;/h2&gt;
&lt;p&gt;16 сентября 2026 года OpenAI опубликовала фреймворк для отслеживания, расследования и публичного раскрытия случаев рассогласования моделей (model misalignment — ситуации, когда ИИ ведёт себя вопреки своим инструкциям), а вместе с ним — шесть отчётов о неожиданном или тревожном поведении, наблюдавшемся в ходе обучения или оценки ещё не выпущенных моделей.&lt;/p&gt;



&lt;div class="callout callout-info"&gt;
 &lt;div class="callout-title"&gt;&amp;#8505; Что такое misalignment?&lt;/div&gt;
 &lt;div class="callout-content"&gt;&lt;strong&gt;Misalignment (рассогласование)&lt;/strong&gt; — ситуация, при которой ИИ-модель ведёт себя не так, как задумано разработчиками: нарушает инструкции, скрывает ошибки, предпринимает несанкционированные действия или обманывает пользователя. Это один из центральных рисков в исследованиях безопасности ИИ.&lt;/div&gt;
&lt;/div&gt;

&lt;p&gt;Прежде OpenAI стремилась публиковать результаты своих исследований рассогласования, чтобы информировать учёных, разработчиков, политиков и широкую публику. Однако без системного подхода раскрытия носили хаотичный характер: компания нередко ждала, пока накопится достаточно инцидентов, чтобы объединить их в один отчёт, или прикладывала выводы к системным карточкам новых выпускаемых моделей.&lt;/p&gt;</description></item></channel></rss>