<?xml version="1.0" encoding="utf-8" standalone="yes"?><rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom"><channel><title>Post-Training on AI-Uchi — Всё об искусственном интеллекте</title><link>https://ai-uchi.ru/tags/post-training/</link><description>Recent content in Post-Training on AI-Uchi — Всё об искусственном интеллекте</description><generator>Hugo</generator><language>ru</language><lastBuildDate>Sun, 06 Sep 2026 03:10:39 +0300</lastBuildDate><atom:link href="https://ai-uchi.ru/tags/post-training/index.xml" rel="self" type="application/rss+xml"/><item><title>Miles v0.1: RL-фреймворк для дообучения LLM на уровне предприятия</title><link>https://ai-uchi.ru/news/miles-v01-rl-frejmvork-dlya-doobucheniya-llm/</link><pubDate>Sun, 06 Sep 2026 03:10:39 +0300</pubDate><guid>https://ai-uchi.ru/news/miles-v01-rl-frejmvork-dlya-doobucheniya-llm/</guid><description>&lt;h2 id="miles-v01-вышел-корпоративный-rl-фреймворк-для-гигантских-языковых-моделей"&gt;Miles v0.1 вышел: корпоративный RL-фреймворк для гигантских языковых моделей&lt;/h2&gt;
&lt;p&gt;Команда RadixArk в августе 2026 года выпустила &lt;strong&gt;Miles v0.1&lt;/strong&gt; — open-source фреймворк для обучения с подкреплением (RL, Reinforcement Learning) корпоративного уровня, предназначенный для пост-тренинга (post-training — дополнительное обучение после предобучения) больших языковых и мультимодальных моделей. Проект форкнут из популярного легковесного фреймворка slime и развивается параллельно с ним, закрывая потребности, которые slime изначально не ставил целью: надёжность, масштаб и контролируемость на уровне промышленного развёртывания.&lt;/p&gt;</description></item></channel></rss>