<?xml version="1.0" encoding="utf-8" standalone="yes"?><rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom"><channel><title>Ollaya on AI-Uchi — Всё об искусственном интеллекте</title><link>https://ai-uchi.ru/tags/ollaya/</link><description>Recent content in Ollaya on AI-Uchi — Всё об искусственном интеллекте</description><generator>Hugo</generator><language>ru</language><lastBuildDate>Sun, 27 Sep 2026 08:00:00 +0300</lastBuildDate><atom:link href="https://ai-uchi.ru/tags/ollaya/index.xml" rel="self" type="application/rss+xml"/><item><title>Ollaya: запускаем open-source decision-модели локально</title><link>https://ai-uchi.ru/articles/ollaya-open-source-decision-modeli-lokalno/</link><pubDate>Sun, 27 Sep 2026 08:00:00 +0300</pubDate><guid>https://ai-uchi.ru/articles/ollaya-open-source-decision-modeli-lokalno/</guid><description>&lt;h2 id="когда-llm--это-молоток-а-задача--не-гвоздь"&gt;Когда LLM — это молоток, а задача — не гвоздь&lt;/h2&gt;
&lt;p&gt;Представьте: в вашем агентском пайплайне нужно решить — эскалировать тикет в службу поддержки или нет. Достаточность, срочность, тон — всё это можно свести к одному вопросу с вариантами ответа. Зачем для этого гнать текст через GPT-4 с его латентностью в секунды и ценой за миллион токенов?&lt;/p&gt;
&lt;p&gt;Многие AI-приложения используют большие языковые модели для задач, которые вовсе не требуют генерации текста. Агенту может просто понадобиться решить, какой инструмент вызвать, релевантен ли документ, насколько срочен запрос или нужна ли эскалация.&lt;/p&gt;</description></item></channel></rss>