<?xml version="1.0" encoding="utf-8" standalone="yes"?><rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom"><channel><title>On-Device Inference on AI-Uchi — Всё об искусственном интеллекте</title><link>https://ai-uchi.ru/tags/on-device-inference/</link><description>Recent content in On-Device Inference on AI-Uchi — Всё об искусственном интеллекте</description><generator>Hugo</generator><language>ru</language><lastBuildDate>Fri, 31 Jul 2026 08:00:00 +0300</lastBuildDate><atom:link href="https://ai-uchi.ru/tags/on-device-inference/index.xml" rel="self" type="application/rss+xml"/><item><title>Gemma 4 26B в 2 ГБ RAM: магия TurboFieldfare на Mac</title><link>https://ai-uchi.ru/articles/gemma-4-26b-2gb-ram-turbofieldfare-mac/</link><pubDate>Fri, 31 Jul 2026 08:00:00 +0300</pubDate><guid>https://ai-uchi.ru/articles/gemma-4-26b-2gb-ram-turbofieldfare-mac/</guid><description>&lt;h2 id="введение-26-миллиардов-параметров-в-кармане"&gt;Введение: 26 миллиардов параметров в кармане&lt;/h2&gt;
&lt;p&gt;Представьте: вы открываете MacBook Air с базовыми 8 ГБ памяти — и запускаете языковую модель с 26 миллиардами параметров. Без облака, без подписки, без GPU за $5000. Именно это стало реальностью благодаря проекту &lt;strong&gt;TurboFieldfare&lt;/strong&gt; — специализированному движку для инференса, появившемуся на Hacker News и мгновенно привлёкшему внимание разработчиков.&lt;/p&gt;
&lt;p&gt;Автор собрал специализированный движок для запуска 4-bit Gemma 4 26B-A4B-IT на любом Mac с чипом M-серии, используя около 2 ГБ оперативной памяти. Это звучит почти невозможно — ведь стандартный 4-bit вариант модели занимает 14–18 ГБ. Как это работает и почему это важно — разбираемся в этой статье.&lt;/p&gt;</description></item></channel></rss>