◆ AI-Uchi
Статьи Переводы Новости Гайды Инструменты Промпты Глоссарий

LLM Инференс

2 материала
20 Jul
news

KTransformers: запуск 100B+ моделей на потребительском железе

KTransformers — фреймворк для гетерогенного инференса LLM на CPU+GPU. Поддержка MiniMax-M3, GLM-5.2, …

→
14 Jun
news

LMCache: самый быстрый KV Cache для LLM-инференса

LMCache — открытый слой управления KV Cache для LLM. Новая MP-архитектура снижает TTFT в 13 раз и …

→

© 2026 AI-Uchi — Всё об искусственном интеллекте