Модели
5Разборы конкретных моделей и исследований: что нового, как устроено и стоит ли того хайп.
моделиKimi K3: open-weight модель обгоняет Claude Opus 4.8 🌙⚡
Kimi K3 от Moonshot AI — 2.8T параметров, 104B активных, экстремальная MoE-разреженность и Kimi Delta Attention: тот же гибрид линейного и полного внимания на 3:1, что в пейпере Kimi Linear обещал до 6× ускорения декодинга на длинном контексте.
Читать далееUnlimited-OCR от Baidu: читает страницу как картинку 📄👁️
Unlimited-OCR от Baidu — 3B vision-language модель для OCR документов в духе DeepSeek-OCR: оптическое сжатие, режимы gundam/base, запуск через SGLang.
Читать далее
моделиH-Neurons: 0.1% нейронов, из-за которых LLM врут 🫡
Исследование H-Neurons из Университета Цинхуа — нейроны-галлюцинаторы в LLM, их связь с чрезмерной уступчивостью и почему корень проблемы в претрейне.
Читать далее
моделиKimi K2.5: Как KimiClaw прогрел рынок на $10 лярд
Kimi K2.5 от Moonshot AI — 1T параметров MoE, рой из 100 агентов с 4.5× ускорением и KimiClaw, который за 20 дней заработал больше, чем весь 2025 год.
Читать далее
моделиQwen3.5: Китайцы сделали модель, которая рвёт GPT-5.2 🫡
Разбираю Qwen3.5 от Alibaba — 397B параметров, 17B активных, MoE, нативное зрение и 201 язык. Как 3B активных параметров побеждают 22B? Разбор с шизой.
Читать далее