
DeepSeek V4 вышел — триллион параметров, миллион токенов и MIT-лицензия
DeepSeek выпустил V4 Preview: две MoE-модели с контекстом в миллион токенов, тремя архитектурными нововведениями и ценой, от которой конкурентам станет не по себе.
Короткие наблюдения, находки и рабочие заметки — от новых инструментов до собственного опыта.

DeepSeek выпустил V4 Preview: две MoE-модели с контекстом в миллион токенов, тремя архитектурными нововведениями и ценой, от которой конкурентам станет не по себе.

OpenAI выпустила GPT-5.5 — модель, которая быстрее понимает задачу, сама планирует шаги и доводит работу до конца. Разбираюсь, что реально изменилось и почему это важно.

Google перевёл Gemini Embedding 2 из превью в GA. Теперь текст, картинки, видео и аудио живут в одном векторном пространстве — и это можно использовать в продакшене.

OpenAI выпустил ChatGPT Images 2.0 на базе GPT-Image-2 — с почти идеальным рендерингом текста, реалистичными UI-скриншотами и заметным скачком в фотореализме. Разбираюсь, что изменилось и почему это важно.

Moonshot AI выпустила Kimi K2.6 — open-source модель с рекордным long-horizon кодингом, Agent Swarm на 300 агентов и поддержкой OpenClaw и Hermes. Разбираюсь, почему это важно.

Alibaba выложила в открытый доступ Qwen3.6-35B-A3B — MoE-модель с 35 миллиардами параметров, из которых активны только 3. При этом по agentic coding она не уступает моделям в 10 раз крупнее.

MiniMax открыла исходный код M2.7 — модели, которая участвовала в собственном обучении. С результатами на уровне GPT-5.3-Codex и ценой в 20 раз ниже Claude Opus, она уже доступна через Ollama.

ACE-Step выпустил XL-версию с 4B параметрами — и она обходит Suno v5 на метриках качества. MIT-лицензия, три варианта модели, запуск на своём железе.

Alibaba выпустила Qwen3.5-Omni — нативно мультимодальную модель на 397 миллиардов параметров, которая обрабатывает текст, изображения, аудио и видео, отвечает голосом в реальном времени и умеет вызывать внешние инструменты.

Gemini 3.1 Flash Live — модель для создания голосовых ИИ-агентов с минимальной задержкой. Разбираюсь, что это значит для разработчиков и почему это важно.

Сэм Альтман передал контроль над безопасностью, OpenAI завершила претрейнинг модели Spud и закрывает Sora. Разбираюсь, что всё это значит.

Короткая заметка о том, как устроен autoresearch: вы правите «программу» агента в .md, агент правит тренировочный .py, а все эксперименты сравнимы, потому что каждый прогон длится фиксированные 5 минут.
Страница 7 из 8
Кто отвечает, если ИИ-агент что-нибудь сломает: о человеческом выборе, правосубъектности и привычке искать виноватого вместо того, чтобы думать.