Вехи на линии · ПАМЯТЬ

Длинный контекст

Модель теперь удерживает перед глазами сразу целую книгу, весь код проекта или час видео — а не пару страниц, как раньше.

Миллион токенов перестал быть демонстрацией и стал рабочим режимом. Модель держит в голове весь проект, а не отдельный файл.

СтатусПРОЙДЕНО
ТипВехи на линии
Отметка2026
Что уже есть6

Исследовано

2023

Извлечение из базы (RAG)

Обходной путь, которым индустрия жила, пока контекст был коротким. Сейчас — дополнение, а не костыль.

подтверждено
2024

Gemini 1.5 Pro

Миллион токенов в проде — впервые в модель целиком помещалась книга или час видео.

подтверждено
2025

Контекст масштаба репозитория

Кодовые системы читают проект целиком.

подтверждено
2026-06

MiniMax M3

Одна двадцатая вычислений на токен, prefill вдевятеро и декодирование в пятнадцать раз быстрее на миллионном контексте.

НОВОЕпо сообщениям

В процессе

сейчас

Потеря середины

Длинный контекст помещается, но внимание к его середине проседает: модель помнит начало и конец лучше, чем то, что между ними.

НОВОЕ

В планах

в планах

Постоянная память между сессиями

Контекст обнуляется с каждым новым разговором. Память, которая живёт годами и не растёт бесконечно, — отдельная нерешённая задача.

НОВОЕ
Вехи на линии
На линию

Следить за движением линии

Раз в неделю — какие ветви продвинулись, что открылось и что оказалось преувеличением.