TL;DR
Контекстное окно — это конечный фрагмент диалога, который AI «видит» в любой момент; всё за его пределами для модели фактически не существует. Держите это окно маленьким, чистым и сфокусированным на одной теме — и AI останется резвым, быстрым и дешёвым.
Аналогия
Перестаньте представлять AI как «разум». Вместо этого представьте умнейшего на Земле клерка, работающего за столом шириной ровно 4 фута.
Каждое ваше сообщение — лист бумаги, ложащийся на правый край стола. А у клерка есть ритуал, который он никогда не нарушает:**чтобы написать каждый ответ, он перечитывает все листы, лежащие на столе прямо сейчас — слева направо, каждый раз, без исключений.**Никакого просмотрового чтения. Никакого «это я помню». Полное перечитывание для каждого ответа, навсегда.
И жестокая деталь:**стол никогда не становится больше.**Он сделан на заводе фиксированного размера. Когда прибывает новый лист, а места нет, самый старый лист выскальзывает с левого края — не в ящик, не в шкаф, а в шредер. Клерк не скорбит.Он даже не замечает, что что-то исчезло.
Этот стол и есть контекстное окно.Когда вы говорите «AI забыл мою инструкцию», забывание не произошло.Лист с инструкцией просто соскользнул со стола.Клерк по-прежнему блистателен — просто стол полон.
Последняя деталь, касающаяся кошелька: этот клерк берёт оплату за листы.Поскольку каждый ответ требует перечитывания всего стола, чем дольше вы оставляете его захламлённым, тем больше платите за каждое генерируемое слово.Захламлённый стол — это не только растерянный клерк, но и дорогой клерк.
Как это работает и слоты чатов Uzu
Внутри большая языковая модель не «помнит» диалог — она его перечитывает на каждом ходу. Видимый текст измеряется в токенах (считайте токен примерно тремя четвертями слова), и эта зона видимости — контекстное окно.Попало внутрь — прочитано; не поместилось — суммируется или отбрасывается.
Что лежит на столе в произвольный момент:
| Что на столе | Что это значит для вас |
|---|---|
| Системные инструкции | Постоянные команды AI — занимают место ещё до того, как вы заговорили |
| Персона и роль | Карточка персонажа, которую клерк перечитывает перед каждым ответом |
| Ваши недавние сообщения | Самые свежие листы — всегда полностью видны |
| Ответы самого AI | Да, он тоже перечитывает свои слова — длинные ответы вытесняют вас со стола |
| Вложения и вставленный текст | Самые тяжёлые листы, без сомнения |
Вот почему такие техники, как промпт одного запроса, работают так хорошо: полная и точная инструкция остаётся на столе и работает на вас на каждом ходу.Вот почему few-Shot промптинг — вставка решённых примеров в промпт — силён, но дорог как место на столе: каждый пример — это лист, который клерк будет перечитывать вечно.
Контекст — это ресурс, и приложение Uzu обращается с ним именно так. Uzu отправляет последние ~20 сообщений диалога, автоматически сжимая более ранние ходы в резюме — как клерк, периодически переплетающий самые старые листы в одну тонкую выжимку.Важные нити выживают, не переполняя стол. Uzu также сознательно ограничивает число одновременно открытых чатов, расширяя лимит с уровнем.Каждый открытый чат — отдельный стол, за который платится содержание.Мёртвые диалоги — не хлам; они вытесняют важную работу.
Экономика сходится и здесь: каждый токен, который модель перечитывает, — обработанный токен.Поэтому чистое контекстное окно заканчивается меньшим числом G-Credits, чем грязное.Точность экономит деньги дважды — один раз при написании промпта и по разу на каждый последующий ход.
Рабочее правило простое:
**Один стол — одна работа.**Один чат — одна тема, на листах только суть, а хлам — в шредер до того, как счёт выйдет из-под контроля.
Частые ловушки
- **Вести всю жизнь в одном вечном чате.**Чат, где вы планируете поездку, спрашиваете об аренде и отлаживаете рецепт — это стол, погребённый под нерелевантными листами.Новую тему — в новый чат: новый стол, стопроцентная концентрация.
- **Повторять всё ещё видимую инструкцию.**Если промпт одного запроса прибыл 12 сообщений назад, а диалог всё ещё короток, повторение — пустая трата токенов.Повторяйте правило, только когда оно явно соскользнуло с края — длинный диалог, потерянное ограничение.
- **Вставлять документ на 40 страниц и задавать один вопрос.**Самый тяжёлый лист на любом столе — выгрузка сырого документа.Сначала извлеките нужные разделы или используйте специализированный инструмент — в Uzu приложенный PDF становится эффективно цитируемым постоянным контекстом, а не перепосылаемым на каждом ходу полным текстом.
- **Путать окно с памятью.**Контекстное окно — это рабочее пространство, а не хранилище.Это стол, а не жёсткий диск — закройте чат, и стол вытерт.То, что вы хотите сохранить, нужно сохранять намеренно (записать или сохранить в память, поддерживаемую приложением).
- **Спорить с «забывшим» AI.**Когда модель противоречит старой инструкции, она не упрямится — лист упал со стола.Не воюйте с симптомом: переформулируйте ключевое ограничение или начните чистый чат, где оно близко к началу.
FAQ
Что такое контекстное окно в AI?
Контекстное окно — это максимальный объём текста (измеряемый в токенах), который модель AI может обработать за один раз.Оно включает ваши инструкции, историю диалога, прошлые ответы самого AI и приложенные документы.Всё за пределами окна не может повлиять на текущий ответ.Вот почему длинные диалоги в итоге «теряют» начальные инструкции.
Почему AI забывает то, что сам говорил в начале диалога?
Потому что модель никогда не сохраняла это — она лишь перечитывала то, что попадает в контекстное окно.По мере роста диалога ранние обмены суммируются или отбрасываются за пределы окна.Дело не в невнимательности AI — старейшие листы буквально покинули поле зрения.
Большое контекстное окно — это то же самое, что память AI?
Нет, и это смешение порождает бесконечные разочарования.Контекстное окно — временное рабочее пространство: оно существует, только пока жив диалог, и перечитывается на каждом ходу.Память — вроде сохранённых фактов или систем запоминания, которые предлагают некоторые приложения, — это отдельный, намеренный слой хранения, живущий дольше одного чата.Большое окно: более широкий стол.Память: картотека.Нужны обе, но роли у них разные.
Следующий урок
А теперь часть, о которой не предупреждают новичков: всё вышесказанное прекрасно работает и тогда, когда AI неправ.Модель с чистым столом реже противоречит инструкциям — но всё равно способна спокойнейшей уверенностью излагать ложь.Это не баг вашего промпта.Это иллюзия уверенности — покерное лицо, встроенное в каждую большую языковую модель.Научиться его распознавать — важнейший навык защиты в AI.
Следующий урок: Иллюзия уверенности
Упражнение перед уходом: откройте свой самый долгий чат и прочитайте его как инспектор стола.Какие листы всё ещё заслуживают места — а какие соскользнули три темы назад?Начните чистый чат и заметьте разницу в первом же ответе.