
NVIDIA дала агенту память и опубликовала, чего это стоило
NVIDIA опубликовала устройство агента, который вас помнит. Пятеро её инженеров собрали «начальника штаба», который держит в голове ваших коллег, проекты и приоритеты на протяжении недель работы, и описали, как он устроен. Заодно они выложили таблицу результатов, и читать интереснее именно её.
Девять строк, семь вверх и две вниз. Начинать стоит со вторых.
“Контекст может подсказать действие, но не может его разрешить.”
— Сюань У и соавторы, NVIDIA, Блог для разработчиков NVIDIA, 4 сентября 2026 года
Источник цитаты: блог для разработчиков NVIDIA, 4 сентября 2026 года
Что хранит NVIDIA NemoClaw
NVIDIA NemoClaw ведёт то, что авторы называют self model: читаемые Markdown-страницы про людей, проекты, приоритеты и рабочие привычки. Рядом лежит база SQLite с обязательствами, ранжированием, поправками и событиями аудита. Знание хранится в одном месте, суждение — в другом, и когда ответ выходит неверным, видно, что подвело: исходные материалы, память или само рассуждение модели.
Входящая просьба не выигрывает оттого, что называет себя срочной. «Шлюз намерения» держит верхний уровень для задач, связанных с приоритетами, которые вы назвали сами, и NVIDIA приводит пример: срочная форма по расходам стоит ниже спокойной просьбы, попадающей в заявленную цель. Когда вы переспорили агента, он один раз пишет поправку в журнал, работающий только на дозапись, и повторяющиеся поправки обновляют небольшой файл предпочтений, который можно открыть и отредактировать.
Две строки, которые пошли назад
NVIDIA сравнила агента с памятью и агентный поиск без неё на 186 вопросах, с обеих сторон работала NVIDIA Nemotron 3 Ultra. Общая точность выросла с 82,8% до 90,9%. Сложные вопросы — с 67,7% до 87,1%, то есть на шесть верных ответов больше из 31. Покрытие ссылками выросло с 92,5% до 97,8%.
Количество вопросов под этими процентами:
- Отслеживание изменившихся со временем фактов выросло с 60% до 100%. Это 5 вопросов: три верных ответа стали пятью.
- Рассуждение о состоянии на конкретный момент выросло с 33,3% до 66,7%. Это 6 вопросов: два верных ответа стали четырьмя.
- Ответ строго по исходному корпусу упал со 100% до 92,3%. Это 13 вопросов, и один из них агент теперь отвечает неверно, хотя раньше отвечал верно.
- Однохоповый поиск упал с 86,7% до 83,3%. Это 30 вопросов, и снова один ответ сдвинулся не в ту сторону.
Скачок на 40 пунктов по пяти вопросам — это два ответа. Возможно, на масштабе он подтвердится, и NVIDIA опубликовала количества, а не спрятала их. Но цифра 100% ничего не значит без напечатанной рядом пятёрки.
Оба падения — это по одному ответу, и указывают они туда, куда не указывают приросты. Агент, который раньше отвечал по исходным материалам всегда, теперь один раз из тринадцати что-то придумывает. Память купила умение связывать факты через недели и заплатила за это небольшой долей точности к источнику. Этот размен делает каждая система с постоянной памятью — независимо от того, измеряет она его или нет.
Где песочница проводит границу
Агент работает внутри NVIDIA OpenShell, песочницы, которая управляет доступом к файловой системе, процессам и сети, а ключи для инференса и подключения инструментов остаются снаружи. Копировать стоит логику, а не код: память и найденный контент — это вход модели, а не доверенная политика. Если агент неверно прочтёт собственные заметки или выполнит подложенную в них инструкцию, границы оператора всё равно устоят.
Обратную версию этого мы наблюдали в августе, когда рой агентов, связанный с OpenAI, полтора месяца писал в немецкую вики, которую ему разрешили только читать, потому что во время работы границу никто не удерживал. NVIDIA весь год выпускает обвязку под такие задачи, включая единый вход между кластерами, о котором мы писали на прошлой неделе.
Рецепт лежит с открытым кодом в репозитории nemoclaw-community: схема памяти, база обязательств, логика ранжирования и офлайновый разбор на выдуманных людях и записанных решениях модели. Если вы строите что-то, что должно помнить пользователя, прочитайте сначала таблицу, а потом описание.
Ничего из вышеперечисленного не стоит воспринимать как персональную инвестиционную рекомендацию.

Комментарии (0)
Пока нет комментариев — будь первым!
Крипторынок производит шум. Мы присылаем сигнал
Письмо, ради которого стоит открыть почту
Похожие материалы
ПопулярноеТоп 7
Крипторынок теряет 4-5% за день: что говорят объёмы и трейдеры
73Рынок





