thought

Agent = LLM + Context + Tools

1Map of atomic notes based on the book “Deep Understanding of AI Agent” (Li Bojie). The book unfolds the agent formula across four levels: construction → evaluation and evolution → interaction and collaboration.

01 Agent Fundamentals (Chapter 1)

02 Context Engineering (Chapter 2)

03 User Memory and Knowledge Base (Chapter 3)

04 Tools (Chapter 4)

05 Coding Agent and Code Generation (Chapter 5)

06 Agent Evaluation (Chapter 6)

  • [Три уровня системы оценки]
  • [Среды оценки]
  • [Метрики оценки агентов]
  • LLM-as-a-Judge
  • [Четыре принципа рубрики]
  • [Статистическая значимость оценки]
  • [Анализ стоимости агента]
  • [От бенчмарка к улучшениям]
  • [Наблюдаемость агента]
  • [Симуляционная среда]

07 Model Post-training (Chapter 7)

  • [Три этапа постобучения]
  • [SFT запоминает - RL обобщает]
  • [Сначала SFT потом RL]
  • [Данные и среда важнее алгоритма]
  • [RLHF]
  • [KL - mode-seeking против mass-covering]
  • [RLVR и проверяемые награды]
  • [Награда за процесс и награда за результат]
  • [GRPO]
  • [On-Policy Distillation]
  • [Самодистилляция OPSD]

08 Continuous Agent Evolution (Chapter 8)

  • [Непрерывная эволюция агента]
  • [Обучающие сигналы из траекторий]
  • [Четыре носителя обновления]
  • [От опыта к знаниям]
  • [Обновление Prompt и Skill]
  • [От опыта к программам]
  • [Обновление параметров модели]
  • [Два контура эволюции]
  • [Проверка - выпуск - откат]
  • [Границы безопасности самомодификации]
  • [Обучение во сне]

09 Multimodality and Real-time (Chapter 9)

  • [Голосовые парадигмы]
  • [Каскадный голосовой конвейер]
  • [Потоковое речевое восприятие]
  • [Полный дуплекс]
  • [Архитектура мышления быстрое и медленное]
  • [Синтез речи подобный человеку]
  • [Computer Use]
  • [Визуальная локализация GUI]
  • [VLA-модели]
  • [Двухуровневая архитектура планирование-управление]
  • [Sim2Real]

10 Multi-agent Interaction (Chapter 10)

  • [Общий и раздельный контекст]
  • [Топологии взаимодействия]
  • [Межагентная коммуникация]
  • [Мультиагентная смена ролей]
  • [Мультиагентное взаимодействие без общего контекста]
  • [Файловая система в мультиагентных системах]
  • [Запрос состояния и персистентность траектории]
  • [Модель оркестрации]
  • [Децентрализованная модель и handoff]
  • [Протокол A2A]
  • [Мультиагентность против одного агента]
  • [Режимы отказа мультиагентных систем]
  • [Эмерджентное поведение агентов]
  • [Общество агентов]

11 Afterword

  • [Два облака агентного неба]
  • [Совместная эволюция модели и агента]
  • [Harness постепенно поглощается моделью]
  • [Маховик модель-агент]