AGENT-PLAYBOOK · THEORY ARCHIVE
Agentic Engineering
學習知識庫学习知识库
AI AGENT TRENDS
high
AI AGENT TRENDS
▲ 2 accelerating 11 families · 31 mentions covered
FAMILY MOM 7d Δ7d CHART ST
Agentic Coding 11 1.83x
●
Frontier Model 6 1.50x
●
Agent Infra 4 1.00x
●
MCP / Tool Protocol 2 9.99x
●
Context Eng. 2 2.00x
◉
Voice / Modal 2 0.67x
●
Reasoning 2 9.99x
●
Vertical Agent 2 2.00x
◉
Multi-Agent 0 0.00x
●
Agent Safety 0 0.00x
●
Eval / Bench 0 0.00x
●
COMPETITION PAIRS 5
SINGLE vs SWARM
Single powerful coding agent vs multi-agent orchestration
11 vs 0
· ratio —x
ACT vs THINK
Tool execution protocol vs context/knowledge retrieval
2 vs 2
· ratio 1.00x
SCALE vs SENSE
Infrastructure scaling vs multimodal perception
4 vs 2
· ratio 2.00x
TOP AI ORGS
13 active / 30d
TOP AI ORGS
ORGANIZATION TOTAL LAST SEEN ACTIVITY
1 OpenAI 98 09-10
2 Anthropic 64 09-09
3 DeepSeek 30 09-09
Amazon 16 09-10
Cursor 14 09-08
Google 14 09-07
Meta 13 09-05
Qwen 9 08-24
xAI 8 09-05
NVIDIA 7 09-08
Hugging Face 5 09-06
Apple 4 08-19
Google DeepMind 3 08-01
Microsoft 2 07-05
LangChain 1 08-11
✦ 不知道從哪裡開始?選一條路徑不知道从哪里开始?选一条路径
工程師入門工程师入门
從零建立完整的 Agentic 工程認知从零建立完整的 Agentic 工程认知
系統架構師系统架构师
設計可靠的多 Agent 控制平面與治理设计可靠的多 Agent 控制平面与治理
產品 / 戰略产品 / 战略
把握範式轉變,制定 AI 時代競爭策略把握范式转变,制定 AI 时代竞争策略
精選必讀精选必读
建立 Agentic 工程直覺的 8 篇核心文章建立 Agentic 工程直觉的 8 篇核心文章01
工程實戰工程实战
新手詞彙表新手词汇表
掌握 Agent 工程核心術語,第一篇必讀掌握 Agent 工程核心术语,第一篇必读
02
底層原理底层原理
Agent 心智模型Agent 心智模型
理解 Agent 如何「思考」的底層認知框架理解 Agent 如何"思考"的底层认知框架
03
工程實戰工程实战
Context 工程手冊Context 工程手册
從壓縮到結構化注入的完整方法論从压缩到结构化注入的完整方法论
04
工程實戰工程实战
T1–T6 故障分類法T1–T6 故障分类法
生產部署前必讀的 Agent 失敗模式大全生产部署前必读的 Agent 失败模式大全
05
工程實戰工程实战
信任分層設計信任分层设计
防止 Agent 越權的多層級權限架構防止 Agent 越权的多层级权限架构
06
工程實戰工程实战
評估環路即生產實踐评估环路即生产实践
把評估從測試階段提升為持續生產實踐把评估从测试阶段提升为持续生产实践
07
工程實戰工程实战
委托而非自動化委托而非自动化
重新定義 Agent 與人類協作的工程邊界重新定义 Agent 与人类协作的工程边界
08
戰略生存战略生存
Agent 原生組織角色Agent 原生组织角色
Agent 時代的職能重構與角色設計Agent 时代的职能重构与角色设计
PULSAR 深度分析深度分析
50 篇 · Pipeline 自動生成篇 · Pipeline 自动生成 significant_updatesignificant_update AI 编程成本危机:Copilot、Claude 集体涨价,社区反思 vibe coding 经济性 significant_updatesignificant_update GPT-6 Astra 正式发布:跨软件全流程自主操作能力 significant_updatesignificant_update OpenAI 训练中的 Agent 通过公开 Wiki 协作通信数周 深度文章深度文章 HuggingFace 发布 funes:给 Coding Agent 装上持久记忆层 significant_updatesignificant_update 🎯 Vercel Dashboard 支持构建部署 Eve Agent significant_updatesignificant_update Anthropic 硬件版 MCP 扩展:从实验室设备走向全球设备接管 significant_updatesignificant_update 🎯 Vercel Chat SDK 集成 Claude Managed Agents:托管 Agent 一键接入应用 深度文章深度文章 GPT-6 Astra 正式发布:OpenAI 新一代旗舰,全面超越 Claude Fable 5.1 significant_updatesignificant_update OpenAI 宣布断供 Cursor:SpaceX 收购后的模型隔离升级 深度文章深度文章 AgentCore Memory 生命周期管理:长运行 Agent 的遗忘策略 significant_updatesignificant_update Claude 训练 Claude:Anthropic AAR 自动化对齐研究员,4 美元/小时跑赢人类 significant_updatesignificant_update 🎯 Warp 基于 Claude Skills 构建自改进 Agent:800K 开发者的生产实践 significant_updatesignificant_update vLLM v0.28.0:Kimi-K3 全栈优化 + DeepSeek V4 稀疏 MLA 端到端 significant_updatesignificant_update AWS 发布 Agentic Resource Discovery (ARD) 开放规范 + Agent Registry significant_updatesignificant_update LLM 可通过推理引擎漏洞控制宿主机:安全研究引发关注 深度文章深度文章 Meta Muse Image 上线 Vercel AI Gateway:统一生成+编辑的图像模型 significant_updatesignificant_update DeepSeek API 周末计费调整:周六日全天统一低谷价 significant_updatesignificant_update Claude Code 神话破灭?大量用户正在取消订阅 深度文章深度文章 Gradio Workflow:拖拽式 AI 管线,一图抵千行 Python significant_updatesignificant_update DeepSeek V4-Flash-Vision-Exp 上线:多模态 Agent 能力接近 Opus-4.8 significant_updatesignificant_update Hypura – storage-tier-aware LLM inference scheduler for Apple Silicon significant_updatesignificant_update OpenAI 全面开源 Codex Harness(Apache-2.0) significant_updatesignificant_update DeepSeek Harness v0.1.0-rc.8:Claude Code 和 Codex 收编为子代理(续报) significant_updatesignificant_update OpenAI 人事大震荡:安全团队撤编 + 12位高管离职 significant_updatesignificant_update Bun 1.4 发布 Bun.WebView:为 LLM Agent 提供 shot-scraper 式 JSON API significant_updatesignificant_update Amazon Bedrock 上线 GPT-5.6 跨 Region 推理(25+ Regions) significant_updatesignificant_update sqlite-utils 4.0 正式发布:六年首次大版本升级,支持 schema 迁移 深度文章深度文章 Amazon Bedrock AgentCore Gateway:集中治理 Agent 工具访问权限 深度文章深度文章 AWS ADOP:用 Agentic 平台将数据工程上线周期从周压缩到小时 significant_updatesignificant_update NVIDIA Nemotron 3.5 Lightning 登陆 Amazon SageMaker JumpStart 深度文章深度文章 IBM 研究:Agent 内存不是「开关」而是「剂量」——校准比堆量更重要 significant_updatesignificant_update Qwen 3.8 27B 默认过度推理:实测需手动调低 reasoning_effort 深度文章深度文章 OpenViking:面向 AI Agent 的自进化上下文数据库 significant_updatesignificant_update 腾讯 QQ Bot 接入 DeepSeek Harness:支持单聊/群聊 AI 智能体 significant_updatesignificant_update 阿里巴巴正式开源 Qwen3.8 系列模型 significant_updatesignificant_update Don't classify. Hallucinate! 深度文章深度文章 ai-memory — 跨Agent CLI的长期记忆方案,GitHub Trending significant_updatesignificant_update Introducing Gemini 3.7 Flash significant_updatesignificant_update Grok 4.6 模型发布:61分追平 GPT-5.6 Sol,agentic 性能突出 significant_updatesignificant_update DeepSeek V4 Pro 0813 正式版上线:100万上下文,默认思考模式 significant_updatesignificant_update Claude Apps Gateway for AWS 企业部署指南 significant_updatesignificant_update Stealing Reasoning Traces:闭源 LLM API 的 CoT 重放攻击 深度文章深度文章 Building agentic workflows with SageMaker AI and Bedrock AgentCore significant_updatesignificant_update AWS Bedrock AgentCore 推出 Dogwood 策略语言:跨动作时序控制 Agent 行为 significant_updatesignificant_update GitHub Models is now retired significant_updatesignificant_update OpenChamber: An Agentic Development Environment significant_updatesignificant_update SpaceX 600 亿美元收购 Cursor:品牌将淘汰,Sand Agent 或改名 Grok Bot significant_updatesignificant_update The Bitter Lesson of Tool Calling:程序化工具调用全面超越 JSON 工具调用 significant_updatesignificant_update TReNDS automates root-cause analysis with Amazon Bedrock significant_updatesignificant_update DeepSeek 宣布近期整体上调 API 定价,预计涨幅较大
全部文章
82 篇 · 點擊模塊過濾篇 · 点击模块过滤 底層原理底层原理 11 篇篇
Agent 的心智模型:从"做题家"到"管理者" AlphaOPT:构建可进化的优化建模经验库 LoFA vs RAG:两种不同的“知识注入”路径 mHC 範式:具身智能與大規模模型中的信號守恆 Post-Scaling Research Age:把“更聪明地用算力”落到工程清单 WaveFormer:用欠阻尼波动方程做全局视觉建模(Frequency-Time 解耦) 不確定性處理與貝葉斯估計 (Bayesian Estimation & Uncertainty) 深度解析:Hypernetwork (超网络) 獨立推理與證明邏輯 (Independent Reasoning & Proof Logic) 锯齿状智能与 RLVR:理解 2025 推理模型 隐空间推理:Coconut 与连续思维链 (Continuous CoT)
Agent 設計Agent 设计 15 篇篇
01 组织模型与角色分工(Operating Model & Roles) 03 Playbook:多 Agent 编队协作(Multi-Agent Squad) Agent UI / Agent API 設計模式 (Agent UI & API Design Patterns) Agent 交互模型:角色、职责与闭环反馈 Agent 存储选型:SQLite, MySQL 还是 PostgreSQL? Agent 执行环境:云端沙箱全权限 vs 本地受控执行(选型与折中) Agent 记忆系统:短期(上下文工程)到长期(可审计的外部记忆)架构 AI Coding 智能体架构设计模式 RAG:Agent 的外部长期记忆库 vLLM 语义路由(Semantic Routing):把“模型选择 + 安全 + 缓存 + 质量”做成一个路由层 推理编排与元系统:榨干 LLM 的最后一滴潜力 架构分析:Skill 与 MCP 的边界与配合 灯塔 vs 火把:Agent 选型决策框架 知识蒸馏:让 Agent 拥有万级文件的“上帝视角” 社会模拟与多智能体预测系统 (Social Simulation & MAS)
工程實戰工程实战 核心模塊核心模块 26 篇篇
01-物理层治理:项目组织与结构导轨 02 Playbook:从 Spec 到 PR(Spec → PR Delivery) 02-逻辑层治理:编码规范与契约 03-流程层治理:审查与协同闭环 04 Playbook:风险治理与回滚(Risk & Rollback) 04-自动化执法:让架构导轨“带电” 05 Playbook:Ralph Loop 迭代範式与 AFK 指挥 05-架构决策记录 (ADR):给 AI 建一座记忆宫殿 10x 开发者集成战术链路手册 Agent 信任層級設計 (Trust Tier Design) Agent 失效分類學 (Agent Failure Taxonomy) Agentic Coding 的本质:文档工程(DocOps) Agentic 控制平面設計 (Agentic Control Plane Design) AI 原生调试:从手动 Profiling 到 Agentic 诊断 AI 参与编码的检测、度量与治理:从“偷偷用”到“系统化基本功” AI應用開發知識系統整體設計 Context 工程實戰指南 (Context Engineering Field Guide) Eval Loop 作為生產實踐 (Eval Loop as Production Practice) Hybrid DocOps + AgentOps:一套可落地的 Agentic Coding 最佳实践 Playbook:Agent 评估体系(Evals)从 0 到 1 PRD(写给工程师与 LLM Agent 的可执行模板) 委派而非自動化:工程原則 (Delegation, Not Automation) 数字化工作室:设计你的代理组织架构 (Agentic Org Chart) 架构导轨:防止 AI 在大型项目中失控的治理艺术 架构治理 (Architectural Governance) 专项指南 架构治理:小白版黑话词典 (Glossary for Beginners)
範式轉變范式转变 10 篇篇
《A Year Of Vibes》读后:Prompt 版本控制、协作界面与“责任归属” 2025 LLM 现状:进展、问题、以及对 2026 的工程预测(Raschka 摘要提纯) Anthropic 2026 Agentic Coding 趋势报告:8 大趋势 × 4 个组织优先级(工程化读法) Vibe Coding 范式:从意图驱动开发到 Agentic Engineering 一人 CEO 范式:Agent 时代的个体组织力 不再為人設計:新文明的軟體範式與經驗清空 大白话:当扫地机开始自己“发工资” (aGDP 详解) 智能作为一种资源:可编织与可协作的未来 真实性危机:当 AI 民主化演变成“噪音民主化” 知识平权与智力成本的扁平化
戰略生存战略生存 13 篇篇
Agent-Native 組織新角色 (Agent-Native Organization Roles) AI 教育革命:终结百年的工业模式 AI 时代程序员的核心硬实力:三大理解心法 Vibe Coding 时代的发布摩擦力:国内 vs 海外 Vibe Coding 时代的独立开发者收款与出海实操指南 X(Twitter)生态生存手册:从“免费公地”到“付费帝国”的分发规则 以人为中心的 Agent 设计:主体性、氛围感与空间化 后端工程师进化:从“实现者”到“架构编排师” 智力套利策略:利用平权智力寻找利基机会 梯度下降人生法:对抗 AI 时代的惶恐 研究品味:作为决策中的“值函数” 跨境 AI 创业:身份/结构/合规/退出路径的决策清单(以 Manus 讨论为引子) 重构工程心智:跨越 AI 时代的 10 倍效率鸿沟