AGENT-PLAYBOOK · THEORY ARCHIVE
Agentic Engineering
學習知識庫学习知识库
AI AGENT TRENDS
high
AI AGENT TRENDS
11 families · 52 mentions covered
FAMILY MOM 7d Δ7d CHART ST
Agentic Coding 17 1.70x
●
Frontier Model 16 1.14x
●
Agent Infra 5 1.25x
●
MCP / Tool Protocol 4 0.80x
●
Context Eng. 2 1.00x
●
Eval / Bench 2 1.00x
●
Voice / Modal 2 9.99x
●
Vertical Agent 2 0.50x
●
Multi-Agent 1 9.99x
●
Reasoning 1 1.00x
●
Agent Safety 0 0.00x
●
COMPETITION PAIRS 5
SINGLE vs SWARM
Single powerful coding agent vs multi-agent orchestration
17 vs 1
· ratio 17.00x
ACT vs THINK
Tool execution protocol vs context/knowledge retrieval
4 vs 2
· ratio 2.00x
MEASURE vs GUARD
Evaluation-driven development vs safety-first guardrails
2 vs 0
· ratio —x
SCALE vs SENSE
Infrastructure scaling vs multimodal perception
5 vs 2
· ratio 2.50x
TOP AI ORGS
13 active / 30d
TOP AI ORGS
ORGANIZATION TOTAL LAST SEEN ACTIVITY
1 OpenAI 85 07-18
2 Anthropic 65 07-19
3 DeepSeek 33 07-17
Google 23 07-18
Amazon 13 07-18
Cursor 12 07-12
NVIDIA 10 07-13
Meta 9 07-18
xAI 9 07-19
Qwen 6 07-20
Apple 6 07-14
Microsoft 4 07-05
Mistral 4 07-16
LangChain 2 05-21
LlamaIndex 2 05-17
✦ 不知道從哪裡開始?選一條路徑不知道从哪里开始?选一条路径
工程師入門工程师入门
從零建立完整的 Agentic 工程認知从零建立完整的 Agentic 工程认知
系統架構師系统架构师
設計可靠的多 Agent 控制平面與治理设计可靠的多 Agent 控制平面与治理
產品 / 戰略产品 / 战略
把握範式轉變,制定 AI 時代競爭策略把握范式转变,制定 AI 时代竞争策略
精選必讀精选必读
建立 Agentic 工程直覺的 8 篇核心文章建立 Agentic 工程直觉的 8 篇核心文章01
工程實戰工程实战
新手詞彙表新手词汇表
掌握 Agent 工程核心術語,第一篇必讀掌握 Agent 工程核心术语,第一篇必读
02
底層原理底层原理
Agent 心智模型Agent 心智模型
理解 Agent 如何「思考」的底層認知框架理解 Agent 如何"思考"的底层认知框架
03
工程實戰工程实战
Context 工程手冊Context 工程手册
從壓縮到結構化注入的完整方法論从压缩到结构化注入的完整方法论
04
工程實戰工程实战
T1–T6 故障分類法T1–T6 故障分类法
生產部署前必讀的 Agent 失敗模式大全生产部署前必读的 Agent 失败模式大全
05
工程實戰工程实战
信任分層設計信任分层设计
防止 Agent 越權的多層級權限架構防止 Agent 越权的多层级权限架构
06
工程實戰工程实战
評估環路即生產實踐评估环路即生产实践
把評估從測試階段提升為持續生產實踐把评估从测试阶段提升为持续生产实践
07
工程實戰工程实战
委托而非自動化委托而非自动化
重新定義 Agent 與人類協作的工程邊界重新定义 Agent 与人类协作的工程边界
08
戰略生存战略生存
Agent 原生組織角色Agent 原生组织角色
Agent 時代的職能重構與角色設計Agent 时代的职能重构与角色设计
PULSAR 深度分析深度分析
50 篇 · Pipeline 自動生成篇 · Pipeline 自动生成 深度文章深度文章 Vercel Workflows 支持自定义 run state 存储位置 significant_updatesignificant_update Grok 4.3 登陆 Amazon Bedrock:xAI 模型正式进入 AWS 生态 significant_updatesignificant_update How I tricked Claude into leaking your deepest, darkest secrets significant_updatesignificant_update Show HN: I RL-trained an agent that trains models with RL (for ~$1.3k) significant_updatesignificant_update Cursor 0day: When Full Disclosure Becomes the Only Protection Left significant_updatesignificant_update OpenAI 计划推出家用智能音箱,首款硬件产品 significant_updatesignificant_update Nobie — Excel-compatible runtime for agents and humans significant_updatesignificant_update The Vibe Coding Wall of Shame significant_updatesignificant_update Runtime (YC P26) — 团队级沙盒编码 Agent 基础设施 深度文章深度文章 DeepSeek 筹备 IPO:ARR 达 $4-5 亿,估值 $740 亿 significant_updatesignificant_update GPT-5.6 Sol Ultra 一小时证明 50 年数学猜想 significant_updatesignificant_update Claude Code vs OpenCode token 开销实测:33k vs 7k 系统前缀 significant_updatesignificant_update Claude Code 企业级 session/cache 泄漏:ZDR workspace 出现 Minecraft 提示词 significant_updatesignificant_update OpenAI 审计 SWE-Bench Pro:约 30% 任务存在设计缺陷 significant_updatesignificant_update Rowboat:开源本地优先的 Claude Desktop 替代,可自定义工作界面 significant_updatesignificant_update Pulpie:Pareto 最优网页清洗模型,质量逼近 SOTA 但成本仅 1/20 深度文章深度文章 Multi-agent social intelligence with Strands Agents and Amazon Bedrock 深度文章深度文章 Bilibili 开源 Index-1.9B 小模型:19 亿参数超越数倍体积模型 significant_updatesignificant_update OpenAI 发布 GPT-Live:原生实时语音模型,可后台委派 GPT-5.5 深度文章深度文章 Bedrock AgentCore Gateway: On-Behalf-Of Token Exchange for Multi-Tenant Agents significant_updatesignificant_update BAIR:Intelligence is Free, Now What? — 为 Agent 设计数据系统 significant_updatesignificant_update Claude apps gateway for AWS:自托管控制平面,统一管理 Claude Code/Desktop significant_updatesignificant_update Vercel Agent:独立身份 + 审批权限模型,Agent 可安全触达生产环境 significant_updatesignificant_update Anthropic 发现 LLM 涌现「全局工作空间」:J-space 内部神经模式 significant_updatesignificant_update OfficeCLI:专为 AI Agent 设计的 Office 套件,一行代码接入 Word/Excel/PPT significant_updatesignificant_update Zuckerberg 内部坦言:AI Agent 进展不及预期 significant_updatesignificant_update sqlite-utils 4.0rc2 主要由 Claude Fable 编写,花费 $149.25 significant_updatesignificant_update GPT-5.5 Codex reasoning-token 聚类异常:516 阈值导致复杂任务性能下降 significant_updatesignificant_update 🎯 新 Claude 模型工具调用反而更差:Opus 4.8/Sonnet 5 捏造字段 significant_updatesignificant_update OpenAI 向 SEC 提交 S-1 草案,IPO 选项开放 significant_updatesignificant_update Hypura – storage-tier-aware LLM inference scheduler for Apple Silicon 深度文章深度文章 sqlite-utils 4.0 正式发布:六年首次大版本升级,支持 schema 迁移 significant_updatesignificant_update 阿里巴巴全面禁用 Claude:7月10日生效,全员卸载 Anthropic 全系产品 significant_updatesignificant_update Fable's judgement:Claude Code 团队建议让模型自主判断,Simon 实践 sub-agent 委派降本 significant_updatesignificant_update 🔧 DeepSeek 联合北大开源 DSpark:推测解码推理提速 60-85% significant_updatesignificant_update Manufact (YC S25) — MCP Cloud:一键部署 MCP Apps/Servers significant_updatesignificant_update llm-coding-agent 0.1a0 — Simon Willison 的 Python 编码 Agent significant_updatesignificant_update Anthropic 回应 Claude Code 暗藏代码检测中国用户:将删除相关逻辑 significant_updatesignificant_update Bedrock GovCloud 支持 OpenAI GPT OSS + NVIDIA Nemotron 开源模型 significant_updatesignificant_update Dean W. Ball:政府延迟发布正在破坏前沿模型经济模型 significant_updatesignificant_update 🎯 AI 账单失控,美国企业 100% 切换 DeepSeek 降本 深度文章深度文章 AgentCore Memory 支持结构化元数据过滤 深度文章深度文章 AWS 发布 Serverless A2A Gateway:Agent 发现、路由与访问控制 significant_updatesignificant_update OpenAI 预览 GPT-5.6 Sol/Terra/Luna 三模型系列,新增 Ultra 子代理模式 significant_updatesignificant_update Stripe 在 AWS 上部署生产级金融合规 Agent,处理时间降 26% significant_updatesignificant_update OpenAI 联合 Broadcom 发布 Jalapeño:专为 LLM 推理定制的 AI 芯片 significant_updatesignificant_update Claude Tag 发布:Claude Code 进化为企业协作 AI 队友,Karpathy 称 LLM 界面第三次变革 significant_updatesignificant_update 🎯 OpenAI Codex 开放 OSS 模式:可插接任意开源模型 significant_updatesignificant_update Sonnet-5 泄露:Anthropic 下一代模型下周上线,百万 token 上下文 significant_updatesignificant_update 小米 MiMo 大模型联合 OpenClaw/OpenCode/KiloCode 等 Agent 框架,首周限免开放
全部文章
82 篇 · 點擊模塊過濾篇 · 点击模块过滤 底層原理底层原理 11 篇篇
Agent 的心智模型:从"做题家"到"管理者" AlphaOPT:构建可进化的优化建模经验库 LoFA vs RAG:两种不同的“知识注入”路径 mHC 範式:具身智能與大規模模型中的信號守恆 Post-Scaling Research Age:把“更聪明地用算力”落到工程清单 WaveFormer:用欠阻尼波动方程做全局视觉建模(Frequency-Time 解耦) 不確定性處理與貝葉斯估計 (Bayesian Estimation & Uncertainty) 深度解析:Hypernetwork (超网络) 獨立推理與證明邏輯 (Independent Reasoning & Proof Logic) 锯齿状智能与 RLVR:理解 2025 推理模型 隐空间推理:Coconut 与连续思维链 (Continuous CoT)
Agent 設計Agent 设计 15 篇篇
01 组织模型与角色分工(Operating Model & Roles) 03 Playbook:多 Agent 编队协作(Multi-Agent Squad) Agent UI / Agent API 設計模式 (Agent UI & API Design Patterns) Agent 交互模型:角色、职责与闭环反馈 Agent 存储选型:SQLite, MySQL 还是 PostgreSQL? Agent 执行环境:云端沙箱全权限 vs 本地受控执行(选型与折中) Agent 记忆系统:短期(上下文工程)到长期(可审计的外部记忆)架构 AI Coding 智能体架构设计模式 RAG:Agent 的外部长期记忆库 vLLM 语义路由(Semantic Routing):把“模型选择 + 安全 + 缓存 + 质量”做成一个路由层 推理编排与元系统:榨干 LLM 的最后一滴潜力 架构分析:Skill 与 MCP 的边界与配合 灯塔 vs 火把:Agent 选型决策框架 知识蒸馏:让 Agent 拥有万级文件的“上帝视角” 社会模拟与多智能体预测系统 (Social Simulation & MAS)
工程實戰工程实战 核心模塊核心模块 26 篇篇
01-物理层治理:项目组织与结构导轨 02 Playbook:从 Spec 到 PR(Spec → PR Delivery) 02-逻辑层治理:编码规范与契约 03-流程层治理:审查与协同闭环 04 Playbook:风险治理与回滚(Risk & Rollback) 04-自动化执法:让架构导轨“带电” 05 Playbook:Ralph Loop 迭代範式与 AFK 指挥 05-架构决策记录 (ADR):给 AI 建一座记忆宫殿 10x 开发者集成战术链路手册 Agent 信任層級設計 (Trust Tier Design) Agent 失效分類學 (Agent Failure Taxonomy) Agentic Coding 的本质:文档工程(DocOps) Agentic 控制平面設計 (Agentic Control Plane Design) AI 原生调试:从手动 Profiling 到 Agentic 诊断 AI 参与编码的检测、度量与治理:从“偷偷用”到“系统化基本功” AI應用開發知識系統整體設計 Context 工程實戰指南 (Context Engineering Field Guide) Eval Loop 作為生產實踐 (Eval Loop as Production Practice) Hybrid DocOps + AgentOps:一套可落地的 Agentic Coding 最佳实践 Playbook:Agent 评估体系(Evals)从 0 到 1 PRD(写给工程师与 LLM Agent 的可执行模板) 委派而非自動化:工程原則 (Delegation, Not Automation) 数字化工作室:设计你的代理组织架构 (Agentic Org Chart) 架构导轨:防止 AI 在大型项目中失控的治理艺术 架构治理 (Architectural Governance) 专项指南 架构治理:小白版黑话词典 (Glossary for Beginners)
範式轉變范式转变 10 篇篇
《A Year Of Vibes》读后:Prompt 版本控制、协作界面与“责任归属” 2025 LLM 现状:进展、问题、以及对 2026 的工程预测(Raschka 摘要提纯) Anthropic 2026 Agentic Coding 趋势报告:8 大趋势 × 4 个组织优先级(工程化读法) Vibe Coding 范式:从意图驱动开发到 Agentic Engineering 一人 CEO 范式:Agent 时代的个体组织力 不再為人設計:新文明的軟體範式與經驗清空 大白话:当扫地机开始自己“发工资” (aGDP 详解) 智能作为一种资源:可编织与可协作的未来 真实性危机:当 AI 民主化演变成“噪音民主化” 知识平权与智力成本的扁平化
戰略生存战略生存 13 篇篇
Agent-Native 組織新角色 (Agent-Native Organization Roles) AI 教育革命:终结百年的工业模式 AI 时代程序员的核心硬实力:三大理解心法 Vibe Coding 时代的发布摩擦力:国内 vs 海外 Vibe Coding 时代的独立开发者收款与出海实操指南 X(Twitter)生态生存手册:从“免费公地”到“付费帝国”的分发规则 以人为中心的 Agent 设计:主体性、氛围感与空间化 后端工程师进化:从“实现者”到“架构编排师” 智力套利策略:利用平权智力寻找利基机会 梯度下降人生法:对抗 AI 时代的惶恐 研究品味:作为决策中的“值函数” 跨境 AI 创业:身份/结构/合规/退出路径的决策清单(以 Manus 讨论为引子) 重构工程心智:跨越 AI 时代的 10 倍效率鸿沟