2026年8月10日Agent 正在长成一朵云:从八个岗位地图到未来架构的压缩重演预测姊妹篇:上一篇把主 Agent 推理循环拆成八个被专训小模型接管的岗位,这一篇把岗位表贴到云架构图上,发现 Agent 架构正在压缩重演云计算二十年的演化史。四层证据链逐层判收敛:组件层(BAIR 复合 AI 系统宣言→NVIDIA 异构编制)、内核层(AIOS 的 agent syscall、Parrot 的 Semantic Variable、Mooncake 的 P/D 分离)、运行时层(AWS AgentCore/Azure Foundry/Google Agent Engine 六个月内先后 GA,microVM 隔离 + serverless 计费)、协议层(MCP 管南北向、A2A 捐入 Linux 基金会管东西向)。给出三条置信度分级预测(控制面/数据面成为 Agent 默认词汇;模型从架构图中消失变成实例类型;评测成为 Agent 云的类型系统),并收束成一条元规律:抽象复用使演化压缩——后发领域直接借用先行领域付清过发明成本的抽象词汇表,把二十年走成三年。AILLMAgentAI InfraMCP论文深读
2026年8月10日主模型在思考,谁在打下手?——Agent 推理循环里被专训小模型接管的八个岗位把主 Agent 的一次推理循环摊开成一条流水线,逐站盘点正在被专向训练小模型接管的岗位:路由员(RouteLLM)、安检员(Llama Guard/ShieldGemma)、精简师(LLMLingua)、打字员(投机解码/EAGLE)、质检员(Math-Shepherd/Qwen PRM/Prometheus 2)、翻译员(Gorilla/xLAM)、指路员(UGround/OS-Atlas)、誊写员(Cursor fast apply,已被回收的岗位)。以 NVIDIA 的 SLM 立场论文为理论锚点,收束成一条岗位寿命定律:结构位 > 部署位 > 能力位——靠结构立足的岗位长存,靠能力差立足的岗位终将被主模型收回。AILLMAgentAI 安全论文深读
2026年8月8日大模型三年半技术路线图:算力的三次搬家(2022.11–2026.08)把 ChatGPT 发布至今的三年半压缩成一张可跳转的时间轴:四次范式接力(对齐→效率→推理→智能体)× 五条暗线(对齐方法、稀疏化、算力搬家、开源时差、接口标准化)。全部 17 个 arXiv ID 经 API 逐一核实,2025 下半年之后的产品日期逐条回查过来源,文末附一条可复现的核实命令。LLMAgent论文深读
2026年8月7日Agent 时代的工程学·门禁篇:六道闸门,和一条「不可逆边界」定律决策地图系列第六篇:体系化地做 AI Gates 门禁。先给出第一性分解——门禁 = 判定器 × 执法点,判定器全是评测的蒸馏、执法点应设在不可逆性跃迁的边界上;再沿 AI 系统生命周期排出六道闸门(输入、输出、行动、合入、发布、熔断),每道闸配源头论文与技术代表:Llama Guard、Constitutional Classifiers、NeMo Guardrails、ToolEmu、Progent、Meta TestGen-LLM、promptfoo/Braintrust、Preparedness Framework/RSP、Circuit Breakers。附一张可复用的门禁设计表和四步落地路线。AILLMAgentAI 安全论文深读
2026年8月6日Agent 写码、Agent 测码:「人力真空」的真名,叫「独立验证真空」如果代码由 agent 写、测试也由 agent 生成,人退出验证环节会不会导致线上故障?本文用九个可核实的来源回答:会,但根因不是「人少了」,而是「独立验证信号少了」。写与测同源时,测试从独立证据退化为自我确认;对冲方案不是把人塞回原位,而是重构验证信号图——这个问题 1983 年就被预言过一次。AILLMAgentAgent 工程论文深读
2026年8月6日Agent 时代的工程学:六个决策点,每个都有一条「论文→产品」的传导链Agent 工程在 2026 年不缺方法,缺的是判断:哪些决策已经收敛(抄工业默认答案就行),哪些还没收敛(要自己读论文做实验)。本文把 Agent 工程拆成六个决策点,每个决策点给出源头论文、落地技术代表和收敛度判断,最后合成一张可以直接用的选型地图。AILLMAgentAgent 工程上下文工程AI Infra论文深读
2026年8月6日Agent 时代的工程学·Infra 篇:六个决策点,和一条从显存到信任的收敛度梯度应用层的六个决策点全部站在 Infra 兑现的承诺上:token 流得出来、动作有地方跑、状态死不掉、身份说得清。本文用同一套「论文→产品」传导链方法,把 Agent Infra 拆成六个决策点逐个判收敛,并合成一条规律:离物理越近的层越收敛,离社会越近的层越不收敛。AILLMAgentAI InfraAgent 工程论文深读
2026年8月6日Agent 时代的工程学·测试篇:六个决策点,和一条「Oracle 梯度」定律决策地图系列第四篇:测试团队被 Agent 时代冲击两次——工具 agent 化、被测对象也 agent 化。把测试拆成六个决策点(测试生成、杀伤力度量、E2E agent 化、fuzzing 算力化、确定性模拟、agent evals),用同一套「论文→产品」传导链判收敛,得到一条新定律:一个测试环节被机器接管的速度,等于它的判定标准(oracle)能被形式化的程度。测试团队的转变,就是沿这条梯度上移。AILLMAgent论文深读
2026年8月5日Agent 部署架构全景:五种宿主形态、两条横切层,和背后同一个冲突云基础设施默认计算是短时、无状态、可信、调用图静态的——Agent 把四个假设同时打破。本文结合 AIOS、Parrot、Autellix、部署综述(arXiv:2412.13437)等论文,把当前 Agent 部署方式整理成"五种宿主形态 + 两条横切层"的分层地图:进程内嵌入、沙箱化执行、托管运行时、Agent OS、端侧协同,以及 serving 调度层与 MCP/A2A 互联层,并给出选型决策表。AIAgentAI Infra论文深读
2026年8月5日深度解读 Agent Swarm:第三条 scaling 轴,和它要交的协调税从蚁群算法到 OpenAI Swarm 的 handoffs、Anthropic 的 orchestrator-worker、Claude Code 的 agent teams,再到 Kimi K2.5 用 RL 把编排策略训练出来——agent swarm 的本质是把推理算力从『纵向想更久』扩展成『横向同时想』。这篇按第一性原理拆:为什么稀缺资源是上下文窗口、协调税记在账本哪一行、以及『何时并行』这件事如何正在从人写规则变成数据学出来。Agent工程实践LLM
2026年8月5日一页 API 文档的考古学:八个"进阶功能",三条论文谱系某大模型平台的"进阶使用"页列了八个功能:续写模式、批量推理、视觉定位、上下文缓存、文件输入、云部署 MCP、3D 生成、GUI 任务处理。看起来是产品经理排的功能清单,其实是一张考古地图——每个卡片下面都埋着一条"论文→系统→产品"的谱系。本文把八个功能归并成三条:给稀缺资源定价(KV Cache 经济学)、把世界变成 token(表示的进出口)、闭合反馈环(从会说到会做),每条配已核实的 arXiv 论文链,结尾给一套看任何 API 新功能都能用的三问。LLMAI InfraAgent论文深读
2026年8月4日Eval 是新的 PRD?是的,但规格的缝隙只是搬了家从 VB Transform 2026 的一句口号出发,用三篇论文拆解「Eval 取代 PRD」的真实含义:当产品规格从给人读的散文变成给机器跑的目标函数,Goodhart 定律开始起作用——真正的交付物不是 eval 套件,而是让 eval 与意图持续对齐的闭环。评测工程实践AgentLLM
2026年8月4日读 MemOS 源码:记忆的三态、相变,与一个诚实的占位符把 MemTensor 的 MemOS(arXiv:2507.03724)克隆下来,对照论文精读约 9 万行 Python 源码。它的精髓可以压成一张相图:记忆有三态——明文(气态)、激活(液态)、参数(固态),'记忆操作系统'的职责是调度相变。审计结果:明文态是生产级,明文→激活这条相变真实且值钱(TTFT 最高降 94.2%),而参数态在源码里是一个 dump() 时写入 b"Placeholder" 的占位符。这篇按'表示—调度—相变—进化—数字'五层,把论文的承诺和代码的现实逐条对齐。记忆AgentLLMAI Infra
2026年8月4日记忆的内化:Metis 把 Agent 记忆从提示词搬进前向计算做出外挂记忆操作系统 MemOS 的 MemTensor 团队,自己发布了外挂路线的'反面':Metis(arXiv:2607.26760),第一个把记忆做成原生能力的基础模型——记忆不再是数据库+检索+拼提示词,而是一块随对话演化的参数状态:写入靠前向计算,读取靠 memory attention,全程没有一次反向传播。本文沿论文的三轴对比(架构、优化、效率)拆它的设计,再用诚实的数字给它定位:原生记忆今天的处境,约等于 LRM 出现之前的推理。Agent记忆LLM论文深读
2026年8月4日概率内核,确定性外壳:五个「可」的伪代码实践承接《Agent 应用工程师的六层》的分水岭判断,把「可观测、可恢复、可验证、可治理、可持续进化」逐个拆成最小工程实现:每个「可」一段伪代码,共享同一个设计原则——状态放内核外面,决策穿过内核,副作用经过关卡。Agent工程实践评测LLM
2026年8月4日当提示词成为依赖:读 Warp 的 skills-lock.jsonWarp 仓库根目录躺着一个 skills-lock.json:25 个'依赖'全是 Markdown 提示词,每条锁一个内容哈希。它不是标准的一部分,却标志着一个转折——当提示词成为跨团队共享的工件,它就继承了软件依赖的完整生命周期:manifest、锁文件、可复现安装,以及供应链攻击。结合五篇 arXiv 论文,拆解 Agent Skill 依赖管理的现状、原则与锁不住的部分。AgentSkills工程实践
2026年8月4日读 Warp 源码:一场针对字节流的政变Warp 开源了客户端全部 78 个 Rust crate。精读源码后会发现它的全部架构是同一个赌注的四次下注:终端 50 年的契约是无结构字节流,Warp 在输出(Blocks)、输入(编辑器)、意图(分类器)、渲染(自研 UI 框架)四层同时把结构强加回去——而这套结构恰好是 Agent 需要的执行环境。连它的开源仓库本身,都在用 Agent + Spec 的结构化流程运转。Agent工程实践
2026年8月3日从能跑到可托付:顶级 Agent 应用工程师的六层系统与三条闭环写给已经在做 Agent 的工程师:从目标契约、上下文状态、决策控制、工具环境、运行时信任到评测学习,用六层系统与三条闭环重新理解 Agent 应用层,并给出从功能实现者走向系统负责人的进阶路径。AILLMAgentAgent 工程上下文工程AI Infra论文深读
2026年8月3日当 Agent 开始说“物化”:一张大模型工程术语地图从物化、编排、轨迹、检查点到 Harness 和 Verifier,按任务闭环梳理 60 多个 Agent 工程术语,并追问哪些是真问题的新名字、哪些只是旧概念迁移,以及模型为何偏爱这种语言。AILLMAgentAgent 工程论文深读
2026年8月3日Agent 真正缺的不是记忆,而是一套可执行的世界模型从本体、知识图谱、约束与运行轨迹四层拆解 Agent 的语义底座:为什么老语义网在智能体时代重新有用,以及它不能替你解决什么。Agent工程实践
2026年8月3日Agent 的断点续传:任务如何中断、恢复,并且不把效果丢在路上结合分布式快照、Saga、LogAct、Crab、RAC、Plans Don’t Persist 与 τ-bench,解释 Agent 长任务如何用任务契约、事件日志、副作用账本、恢复对账和外部验证器实现可中断、可恢复且效果可验收。AILLMAgent论文深读
2026年8月3日Agent 如何控制浏览器:从 HTTP、DOM、CDP 到视觉与混合自动化系统拆解 Browser Agent 的控制通道与页面表示:比较 HTTP/API、WebDriver、Playwright、DOM、Accessibility Tree、CDP、浏览器扩展、视觉坐标和 Agent-aware browser runtime,并结合论文讨论评测、安全与选型。AILLMAgent论文深读
2026年8月3日大模型为什么要用 osascript 操作桌面:从可访问性树到视觉 GUI Agent从一条 macOS UI 探测命令出发,解释大模型如何观察、定位、操作并验证桌面软件,比较 Accessibility Tree、视觉坐标、DOM、API/CLI 与混合控制的取舍和局限。AILLMAgent论文深读
2026年8月3日大企业的大模型到底在搞什么:一张"四个缺口"全景图把大企业"能搞的大模型内容"收敛成四个缺口——知识、行动、信任、成本。用 20 余篇可查证的 arXiv 论文标出每个缺口下值得立项的方向、已知的坑与真实完成度,并给出一张立项检查单。LLMAI InfraRAGAgent