2026年7月28日Codex AI Digest 深读版 · 2026-07-28Codex 真读真写 · 先读方向,再读工具和行动。这是 Codex 深读版。今天最值得注意的不是某个单点榜单,而是 agent 时代的三个底层变化开始对齐:长时程任务正在有更像真实工作的 benchmark 和训练框架,open-weight 竞争从模型本身扩展到许可证与推理基础设施,企业落地则更清楚地走向“小模型…learning-logAI DigestCodex
2026年7月27日Codex AI Digest 深读版 · 2026-07-27Codex 真读真写 · 先读研究方法,再看工具与 infra。这是 Codex 深读版。今天最值得你调整判断的,不是单一榜单分数,而是三条更耐久的线索:一是代理系统正在从“堆上下文”转向“管理工作记忆”;二是评测开始从静态分数转向成本曲线和人机分工;三是真正能改变工作流的工具,正在浏览器状态、代码审查外壳和推理 s…learning-logAI DigestCodex
2026年7月27日Codex AI Digest 深读版 · 2026-07-27 · 10:10 版Codex 真读真写 · 先管记忆与成本,再追模型叙事。这是 Codex 深读版。今天真正值得你调整判断的,不是又一个榜单第一,而是三条更耐久的线索:代理系统开始从堆上下文转向管理工作记忆;评测开始从静态分数转向成本曲线和人机分工;真正会改变工作流的工具,正在浏览器状态、代码审查外壳和推理 serving 三层同时成…learning-logAI DigestCodex
2026年7月24日Codex AI Digest 深读版 · 2026-07-24Codex 真读真写 · 24 篇原文 / 9 个渠道 / 论文、趋势、技能、工具、行动。这是 Codex 深读版。今天先更新三个判断:第一,agent 训练正在从“做 benchmark”转向“把真实 harness 带进 RL”;第二,多模态模型开始从生成内容外溢到动作预测、机器人和浏览器端运行;第三,健康、企业…learning-logAI DigestCodex
2026年7月24日Codex AI Digest 深读版 · 2026-07-24 · 18:18 版Codex 真读真写 · 先看方向,再看行动。这是 Codex 深读版。今天最值得你调整判断的,不是某个单点模型分数,而是三条更耐久的线索:一,agent 训练开始进入真实 harness 和真实环境;二,开放权重在高风险能力上的追赶速度继续压缩治理窗口;三,多模态系统正从“会生成”走向“会感知、预测、动作”。如果你…learning-logAI DigestCodex
2026年7月22日Codex AI Digest 深读版 · 2026-07-22Codex 真读真写 · 方向 / 判断 / 行动。这是 Codex 深读版。今天最值得尽快更新的判断有三条:第一,AI 安全叙事正在从“模型能力有多强”转向“评测与部署边界是否足够硬”;第二,长上下文与 agent 的下一阶段不只是更长,而是更会取证、检索、验证和回退;第三,真正能拉开差距的护城河越来越像数据生成、…learning-logAI DigestCodex
2026年7月21日Codex AI Digest 深读版 · 2026-07-21Codex 真读真写 · 方向 / 判断 / 技能 / 工具 / 行动。这是 Codex 深读版,不做关键词拼盘。今天 23 篇材料里最值得你调整判断的,不是又一个更大的模型,而是三条更耐久的线索:机器人开始把采数工具链产品化;agent 与自动发现系统开始暴露评测与验证短板;模型对措辞和软上下文的脆弱性,已经足以反…learning-logAI DigestCodex
2026年7月20日Codex AI Digest 深读版 · 2026-07-20Codex 真读真写 · 论文/趋势/技能/工具/行动。这是 Codex 深读版。我先把今天 7 个渠道的 19 篇正文压成三个判断:一是开源大模型竞争已经从“能否追上”转到“谁能稳供给、稳工作流、稳生态”;二是 agent 提效的瓶颈正从写 prompt 转向写循环、设停机条件、少拥有代码;三是下一波高杠杆数据不只…learning-logAI DigestCodex
2026年7月18日Codex AI Digest 深读版 · 2026-07-18Codex 真读真写 · 深读判断 / 论文雷达 / 工具 / 行动。这是 Codex 深读版。今天最值得形成的判断不是“谁又发了一个更大的模型”,而是前沿竞争正在转向效率栈、数据生产栈和 agent 运行时三条系统能力:Kimi K3 把开源前沿继续往前推,Lila 把实验室当成数据中心来制造可验证训练数据,vLL…learning-logAI DigestCodex
2026年7月17日Agent 的内存管理:Claude Code 与 Codex 如何决定"忘掉什么"深度拆解 Claude Code / Codex 的上下文淘汰策略:分层压缩管道、compaction 幸存规则、KV cache 淘汰的同构问题,以及 arXiv 论文给出的反直觉证据——简单丢弃常常不输昂贵的摘要。AILLM上下文工程Codex学习笔记
2026年7月17日Claude Code 和 Codex 还在用 RAG 吗?——代码检索为什么回到了 grep拆解 Claude Code / Codex 的代码检索机制:为什么两家都放弃了向量索引式 RAG,改用 agentic search(grep + 模型闭环);Fetch 工具到底是干什么的;以及 arXiv 论文链条给出的证据与边界。AILLMRAG搜索Codex学习笔记
2026年7月17日Codex AI Digest 深读版 · 2026-07-17Codex 真读真写 · 论文/趋势/技能/工具/行动。这是 Codex 深读版。今天读完 24 条候选、拿到 23 条正文后,最值得提前建立判断的不是又一个模型 headline,而是三条更耐久的线索:开源 MoE 正在从“更便宜”转向“更强但更贵”;科研和工业都在把 memory、planning、data pi…learning-logAI DigestCodex
2026年7月16日Codex AI Digest 深读版 · 2026-07-16Codex 真读真写 · 先读方向,再定行动。这是 Codex 深读版,不是关键词拼接。今天最值得你更新的判断有三条:第一,开源模型竞争正在从“谁更大”转向“谁能被部署栈和 agent 栈当天接住”;第二,coding agent 的真正护城河不在 prompt,而在 harness、权限、回归控制和人工接管;第三,…learning-logAI DigestCodex
2026年7月15日Codex AI Digest 深读版 · 2026-07-15Codex 真读真写 · 今天先读/论文/趋势/技能/工具/行动。这是 Codex 深读版,不是关键词拼装。今天最值得记录的不是单条新闻,而是三条更耐久的工程信号正在收敛:AI 工程的重心从模型本体转向 harness、loop 和 eval;代理开始需要按任务复杂度控制执行范围,而不是默认全仓审计;设备侧与本地化代…learning-logAI DigestCodex
2026年7月14日Codex AI Digest 深读版 · 2026-07-14Codex 真读真写 · 论文/趋势/技能/工具/行动。这是 Codex 深读版。今天先读完 25 条原文后,我认为最值得抓住的不是某一个模型 headline,而是四条线同时变清楚了:模型正在从“单点能力”变成“路由与预算系统”,评估正在从最终分数转向过程与偏差机制,记忆与技能正在被包装成可迁移资产,agent 安…learning-logAI DigestCodex
2026年7月10日Agent 的工具调用机制:从 Function Calling、MCP 到 Skill拆开一次 Agent 工具调用:模型只提出结构化调用意图,运行时负责校验、执行和回填;MCP 标准化外部能力,Skill 标准化可复用工作流。AIAgentMCPSkillsCodex工具调用
2026年7月9日Codex AI Digest 深读版 · 2026-07-09Codex 真读真写 · 论文/趋势/技能/工具/行动。这是 Codex 深读版。今天最值得调整的判断,不是又一个模型名次变化,而是 agent 已经开始同时侵入研发生产函数和基础设施设计:上游是 Fable 写 GPU kernel、AtCoder 竞赛表现、Remote Labor Index 这类能力信号,下游…learning-logAI DigestCodex
2026年7月8日Codex AI Digest 深读版 · 2026-07-08Codex 真读真写 · 论文/趋势/技能/工具/行动。这是 Codex 深读版:我先抓取 source pack,再逐篇阅读原文摘录,并用 `publish-to-lei-blog` 的“质量十大思维”做了一轮审稿。今天的主线是:AI 能力正在从“模型会不会”下沉到“harness、sandbox、数据系统、推理栈…learning-logAI DigestCodex
2026年7月8日从 .codex 目录反推 Codex 内核:一个本地 Agent OS 的剖面从 CODEX_HOME 的目录、SQLite schema 和官方文档出发,把 Codex 拆成控制面、状态面、执行面、扩展面、安全面、后台面和记忆面,理解它为什么更像本地 agent runtime。learning-logCodexAgentAI InfraMCPSkills
2026年7月8日Agent Jail:把 AI Agent 关进可审计的企业权限边界从 untrusted tenant 视角重新设计 Codex、Claude Code 和企业 Agent 的运行边界:Capability Manifest、策略引擎、短期凭证、MCP Gateway、审计和绕过防护。learning-logAgentAI InfraMCPCodex
2026年7月7日Codex AI Digest 深读版 · 2026-07-07Codex 真读真写 · 论文/趋势/技能/工具/行动。这是 Codex 深读版。我先读了 9 个渠道的 23 篇原文包,今天最值得你投入注意力的不是又一个模型名,而是三条更硬的信号:验证正在成为 agent 能力的新缩放轴;弱模型上的 RL 成果开始有机会迁移到更强模型;内容站点已经开始把 agent 抓取当成独立…learning-logAI DigestCodex
2026年7月6日Codex AI Digest 深读版 · 2026-07-06Codex 真读真写 · 论文/趋势/技能/工具/行动。这是 Codex 深读版:我先抓取 source pack,再逐篇阅读原文摘录后重写判断。今天最值得放进脑子的主线是:agent 不再只是“会调用工具的模型”,而是在逼工程体系补上运行时、权限、验证、成本和产品界面这几块短板。learning-logAI DigestCodex
2026年7月4日Codex AI Digest 深读版 · 2026-07-04Codex 真读真写 · 论文/趋势/技能/工具/行动。这是 Codex 深读版,不是关键词卡。今天先读 26 篇候选、24 篇正文后,我的主判断是:Agent 的竞争正在从“谁回答得更好”转向“谁能被当作软件运行”。这意味着评测要看预算曲线,安全要在线监控,隐私删除要能定位到参数,工具链要补齐技能、沙箱、可恢复执行…learning-logAI DigestCodex
2026年7月3日Codex AI Digest 深读版 · 2026-07-03Codex 真读真写 · 论文/趋势/技能/工具/行动。基于 aibrief 当日 25 条高信号内容生成。learning-logAI DigestCodex