全部专题

Series

工具与自动化

围绕个人效率、桌面工具、自动简报、发布流程和开发者体验,沉淀能长期复用的工作台。

37 篇文章

Codex AI Digest 深读版 · 2026-07-21

Codex 真读真写 · 方向 / 判断 / 技能 / 工具 / 行动。这是 Codex 深读版,不做关键词拼盘。今天 23 篇材料里最值得你调整判断的,不是又一个更大的模型,而是三条更耐久的线索:机器人开始把采数工具链产品化;agent 与自动发现系统开始暴露评测与验证短板;模型对措辞和软上下文的脆弱性,已经足以反…

短视频说"AI 一小时证明了 50 年数学悬案"——我把 OpenAI 那两份 PDF 读了,真实故事更精彩

2026 年 7 月,"GPT-5.6 一小时证明循环双覆盖猜想"刷屏短视频。事实核查:事件为真,但"证明了"三个字说早了——现在的准确状态是"机器生成了一份证明,人类正在核验"。这篇先用能手画的小例子讲透这个 50 年悬案本身(圈、桥、snark),再逐页拆 OpenAI 发布的两份一手 PDF:3 页的证明走了哪四步,那份比证明更值得读的 2 页提示词里藏着哪些多代理工程设计。结尾是一张"视频说法 vs 核实结果"对照表,以及一个漂亮的对偶:费马大定理是人类已证、等机器核验;这次是机器生成、等人类核验。

给「物料搭建 + 还原业务逻辑」设计一套 AI Harness

前两篇讲了设计稿出码的难题和物料驱动搭建的问题地图。这一篇动手:从「AI 可被控制、可被配置的切面」出发,设计一套能真正跑起来的搭建 harness——用一条「逐步降低不确定性」的窄专家流水线,每步产出可校验的 typed artifact,把 skill.md / tool schema / MCP / 结构化输出 / 编排 / 校验门 / 人机门 当成控制阀装上去。含可直接参考的 SKILL.md、工具契约、IR schema 与编排流程图。

Codex AI Digest 深读版 · 2026-07-14

Codex 真读真写 · 论文/趋势/技能/工具/行动。这是 Codex 深读版。今天先读完 25 条原文后,我认为最值得抓住的不是某一个模型 headline,而是四条线同时变清楚了:模型正在从“单点能力”变成“路由与预算系统”,评估正在从最终分数转向过程与偏差机制,记忆与技能正在被包装成可迁移资产,agent 安…

Codex AI Digest 深读版 · 2026-07-04

Codex 真读真写 · 论文/趋势/技能/工具/行动。这是 Codex 深读版,不是关键词卡。今天先读 26 篇候选、24 篇正文后,我的主判断是:Agent 的竞争正在从“谁回答得更好”转向“谁能被当作软件运行”。这意味着评测要看预算曲线,安全要在线监控,隐私删除要能定位到参数,工具链要补齐技能、沙箱、可恢复执行…

Codex AI Digest 深读版 · 2026-07-02

Codex 真读真写 · 论文/趋势/技能/工具/行动。这是 Codex 深读版,不是关键词卡。今天先读 24 篇候选、23 篇正文后,我更看重四条主线:Agent 竞争从模型能力转向反馈回路;推理架构开始重写多线程协作方式;企业真正缺的是把 AI 嵌进交付链路的人与流程;安全执行环境、技能包与网关正在成为开发者基础…