个人博客 · Personal notes

你好,我是

吴定帮

在复杂世界里,

保留清晰与好奇。

开始阅读
记录思考、创作与日常WDB / 2026

最近书写

01 — 03
01

执行之后:我理解的 AI 协作新能力

AI 能做得更多,不等于人可以少懂一点。真正被放大的,是目标、流程、审查与纠偏能力。

02

下午五点,我第一次认真认识 Codex

从一句“帮我做个博客”开始,我观察一项任务如何经过设计、验证、授权和上线。

03

把安全与运营写进工作流

权限、外部内容、软件依赖和持续监控,不是上线后的附加项,而是交付本身的一部分。

01 / 思考

执行之后:我理解的 AI 协作新能力

AI 能做得更多,不等于人可以少懂一点。真正被放大的,是我们定义目标、设计流程、检查证据和承担结果的能力。

方向是对的,但“执行不重要了”说得太满

我越来越认同一个变化:在办公和开发中,AI Agent 已能承担检索、写作、改代码、运行命令和测试等大量执行工作。于是人的稀缺价值,开始更集中在选对问题、拆清任务、划定边界、验收结果和及时纠偏上。

但这不是“执行能力被淘汰”。没有领域知识,就很难写出可靠的任务说明,也很难看出一个看似正确的答案究竟漏掉了什么。更准确的说法是:执行仍是底座,工作流设计与判断力成为新的放大器。

把一句命令,变成一条可验证的工作流

“修复登录问题”只是愿望;“先复现错误,再补边界测试,修改最小范围的源码,运行相关测试,最后列出风险和改动摘要”才接近可执行的流程。 好的工作流会写清目标、输入、边界、检查点、失败时的处理方式,以及完成的证据。

对 Codex 来说,项目根目录里的AGENTS.md还能沉淀长期规则,例如测试命令、目录约束和交付标准。它不是万能说明书,却能减少每次从头解释的成本。

审查不是“看一眼”,而是主动寻找反例

验收 AI 的工作,不能只问“能不能跑”。还要追问:它有没有越过权限边界?有没有破坏原有功能?失败路径、并发、数据一致性和回滚是否考虑到了? 这是一种负向测试思维——既看它做了什么,也找它没有做什么。

纠偏也应尽量基于证据。与其说“错了,重做”,不如指出失败的测试、错误发生的位置、被违反的约束和期望结果。 AI 可以协助审查,但最终的业务取舍与交付责任仍然属于人。

我没有采用的说法

固定的“30% 写指令、50% 审查、20% 决策”时间配比,不适用于所有岗位;“AI 工作流架构师”可以描述一种能力组合,却还不是普遍统一的职位;来源不明的漏洞率、恶意技能占比和夸张的倍数结论,也不应当作确定事实写入。

安全与运营,必须进入工作流

Agent 一旦能读取网页、调用工具、安装依赖或操作业务数据,风险就不只来自“写错答案”。网页和邮件里的提示注入、虚构的软件包名称、权限过大、凭据泄露和失控的自动操作,都可能把一次普通任务变成安全事件。

所以高风险动作需要人工确认;权限应遵循最小化原则;外部网络和依赖源要受控;部署之后还要持续观察质量、失败率、成本与异常行为。 应被审计的是可观察的工具调用、操作日志和结果,而不是要求系统暴露所谓“完整思考链”。

现实已经给出了一些信号

OpenAI 公布的内部实践显示,Codex 已被用于大多数代码审查;NTT DATA 的案例中,一项原本由五位资深工程师花三天完成的事件分析被缩短到约半小时;Australian Payments Plus 也报告复杂调查由约四小时缩短到约半小时。这些案例证明执行效率可以大幅提升,同时也更凸显流程、验证和治理的重要性。

我的结论是:未来真正有竞争力的,不只是“会让 AI 做事”的人,而是能把事情定义清楚、让过程可检查,并为最后结果负责的人。

核验来源

  1. OpenAI:Codex 现已正式发布

    OpenAI 内部工程师使用情况、PR 产出与代码审查实践

  2. OpenAI:Codex 的产品升级

    代码审查会阅读代码库、依赖关系,并运行代码和测试验证行为

  3. OpenAI:安全运行 Codex

    沙箱、审批、网络控制、身份权限与可审计记录

  4. OpenAI:提示注入

    连接网页和外部工具后,需要限制 Agent 能接触的数据与操作

  5. OpenAI × NTT DATA

    约 9,000 名活跃用户;一次事件分析由多人三天缩短至约 30 分钟

  6. OpenAI × Australian Payments Plus

    复杂调查由约 4 小时缩短至约 30 分钟,模拟原型也明显提速

  7. USENIX Security 2025:Package Hallucinations

    代码生成模型虚构软件包名称所带来的供应链风险

02 / 日常

下午五点,我第一次认真认识 Codex

有些工具要在完成一件具体的事之后,才会显出它真正改变了什么。

下午五点,窗外的光已经斜下来。我原本只想试一句:“帮我做一个个人博客吧,我叫吴定帮。” 没有配色表,也没有页面草图,连第一篇文章写什么都没决定。

屏幕上的变化比我预想得快。名字变成版头,空白被整理成文章、关于和页脚,暖白的底色上落下一点朱红。 但真正让我开始理解 Codex 的,不是页面突然出现,而是它接着检查手机尺寸、构建结果、分享封面和访问地址。

到了把网站放到国内服务器时,速度忽然慢下来:域名要先确认解析,服务器需要身份授权,网页之外还有 Nginx、HTTPS、证书续期和回滚。 原来“做完一个页面”和“交付一个能长期访问的网站”之间,隔着许多不该被跳过的检查点。

我也第一次发现,和 Agent 协作很像带着一支看不见的小队。它可以写、查、改、测,也会在权限不够时停住; 而我要做的,是说清楚我要什么,决定哪些边界不能越过,再判断它交回来的结果是不是我真正想要的。

那一刻我明白:我不必亲手敲下每一个命令,但我不能把目标、判断和责任一起交出去。

茶已经凉了,网站却亮了起来。我点开自己的名字,重新读了一遍首页。今天认识的不是一个会替我完成所有事情的机器, 而是一种新的工作方式——把模糊的想法变成可以一步步验证的现实。

关于这里

About

“把经历写下来,
让模糊变得清楚。”

你好,我是吴定帮。这个博客用来记录我正在理解的事:如何拆解复杂问题,如何做出更好的选择,以及如何在忙碌的日常里保持感受力。

文章不一定提供答案,但希望每一次书写,都能让问题向前走一步。

思考创作日常