AGENTS.md 别再写成流程大全:它该替你的 AI Agent 把三件事说清楚
Agent 回答“已完成”时,改动已经落到文件里了。人一复核,才发现它从仓库根启动,却把 services/payments/ 的规则当成全项目规则;又或者它从几份互相打架的说明里,挑了一条已经废弃的测试命令跑了一遍。
这类返工很烦,因为 …
Agent 回答“已完成”时,改动已经落到文件里了。人一复核,才发现它从仓库根启动,却把 services/payments/ 的规则当成全项目规则;又或者它从几份互相打架的说明里,挑了一条已经废弃的测试命令跑了一遍。
这类返工很烦,因为 …
你把 Agent 接进内部系统后,最危险的那一步通常不是模型回答错了。
而是它开始替你执行代码:装一个包,跑一段 Python,拉一个仓库,开 Chromium 点几个页面 …

你刷到一个帖子,说 Codex 现在能做视频了。
下面一堆人推荐 HyperFrames。GitHub stars 很高,文档也漂亮:写 HTML,渲染视频,专门给 agent 用。
你顺手装上,打开文档才发现不太对。
你真正想做的,是把 …
前几天看到一个视频,标题很猛:“Anthropic just made AI agents 10X better with new standard”——讲的是 agentskills.io。评论区一片叫好,但 …
网上说 Go 后端转 AI Agent,动不动 40K、60K。
我第一反应不是激动,是怀疑。
这类说法太容易变成培训班招生,也容易被技术圈一句“套壳”打掉。我去翻了一圈公开招聘页,结论比这两种都别扭一点:
30K-60K 的样本确实存在, …
你已经有一堆 Go 服务了。
订单、库存、权限、工单、内部审批,全都跑在线上。现在老板说要接 Agent,第一反应往往是:是不是又要拉一套 Python 服务?是不是 Go 只能在旁边当业务 API?
这个问题在 2024 年还比较尴尬。那 …
晚上十一点多,我盯着终端里那段 diff,第一反应不是生气,是有点懵。
我明明只让 Agent 改一个很小的接口判断。结果它顺手动了 service,改了 model,又把测试绕过去了。最后还很认真地补了一段解释:这些改动是为了保持架构一 …
你把任务卡创建好了,researcher、writer、coder 也都分配了。
然后什么都没发生。
这不是 bug。恰恰相反,这是 Hermes Kanban 最容易被误解、也最值得讲清楚的地方:创建 card,不等于启动 worker。 …
你创建了 5 张 Agent 任务卡,以为系统会自动开干。
结果过了十分钟,什么也没发生。
不是模型不行,也不是任务拆得不够细。问题更尴尬:卡片创建,不等于任务执行。
这就是我这两天把文案线从 TASK_BOARD.md + …
一个团队花了两周,搭了三 Agent 流水线——研究员搜集数据、写作者整理报告、审核者把关质量。
跑起来之后发现:每次执行花 40 秒,API 账单涨了 3 倍,调试时根本不知道哪个 Agent 说了什么。
最后他们回到单 Agent,5 …
很多老板现在对 AI 工具最大的顾虑,不是贵,也不是不会用。
而是另一件更现实的事:你买回去,团队热闹两天,最后发现它只是个演示玩具。
能聊天,能写两段话,能给你看几个很唬人的 demo。真到了日常工作里,要么接不上流程,要么没人愿意学,要 …
大家都在问:Qwen3.6-Plus 到底有没有超过 Claude?
说实话,这不是这次发布里最值得看的问题。真正该盯住的是另一件事:阿里这次发的,已经不只是一个“更强一点的 Qwen”,而是在把自己往 hosted agent model …
核心就一句话:当所有人都在讨论"怎么用 AI 赚钱"时,最先赚到钱的,永远是那群"教人怎么用 AI"的人。
昨天晚上,有个读者在后台问我:
“Zampo,现在入局龙虾代运营还来得及吗 …
最近不少朋友问我,为什么我把主力 Agent 从 OpenClaw 切到了 Hermes。
先说结论:不是 OpenClaw 不好。恰恰相反,OpenClaw 当初最打动我的地方,就是它够猛,够自由,够像一台你可以随便改、随便接、随便折腾的 …