<?xml version="1.0" encoding="UTF-8"?><rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom"><channel><title>编码智能体 · AI 简报 · darius.wiki</title><link>https://www.darius.wiki/topics/coding-agents/</link><atom:link href="https://www.darius.wiki/topics/coding-agents/rss.xml" rel="self" type="application/rss+xml"/><description>Claude Code、Codex、Copilot、Cursor 等工具的能力与边界</description><language>zh-CN</language><lastBuildDate>Sat, 10 Oct 2026 00:00:00 GMT</lastBuildDate><item><title>Claude Code 2.1.295 让钩子可以「失败即拦截」，网关可按上游限定模型和首包超时</title><link>https://www.darius.wiki/daily/2026-10-10/claude-code-2-1-295-hooks-fail-closed/</link><guid isPermaLink="true">https://www.darius.wiki/daily/2026-10-10/claude-code-2-1-295-hooks-fail-closed/</guid><pubDate>Sat, 10 Oct 2026 00:00:00 GMT</pubDate><category>工具</category><description>守卫类钩子出故障时不再默认放行，企业网关的路由和超时也能按上游细调。 视角: 「失败即拦截」是安全钩子该有的默认值：一个挂掉就放行的守卫，等于没有守卫。我会把拦截删除、拦截推送生产配置这类钩子都切到 block，同时给钩子本身加健康检查，免得它一出错就把整个团队卡住。</description></item><item><title>Codex CLI 0.162.0 加入受管 Git worktree 工具，并收紧 Linux 沙箱的几处漏洞</title><link>https://www.darius.wiki/daily/2026-10-10/codex-cli-0-162/</link><guid isPermaLink="true">https://www.darius.wiki/daily/2026-10-10/codex-cli-0-162/</guid><pubDate>Sat, 10 Oct 2026 00:00:00 GMT</pubDate><category>工具</category><description>Codex 开始自己管理并行工作目录，同时修补了沙箱规则可能被削弱的地方。 视角: worktree 交给智能体自己管，意味着同一仓库里并行跑多个任务会成为常态。我的建议是先在一个仓库里试，约定 worktree 的命名和清理规则；ripgrep 那条修复也提醒我们，沙箱规则要定期用实际命令去验证，而不是只看配置文件。</description></item><item><title>Copilot 代码评审可改由组织付费，并能限制只有授权用户才能触发</title><link>https://www.darius.wiki/daily/2026-10-10/copilot-code-review-org-billing/</link><guid isPermaLink="true">https://www.darius.wiki/daily/2026-10-10/copilot-code-review-org-billing/</guid><pubDate>Sat, 10 Oct 2026 00:00:00 GMT</pubDate><category>工具</category><description>组织可以决定评审额度由谁出，并防止外部许可证在自家仓库里触发评审。 视角: 默认档下成员额度一用完评审就失败，这对把评审设为必过检查的团队是隐患。我会改成组织付费并设预算，同时打开授权触发开关；和 10-05 评审开放 API 那条连起来看，评审正在从个人工具变成组织的流程成本，需要有人管账。</description></item><item><title>GitHub Copilot CLI 1.0.94-0 可在 /model 里直接发现并切换本地 Ollama 模型</title><link>https://www.darius.wiki/daily/2026-10-09/github-copilot-cli-local-models/</link><guid isPermaLink="true">https://www.darius.wiki/daily/2026-10-09/github-copilot-cli-local-models/</guid><pubDate>Fri, 09 Oct 2026 00:00:00 GMT</pubDate><category>工具</category><description>编码智能体可以在本地模型和云端模型之间按需切换，不用重启 CLI。 视角: 最容易踩的坑在最后一条：换成本地模型不等于代码不出机器。对代码有保密要求的团队，我建议把 COPILOT_OFFLINE=true 写进统一配置，而不是靠每个人记得切模型。</description></item><item><title>Codex CLI 0.161.0：默认模型换成 GPT-6.1 Sol，可按轮次指定网络安全访问计划</title><link>https://www.darius.wiki/daily/2026-10-09/codex-cli-0-161/</link><guid isPermaLink="true">https://www.darius.wiki/daily/2026-10-09/codex-cli-0-161/</guid><pubDate>Fri, 09 Oct 2026 00:00:00 GMT</pubDate><category>工具</category><description>这一版改了默认模型，也把权限和 MCP 登录做得更顺手，升级前值得看一眼。 视角: 默认模型一换，同样的脚本成本和输出风格都会变。CI 里跑 codex exec 的团队，我建议把模型显式写死，等在非关键任务上比完 Sol 的效果和账单再切。</description></item><item><title>GitHub Copilot 本地沙箱正式可用：限制智能体命令的文件、网络与凭据访问，企业可强制开启</title><link>https://www.darius.wiki/daily/2026-10-08/github-copilot-local-sandboxing/</link><guid isPermaLink="true">https://www.darius.wiki/daily/2026-10-08/github-copilot-local-sandboxing/</guid><pubDate>Thu, 08 Oct 2026 00:00:00 GMT</pubDate><category>工具</category><description>Copilot 在开发者本机执行的工具和命令，现在可以跑在按策略限权的沙箱里，不另收费。 视角: 让编码智能体放手跑，最大的顾虑一直是它在本机能碰到什么。我会先把团队的默认策略定成「只能写当前仓库、禁止读 Git 凭据、联网走白名单」，本地 MCP 服务器也一并纳入；这比事后审查每一条命令省心得多。用其他编码智能体的团队，也该照这个标准检查自己的隔离做法。</description></item><item><title>GitHub 推出专用密钥检测模型：读上下文识别无固定格式的密码，推送拦截与 Copilot /security-review 将陆续接入</title><link>https://www.darius.wiki/daily/2026-10-08/github-secret-detection-model/</link><guid isPermaLink="true">https://www.darius.wiki/daily/2026-10-08/github-secret-detection-model/</guid><pubDate>Thu, 08 Oct 2026 00:00:00 GMT</pubDate><category>安全</category><description>GitHub 用自己微调的模型做密钥扫描，覆盖告警、推送拦截和 Copilot 安全评审三个环节，并提前公布了计费方式。 视角: 智能体每步都在提交，密钥混进历史的概率只会更高，push 时就拦下比事后轮换便宜得多。我会先在已买 GHSP 的仓库开推送拦截试点，同时给 AI Credits 设预算上限，因为不拦截也会计费；GitHub 在说明里还特意写了「智能体不应在未授权时开启计费功能」，这条值得原样写进团队的智能体规则。</description></item><item><title>AWS 发布 aws-ai-ml 技能：让 Claude Code、Codex、Kiro 帮你压测 SageMaker 推理端点并生成部署代码</title><link>https://www.darius.wiki/daily/2026-10-06/aws-sagemaker-inference-agent-skill/</link><guid isPermaLink="true">https://www.darius.wiki/daily/2026-10-06/aws-sagemaker-inference-agent-skill/</guid><pubDate>Tue, 06 Oct 2026 00:00:00 GMT</pubDate><category>工具</category><description>云厂商把「选什么实例、怎么部署」的经验打包成编码智能体的技能，你描述目标，它给出可审阅、可运行的代码。 视角: 「技能」正在变成云厂商争夺编码智能体入口的新方式：谁的部署经验被装进智能体，谁的平台就更容易被选中。它产出的是代码而不是黑盒操作，这点我认同；但跑压测会真实开端点、产生费用，先在单独的账号里设好预算上限再让智能体动手。</description></item><item><title>GitHub Copilot 代码评审开放 REST / GraphQL API，默认评审力度改为 Balanced</title><link>https://www.darius.wiki/daily/2026-10-05/copilot-code-review-api/</link><guid isPermaLink="true">https://www.darius.wiki/daily/2026-10-05/copilot-code-review-api/</guid><pubDate>Mon, 05 Oct 2026 00:00:00 GMT</pubDate><category>工具</category><description>代码评审可以从你自己的脚本和内部系统里发起，并按次指定评审力度。 视角: 有了 API，AI 评审可以挂进自己的发布流程，比如只在改动涉及支付或权限时调高力度。默认力度变了，评审耗时和额度消耗可能随之变化，这周值得看一眼账单和 PR 等待时间。AI 写初稿后评审怎么分工，我在博客《当 AI 承担大部分初稿时的代码评审实践》里写过。</description></item></channel></rss>