2026-10-09 · 周五 · 8 条

Anthropic 启动 Cyber Mission 并更新使用政策、Copilot CLI 接入本地模型、LightOn 开源 OCR 小模型

今天的主线是「规则」:Anthropic 一天内既把模型能力交给防御方,又收紧了硬件控制、高风险推荐和地区的条款,OpenAI 也在同一天披露了影响力行动。对做产品的人,这意味着上线前的合规清单要多几行;工具这边,本地模型和小模型继续给成本留出空间。

RSS
  1. Anthropic 启动 Cyber Mission:关键基础设施防御计划首批 11 家伙伴,开源项目可免费申请模型扫描漏洞

    • 关键基础设施防御计划(CIDP)面向电网、水务、交通背后的 OT 系统与政府系统,向受信任的安全服务商提供前沿 Claude 模型、驻场工程师和威胁研究;首批伙伴包括 Accenture、CrowdStrike、Dragos、Palo Alto Networks、Rockwell Automation 等 11 家。
    • OSS Scanner 参照 Google 的 OSS-Fuzz,开源项目自愿加入后定期获得最强模型的免费扫描,每份报告附 PoC、解释和修复建议。
    • 报告由模型生成、不经人工复核直接发出,官方预期真阳性率在 90% 以上,也提醒会有严重程度判断不准等错误;跟不上处理量的项目继续走人工核实的披露流程。
    • 同时资助 Python 软件基金会、Apache 软件基金会,以及 Linux 基金会旗下的 Alpha-Omega 与 OpenSSF;本周早些时候 Project Glasswing 已并入扩大后的网络安全验证计划。

    开发者视角如果你维护的开源库被很多人依赖,我建议报名 OSS Scanner,但先指定一个人专门分拣这些报告:没有人工复核、真阳性率约九成,意味着每十份就可能有一份是噪音。我自己会先拿 AI 云盘依赖的几个上传、解析库看看它的报告质量。

  2. Anthropic 更新使用政策,11 月 12 日生效:新增控制实体硬件的规则,按所有权界定不支持地区

    • Claude 控制可能造成伤害、会自主做出物理动作的硬件时,须有合格操作员能观察并随时叫停,断开 Claude 后设备要能保持安全状态,对应 Anthropic 的 Model Hardware Standard。
    • 高风险场景(医疗、金融、法律、就业等)仍要求合格的人在环审核并告知受影响者用了 AI,新版写明了具体涵盖哪些推荐。
    • 不支持地区的限制明确覆盖:人在这些地区、公司注册或总部在这些地区,以及由这些地区的主体多数控股或控制的实体。
    • 选举部分改名为「不得破坏民主进程」,取消对个性化投票与竞选定向的一刀切禁令;新增禁止对模型进行持续、无目的的辱骂,正常的不满、黑暗题材创作和模型测试不算在内。

    开发者视角智能面试正好落在「就业」这一类高风险场景里,我会在 11 月 12 日前把两件事补齐:结果页写明哪些评价由 AI 给出,HR 端保留人工复核与改判入口。做出海或有外资背景的团队,也该顺手核对一下股权结构是否踩到地区条款。

  3. OpenAI 披露并阻断两起借 AI 运作的「假门面」影响力行动

    • OpenAI 称阻断了两起借助 AI 的影响力行动。
    • 行动以虚构的记者和一家智库作为「假门面」,用来传播地缘政治信息。

    开发者视角和同一天 Anthropic 新增的「虚假活动」条款放在一起看,两家都在把「批量造假身份、假内容」当成重点打击对象。PandaClaws 这类多账号分发的内容工具要注意:账号身份要真实可追溯,别让批量生成的人设看起来像在冒充媒体或机构。

  4. GitHub Copilot CLI 1.0.94-0 可在 /model 里直接发现并切换本地 Ollama 模型

    • 从 1.0.94-0 起,/model 会列出正在运行的本地 Ollama 实例里的模型,与已配置模型和 Copilot 云端模型并列。
    • 发现不等于自动添加:选中后先确认 provider 和 endpoint,可选「本次会话使用」或「添加但不切换」;连接失败会在选择器里说明原因。
    • 本地模型须支持工具调用和流式输出;该功能不负责安装运行时或下载模型。
    • 选本地模型不会开启离线模式,也不会关闭 GitHub 遥测;离线模式需设置 COPILOT_OFFLINE=true 主动开启。

    开发者视角最容易踩的坑在最后一条:换成本地模型不等于代码不出机器。对代码有保密要求的团队,我建议把 COPILOT_OFFLINE=true 写进统一配置,而不是靠每个人记得切模型。

  5. Codex CLI 0.161.0:默认模型换成 GPT-6.1 Sol,可按轮次指定网络安全访问计划

    • GPT-6.1 Sol 成为内置目录和 Amazon Bedrock 目录里的默认模型;Bedrock 上的兼容模型支持 multi-agent V2 和 Ultra 推理。
    • 可用 codex exec --cyber-access-program 或 TypeScript SDK 的 cyberAccessProgram 选项按轮次选择网络安全访问计划。
    • 可在运行中的终端会话里用 /mcp login <name> 登录 MCP 服务器。
    • 修复:获批的文件系统提权仍遵守已拒绝的读取与网络限制,后台任务沿用发起轮次的权限;请求重试与 WebSocket 回退到 HTTP 时遵循服务端的重试指引。

    开发者视角默认模型一换,同样的脚本成本和输出风格都会变。CI 里跑 codex exec 的团队,我建议把模型显式写死,等在非关键任务上比完 Sol 的效果和账单再切。

  6. LightOn 开源 LightOnOCR-3:0.8B 到 4B 三个尺寸,Apache 2.0,olmOCR-Bench 最高 86.3

    • 三个模型 0.8B、1B、4B,Apache 2.0,可商用;0.8B 和 4B 改用 Qwen3.5 视觉语言架构。
    • olmOCR-Bench 总分:4B 86.3、0.8B 85.5、1B 84.5;参数 35.1B 的 Infinity Parser Pro 为 87.6。ParseBench 上 4B 75.1,高于 Infinity Parser Pro 的 74.3。
    • 1540 px 分辨率下吞吐最高 0.8B 每秒 4.78 页、4B 每秒 3.36 页;1B 单页延迟最低,2.7 秒。
    • 新的 grounding 模式输出带标签的边界框、图片描述,并把图表数据转成 HTML 表格。

    开发者视角0.8B 只比 4B 低不到 1 分,这对 AI 云盘的文档解析很有吸引力:我会先拿用户上传最多的扫描件和带表格的 PDF 做一轮对比,看能不能把一部分解析从云端 API 挪到自己的机器上。

  7. Liquid AI 开放 d1 决策模型:d1-3B 一次前向给出判断,RTX 4090 上单题 8 毫秒

    • 两个开放权重模型:d1-3B 基于 LFM2.5-VL-3B,输入文本和图片;d1-omni-600M 输入文本加图片或音频,官方标注为实验性研究版本。
    • Decision Index 0.2.1 上 d1-3B 得 48.57,是 10B 以下最高,高于 Decider 35B-A3B 的 47.11;七个公开数据集均分 d1-3B 82.9、d1-omni-600M 78.4。
    • d1-3B 单题延迟:RTX 4090 8 毫秒、Apple M5 Pro 30 毫秒、Jetson Orin Nano 50 毫秒。
    • 需要 transformers 5.14 及以上并开启 trust_remote_code;文中未写明许可证。

    开发者视角内容审核、路由、是否需要转人工这类「是或否」的判断,没必要每次都调生成式大模型。我会把 PandaClaws 里的发布前合规判断拿来试 d1-3B,但许可证没写清之前只做评估、不上线。

  8. NVIDIA 微调 Nemotron 拿下 IOI 2026 535.4/600、IMO 2026 30/42 金牌线成绩,并开放权重与训练数据

    • IOI 2026:Nemotron-3-Ultra-CC(550B 总参、55B 激活)加 SFT 与 GenCorrect 得 535.4/600,金牌线 361.12,人类最高 498.27;非官方参赛、不计入正式排名。
    • IMO 2026:基于 Nemotron 3 Ultra 的系统得 30/42,高于金牌线 29 分,证明由官方 IMO 评分员评分。
    • 放出 Ultra-CC 的 NVFP4 权重、IMO 的 SFT 与 RL 检查点、两套训练数据(含 2.2 万道编程题),以及 200 题的 Nemotron-IMO-Bench;推理与评测流程在 NeMo-Skills 仓库。
    • 文中未写明许可证。

    开发者视角550B 的模型多数团队用不上,真正值得拿走的是方法:Nano(30B 总参、3B 激活)在 IOI 2025 上从 SFT 后的 280 分靠 GenCorrect 这类测试时策略提到 468 分。做代码类产品的,可以先在自家评测集上试「生成后再自我纠错」这一层。

本期由 AI 辅助检索与起草,选题标准与观点由 Darius 设定。