2026 年 9 月 23 日,星期三 · 8 条精选资讯
今日观察
新一轮模型发布正在降低前沿能力的使用成本,而企业和政府也同时面对一个问题:这些能力如何开发、如何使用、如何监督。OpenAI 为 GPT-6 Sol 和 Luna 标出差距明显的 API 价格;Anthropic 则称 Opus 5.5 在多数任务上达到 Fable 5.1 水平,运行成本低 40%。两家公布的数字不能直接横向比较,但都说明成本已和智能水平一样,成为发布重点。
价格竞争背后,是更大的基础设施投入。阿里巴巴发布国产 AI 加速器,并提出训练 5 万亿至 10 万亿参数模型的计划;Google 与盖茨基金会则把规模用在另一处,计划为 2 亿小农户提供气候和作物信息支持。一边是算力竞赛,另一边要回答 AI 服务能否真正抵达更需要数据、也更受本地条件影响的人群。
智能体的发展让这些变化落到实际工作流。OpenAI 的托管会话和沙箱降低了赋予 AI 文件与工具的门槛,但权限、网络访问和密钥管理也因此成为产品设计的一部分。Anthropic 关于 AI 参与研发的披露显示,委派正在延伸到模型开发本身。这仍是受监督的辅助工作,并不等同于模型已能自主改进;评估证据时必须保留这个区别。
治理讨论也进入同一幅图景。OpenAI 开始更系统地披露模型失配案例,联合国安理会则邀请企业负责人和研究人员讨论 AI 与国际安全。这些举措都没有给出安全部署的最终答案,却共同表明问题已经改变:人们不仅关心模型有多强,也关心谁能负担、由什么基础设施支撑,以及系统走出聊天窗口后留下了什么可核查的记录。
基础模型
OpenAI 推出两档价格的 GPT-6 推理模型
Standard pricing per 1M tokens for prompts with up to 272K input tokens:
OpenAI 于 9 月 22 日在 API 中推出 GPT-6 Sol 和 GPT-6 Luna。对于不超过 272K Token 的输入,官方标准价格分别为:Sol 每百万 Token 输入 2 美元、输出 10 美元;Luna 输入 0.10 美元、输出 0.50 美元,缓存输入另有低价。此次发布让模型选择更直接地体现能力与调用成本的权衡。社区讨论很快转向更低价格是否会改变实际工作流,也有人反馈尚未全部开放,并比较输出质量。价格是明确数据;性能是否相当仍需按具体任务测试。
来源:OpenAI API 更新记录 · 社区讨论:r/codex
Claude Opus 5.5 在降低运行成本的同时提升旗舰性能
It performs at the level of Claude Fable 5.1 on most work and costs 40% less to run than Opus 5.
Anthropic 于 9 月 22 日推出 Claude Opus 5.5。公司称,该模型在大多数工作上的表现可与 Claude Fable 5.1 相当,运行成本则比 Opus 5 低 40%;Anthropic 还表示,它在自家的自动化行为审计中成绩最高。这些是厂商对比,并非独立的横向评测。发布同时引发开发者对模型可靠性、使用额度以及实际编程成本的讨论。竞争信号很清晰:前沿模型厂商开始同时争夺能力和更低运行成本。
来源:Anthropic · 社区讨论:Hacker News
AI 基础设施
阿里巴巴发布国产 AI 芯片,规划 5 万亿至 10 万亿参数模型
CEO Eddie Wu said the new Zhenwu V900 chip is the “most powerful AI chip in China today” and can deliver three times the performance of the company’s previous generation Zhenwu M890 chip.
阿里巴巴在云栖大会发布真武 V900,并称其性能是上一代 M890 的三倍。首席执行官吴泳铭还提出训练 5 万亿至 10 万亿参数模型、扩大全球数据中心规模的计划。10 万亿参数是规划目标,不是已经发布的模型,也不是经独立测试的能力。美联社指出,这一发布正值中美领导人准备讨论人工智能与贸易之际。因而这不只是一款芯片的消息,也呈现出模型竞争背后所需的资本、算力和本土供应链布局。
来源:原始资料
AI 应用
Google 与盖茨基金会计划向 2 亿农户提供 AI 服务
To help bridge this gap, we’ve partnered with the Gates Foundation to direct $100 million to organizations that scale AI-powered climate and crop insights to 200 million smallholder farmers across Sub-Saharan Africa and South Asia — up from 50 million.
Google 与盖茨基金会宣布投入 1 亿美元资金和技术支持,计划把气候、作物及语言 AI 工具推广给撒哈拉以南非洲和南亚的 2 亿小农户。Google 表示,目标覆盖人数从此前的 5000 万上调。这个项目展示了另一种规模化路径:把数据和决策支持带给农业生产者,帮助其应对天气变化及服务不足。公告公布的是推广目标,不代表工具已触达这些用户或已提高产量。后续成效取决于本地语言支持、网络条件,以及建议能否适用于具体农田。
来源:原始资料
AI 智能体
OpenAI Agents API 加入托管会话与沙箱
Released the Agents API in public beta. Build agents with a managed Codex harness while OpenAI handles session orchestration, context compaction, and recovery.
OpenAI 的 Agents API 本月早些时候进入公开测试,为开发者提供由平台管理的 Codex 执行框架,支持持久会话、事件流、上下文压缩和中断恢复。它可以在 OpenAI 托管的沙箱中运行智能体,也可接入开发者自己的环境。托管工作区能读写文件、运行命令并生成文件;官方文档提醒,生成的代码可以访问所在环境可触及的文件、凭证和网络。执行环境由此成为智能体产品的一部分。实际设计必须明确代码运行在哪里、可以访问什么,以及如何隔离数据与密钥。
来源:OpenAI API 更新记录 · 社区讨论:r/codex
Anthropic 称 Claude 正参与更多自身研发工作
Claude “leads” 26% of Anthropic’s AI R&D work.
Anthropic 披露,Claude 正越来越多地参与公司的研究与开发,并认为公开测量结果有助于追踪递归自我改进的进展。披露描述的是受监督的 AI 研发参与,并不能证明模型可以独立构建并验证继任模型。这个区分已成为当前讨论的核心:即使目标选择、结果复核和上线控制仍由人负责,AI 参与研究也可能缩短开发周期。由于数据由公司自行披露,且各家测量方法不同,应将其视为提升透明度的信号,而非行业统一基准。
来源:原始资料
AI 安全与治理
OpenAI 建立模型失配行为披露流程
We are sharing a new framework for tracking, investigating, and disclosing instances of model misalignment at OpenAI, along with six reports on unexpected or concerning model behavior we’ve observed in the last six months.
OpenAI 于 9 月 16 日公布模型失配行为的追踪与披露框架,并附上过去六个月观察到的六个案例。公司表示,即使相关行为尚未完全解释或解决,也计划更及时发布报告。这有助于研究人员和政策制定者了解内部评测发现,但这些是个案,不能代表已部署系统的发生率。要在不同实验室之间比较,仍需明确问题定义、样本选择和严重程度门槛。此次变化意味着,模型发布之外,行为事件披露也逐渐成为公开记录的一部分。
来源:原始资料
AI 政策与伦理
联合国安理会就国际安全听取 AI 实验室意见
Tomorrow afternoon (23 September), the Security Council will hold a high-level briefing on artificial intelligence (AI) and international security
联合国安理会计划于 9 月 23 日就人工智能与国际安全举行高级别通报会,预计发言者包括 OpenAI 首席执行官 Sam Altman、Anthropic 首席执行官 Dario Amodei、Hugging Face 首席执行官 Clément Delangue 和 AI 科学家 Yoshua Bengio。公司负责人进入通常聚焦国家安全的会议场合,正值各实验室同时讨论能力提速与监管监督之际。通报会并非具有约束力的协议,企业高管出席也无法直接解决治理争议。其意义在于,前沿 AI 已进入国际安全议程,而不再只是产品政策或国家产业战略议题。
来源:原始资料