← 返回目录

生成式AI日报 · 2026-09-23

过去 24 小时生成式人工智能领域动态 · 共 10 条

  1. OpenAI 发布 GPT-6 Sol 与 Luna:API 价格降 50%,ChatGPT 付费档全量开放

    OpenAI 官方(一手) · 2026-09-23 02:06 北京时间

    OpenAI 在旗舰 GPT-6 Astra 发布不到三周后扩充产品线,推出 GPT-6 Sol 与 GPT-6 Luna。官方称两款模型沿用与 Astra 相似的训练方法,把 Astra 在专业工作、事实性、编码、计算机使用和对齐方面的能力带到更快、更便宜的模型上,定位是"把新一代智能的收益以更低成本分发出去"。

    价格是本次发布的核心:两款模型 API 价格相比 GPT-5.6 促销价下调 50%——Sol 输入 $2、输出 $10(每百万 token,原 $4/$20),Luna 输入 $0.10、输出 $0.50(原 $0.20/$1.20)。OpenAI 表示缓存与推理改进带来的成本下降将直接让利给用户,缓存读取可享 90% 折扣;同日发布的《Better prompt caching for GPT-6》提到,GitHub 称相关缓存改进已让其数十亿请求中需重新处理的 prompt token 减少超过 50%。

    能力对比(OpenAI 自述):AutomationBench 上 GPT-6 Sol(xhigh)得分 33.2%,高于 Claude Opus 5(max)的 26.9%,单任务成本仅约其 9%;DeepSWE v1.1 上 Sol 得 68.8%,距 Claude Fable 5 的 69.9% 仅 1.1 个百分点,成本约低 80%;内部事实性评测中 Sol 的错误约为上代一半;Luna 高档位可用约百分之一的成本追平 GPT-5.6 Sol。

    可用渠道:即日起在 ChatGPT Work 与 Codex 向 Plus、Pro、Business、Enterprise、Edu 用户开放(为保持服务稳定当天逐步推送);免费版与 Go 用户可在桌面端使用 GPT-6 Luna;两款模型暂未进入 Chat。API 中模型名为 gpt-6-sol 与 gpt-6-luna。

    (链接为 OpenAI 官方公告一手页;中国媒体《财联社》《IT之家》《华尔街见闻》等于北京时间 9 月 23 日凌晨跟进报道,并指出两家美国巨头同日降价加剧了 AI 模型价格战。)

  2. Anthropic 发布 Claude Opus 5.5:性能对标 Fable 5.1,运行成本降 40%

    Anthropic 官方(一手) · 2026-09-23 03:00 北京时间

    Anthropic 发布 Claude Opus 5.5——Claude 5.5 家族的首款模型。官方称它在多数工作上表现媲美更大的 Claude Fable 5.1,运行成本比 Opus 5 低 40%,并称在自动化行为审计(其最全面的对齐测试)中是"迄今测试过表现最强的模型"。

    降价幅度明确:输入 $4、输出 $20 每百万 token(Opus 5 为 $5/$25,降 20%),缓存读取降至 $0.20(降 60%,而缓存读取占 Agent 与编码类工作成本的大头),默认设置下典型工作负载总成本降 40%,输出速度比 Opus 5 快 30% 以上。Claude Code 与 Claude 平台另提供最高 2.5 倍速度的 Fast mode($8 输入/$40 输出)。

    订阅用户直接受益:Pro、Max、Team 及按席位计费的 Enterprise 的 5 小时用量上限提高;同时 Anthropic 向订阅用户提供一次速率重置,可自行选择何时使用。

    性能与场景:Terminal-Bench 4.0 得 66.4%(Fable 5.1 为 55.8%),GDPval-AA v2.1 拿到 1846 Elo;早期测试者用它在不到一天内完成 68 万行代码迁移,另一测试中 3 小时完成 20 万行代码库审计修复(Opus 5 需 20 小时以上)。因生物学与网络安全能力对标 Claude Mythos 5.1,Opus 5.5 配备与 Fable 5.1 类似的护栏,相关高风险用途需通过 Life Sciences / Cyber Verification Program 申请解锁;Sonnet 5.5 与 Haiku 5.5 将在数周内推出。

    背景:这是 Amodei 公开呼吁"放缓前沿(pace the frontier)"后 Anthropic 的首个模型发布,发布前由 METR、Frontier Design 等外部机构评估。同日 OpenAI 发布 Sol 与 Luna,英国《金融时报》评价两家同日推出低价版本、AI 价格战进一步加剧。发布前 1.5 小时左右 Anthropic 先出牌,随后 OpenAI 跟进,被媒体称为"正面对抗"。

    (链接为 Anthropic 官方公告一手页;IT之家、驱动中国等北京时间 9 月 23 日凌晨跟进。)

  3. xAI 发布 Grok 4.7:参数升至 2.1 万亿,价格不变,评测褒贬不一

    机器之心(腾讯新闻) · 2026-09-22 10:07 北京时间

    北京时间 9 月 22 日(美国当地时间 9 月 21 日),马斯克旗下 xAI 发布 Grok 4.7,定位"面向编程与知识工作的最强模型",此前该模型已多次推迟发布。官方称其换用规模更大的基础模型、开展更长周期的强化学习训练,参数量提升至 2.1 万亿(上一代 Grok 4.6 为 1.5 万亿,增幅约 40%),重点强化长时间任务、自我检查与长上下文管理,并把文档、演示文稿、法律、医疗、工程等专业工作纳入重点测试。

    定价维持不变:输入 $2、输出 $6 每百万 token,与 Grok 4.6 持平;官方口径是"速度达到可比模型两倍、价格只有一半",安全防护称为迄今校准最佳。马斯克在 X 上称其"在智能、速度与低成本之间取得了很强的竞争力"。

    首批评测褒贬不一:第一财经、爱范儿等媒体认为这更像一次补齐短板的追赶而非全面超越,跑分亮眼但实测反馈存在争议;也有券商点评(中信证券)认为其延续了高性价比竞争思路,并关注非编程场景的能力拓展。腾讯科技报道称模型即日起在 Cursor 等渠道可用。

    (注:xAI 官方公告页本次抓取未能访问,暂附机器之心原文报道链接。)

  4. 小米发布并开源 MiMo-V2.6 系列:全模态 Pro/Flash,同步上线 Desktop 正式版与订阅

    21世纪经济报道 · 2026-09-22 19:08 北京时间

    9 月 22 日,小米发布并开源新一代 MiMo-V2.6 系列:全模态旗舰 Xiaomi MiMo-V2.6-Pro(面向复杂编程、Agent 与专业任务)与高效推理模型 Xiaomi MiMo-V2.6-Flash,两款均原生支持图片、视频、音频、文本输入。

    同步上线的还有 Pro 版本的 UltraSpeed 超高速模式(多方报道称同等智能水平下输出速度提升 20 倍,将逐步开放)与 MiMo Desktop 桌面客户端正式版,后者配套推出会员订阅方案。

    第三方测评平台 Artificial Analysis 的综合智能指数显示 MiMo-V2.6-Pro 进入全球第一梯队,多家媒体称其登顶全球开源大模型榜;小米官方口径为"价格不变、智能翻倍"。21 世纪经济报道提到其训练耗时六天、花费约 347 万美元;小米罗福莉称该系列技术难度超过 DeepSeek R1。

    北京日报、爱范儿、PConline、智东西等当日均跟进报道;昨日日报(2026-09-22 期)已对该发布做过报道,此处补充 Desktop 订阅方案与训练成本细节。

  5. Meta 承认 Muse 深度“借鉴”开源助手 OpenClaw,文件名与 SOUL.md 几乎照搬

    TechCrunch(一手报道) · 2026-09-23 03:09 北京时间

    Meta 新 AI 助手 Muse 上线两周已登顶美国 App Store 免费榜,Appfigures/Apptopia 等估算其美加下载量与日活超过 ChatGPT 同期表现;但争议随之而来——网友发现 Muse 的工作区文件名与内容和开源个人助手 OpenClaw 高度相似,连定义 AI 人格的 SOUL.md 文件都近乎一致。

    Meta 超级智能实验室(MSL)产品负责人、前 GitHub CEO Nat Friedman 在 X 上回应承认:Muse 确实"从零构建",但作为产品"definitely heavily inspired by OpenClaw";他称自己 1 月用过 OpenClaw 后为 MSL 团队买了数百台 Mac mini,"我们很多人爱上了用 OpenClaw"。对于为何照搬文件名与近乎相同的内容,Friedman 回答"我们认为 Peter(OpenClaw 作者 Peter Steinberger)把这些做对了",并称目标是做出"类似 OpenClaw、但安全易用、能扩展到数十亿人"的产品。

    背景:OpenClaw 是开源项目,其作者 Peter Steinberger 今年 2 月已加入 OpenAI;TechCrunch 评论称这再次体现了 Meta 的一贯打法——盯上有潜力的产品并复制其最佳功能(如 Stories)。Meta 发言人回应称无更多补充。

  6. AWS Bedrock 接入 Kimi K3:中国大模型进入美系云核心渠道,分成合作落地

    每日经济新闻 · 2026-09-22 20:08 北京时间

    9 月 21 日,亚马逊云科技(AWS)旗下大模型服务平台 Amazon Bedrock 宣布接入月之暗面(Moonshot AI)开源大模型 Kimi K3,全球企业开发者可通过 Bedrock 直接调用。

    每日经济新闻、澎湃新闻报道称,此前市场传闻的"Kimi 与海外云厂商收入分成合作"随之正式落地。这是中国大模型出海、进入美国云巨头核心渠道的标志性一步:国内模型厂商开始从单纯出海卖模型,走向与海外云平台的收入分成模式。

  7. 高通骁龙峰会发两款新芯片:旗舰款可在手机本地跑 300 亿参数 MoE 模型

    TechCrunch / IT之家 · 2026-09-23 04:00 北京时间

    夏威夷时间 9 月 22 日 9 点(北京时间 9 月 23 日 3 点),高通在 2026 骁龙峰会发布两款新一代智能手机芯片,重点强调 AI 能力。TechCrunch 报道,高通称新款旗舰芯片可在手机本地运行 300 亿参数的混合专家(MoE)模型。

    IT之家报道,高通宣布携手阶跃、无量火及江波龙,基于第六代骁龙 8 超级至尊版移动平台,完成阶跃 StepEdge-Omni 30B-MoE 模型的端侧适配与推理优化,并现场演示了相关智能体助手。

    对用户的直接影响:下一代安卓旗舰将能在不上云的情况下运行更大规模的生成式模型,端侧 Agent/智能体助手会更普及,同时离线可用性与隐私性提升。

  8. 加拿大 BC 省在加州起诉 OpenAI 及奥尔特曼:指控未用 ChatGPT 日志预警枪击案

    环球时报新媒体 / 凤凰网(引彭博社) · 2026-09-22 22:21 北京时间

    当地时间 9 月 21 日,加拿大不列颠哥伦比亚省(BC 省)在美国加利福尼亚州对 OpenAI 及其 CEO 山姆·奥尔特曼提起诉讼。

    据彭博社、《卫报》等报道,这起诉讼与一起大规模枪击案有关:原告方指控 OpenAI 本可以利用 ChatGPT 的对话日志向警方发出提前警告、从而避免或减少伤害,但未能及时做到,要求其承担责任。

    这是 OpenAI 面临的又一起诉讼,焦点落在聊天机器人日志的审查义务与用户数据的责任边界上。

  9. 据报 OpenAI 与 Anthropic 接近达成协议:将互相测试对方 AI 模型

    鞭牛士(转引外媒) · 2026-09-23 05:28 北京时间

    据外媒报道(鞭牛士等转引),OpenAI 与 Anthropic 正接近达成一项协议,将互相测试对方的人工智能模型。若落地,这将是两家头部模型厂商在激烈竞争之外的首次系统性互测,也被视为头部实验室在安全评估上加强横向验证的信号。

    报道目前停留在"接近达成协议"阶段,未披露具体测试范围、时间表与结果公开方式,尚无官方公告确认。

  10. 软银超 200 亿美元垃圾债获初步认购,资金投向 OpenAI 及 AI 算力基建

    智通财经 · 2026-09-22 20:56 北京时间

    智通财经报道,软银集团一笔有望成为全球债券史上最大规模之一的垃圾债发行,已获得超过 200 亿美元的初步认购需求,最高收益率可能达到 10%。

    报道称这笔资金的配置重心高度集中于 OpenAI 及其背后的 AI 算力基础设施建设。投资者争相认购,显示资本市场对 AI 资产的胃口依然强劲,也意味着 OpenAI 生态将继续获得大额资金支持。