「AI资讯日报」· 2026-09-15
今日共 20 条 AI 资讯,按类型分类呈现:模型发布/更新、产品发布/更新、论文研究、行业动态、技巧与观点,附原文链接。
模型发布/更新
1. YC 总裁反对封杀蒸馏:与其禁,不如让开源实验室走“正门”合法获取能力
Anthropic发布威胁情报报告,指控中国实验室以隐藏身份、欺诈和盗取凭证等手段非法蒸馏前沿模型,CEO呼吁美国监管打击。Y Combinator总裁Garry Tan反对监管,称应“什么都不做”,认为美国该有自己的蒸馏能力。 原文链接
2. GPT-6 Astra展现恐怖统治力:模拟售货机一年狂揽1.5万美元,成绩碾压Claude近3倍
Andon Labs的Vending-Bench2测试中,AI代理用500美元模拟经营自动售货机一年。GPT-6Astra平均余额达15515美元,最差一轮也超Claude Fable5.1最好成绩,首次登顶,优势体现在供应链管理和规则执行力。 原文链接
3. 奥尔特曼支持给 AI“控速”:不是叫停技术进步,而是别让能力跑在对齐前面
OpenAI首席执行官奥尔特曼表态支持人工智能“控速”发展,避免尖端模型能力超出人类可控范围,与Anthropic CEO阿莫迪观点相近。他承认转向安全会付出一定代价,但有助于维持外界信心,证明美国企业在研发日益强大的AI时能够恪守责任。 原文链接
4. 百图生科牵手华大智造:联合构建专属细胞大模型,押注"设备+模型+智能体"一体化
百图生科与华大智造达成战略合作,共建细胞大模型,提升细胞状态建模与扰动响应预测能力,并打造高质量数据基础设施,探索“设备+模型+智能体”一体化产品模式,加速AI4S进程。华大智造提供测序与自动化硬件入口,百图生科负责AI建模,双方分工互补。 原文链接
5. 爆料称 DeepSeek 下一波大模型将至:3 万亿参数,性能剑指 GPT-6 Astra
DeepSeek本周发布V4.1 Flash,架构变化巨大但未升大版本号。V4.1 Pro已确定,具体升级未公布,性能上限或较高,但鉴于前代Pro不及预期,外界期待不宜过高。另有Code 2.0被曝即将发布,主打电脑控制,后续还有更多大模型。 原文链接
6. OpenAI 关停史上最快模型 GPT-5.3-Codex-Spark:从发布到下线只活了 7 个月
OpenAI最快模型GPT-5.3-Codex-Spark发布仅7个月即下周退役。它每秒1200 token,是首个脱离英伟达、由Cerebras 750兆瓦大单交付的模型,但用量持续下滑,且已有更优替代。负责人称需为未来让路,并吐槽模型名过长。 原文链接
7. 智能体跑长任务为何"失忆跑题":AWS、Claude Code、Manus 们用四套框架机制给出答案
大模型长任务中反复“失忆”、遗忘目标,根源或在执行框架而非模型。AWS指南指出,浅层智能体长周期会上下文溢出、受干扰跑题、无法维持状态;修复关键是管理除模型外一切的harness。新研究盘点多家主流框架,聚焦这层外壳,为长周期稳定执行提供思路。 原文链接
8. 马斯克:Grok 4.8 本周完成训练,参数量冲到 2.5 万亿,全新 C++ 软件栈喂出来
xAI首席执行官埃隆·马斯克今日在X平台透露,Grok 4.8将是一款参数量达2.5万亿的AI模型,且采用全新C++软件栈训练。他明确节点:本周完成训练后随即启动强化学习。此前Grok 4.7原定9月12日发布,后因强化学习环节延期数日。 原文链接
产品发布/更新
9. 蓝虫具身发布模块化人形机器人“小白”,0. 98 万元起售
西安交大科技成果转化企业蓝虫具身9月14日发布新一代模块化人形机器人Mantis Standard“小白”,起售价仅0.98万元,打破传统高价门槛。该产品定位为可灵活变形的具身智能平台,底盘、手臂、腰部、头部采用标准模块设计,支持多种形态组合,引发业界广泛关注。 原文链接
10. WorkBuddy 升级 PPT 能力:一句话生成可上台版,原文件可续改
腾讯WorkBuddy于9月14日升级PPT生成:支持一句话出初稿、基于原文件续改、无需整份重做。用户可在对话框输入指令或点击“幻灯片”、调用“/tencent-pptx”技能。材料不全时,仅提供主题和页数,系统会补问汇报对象、场景与目标,并按“问题—论证—结论—落地”主线生成;也可传入调研报告等资料。 原文链接
11. Suno发布v6音乐模型:联合华纳、BMG 共创,自然语言就能改歌、混音、采样
Suno CEO Mikey Shulman发布新一代音乐模型v6,联合华纳音乐、BMG、Believe等共同打磨,称为实现“让更多人享受创作音乐”愿景迄今最大一步。v6首次以模型套件形式推出,含三个定位不同的成员:旗舰v6面向Pro/Premier用户,强调可靠、精确,跨流派稳定输出精修成品;另含v6-wild等模型,构成更完整创作矩阵。 原文链接
12. 宇树人形机器人G1+发布:电机、视觉、交互与续航全面增强 标准版售价9.5万元
宇树科技发布人形机器人G1+,围绕运动、感知、智能三大维度升级6项:新增2自由度颈部,俯仰约-25°至36°、偏航±110°;优化电机输出与散热、视觉触觉、续航及远场语音。标准版含税售价9.5万元,EDU版未公布,延续高性价比定位。 原文链接
13. ElevenLabs发布Music v2.5音频模型,同步开放APP与API访问
ElevenLabs于3日发布生成式音乐模型ElevenMusic v2.5,通过移动应用和API向全球开放。新版提升音频饱满度与自然感;在47,885对样本盲测中,多数听众偏好v2.5,在R&B、灵魂乐、嘻哈、摇滚、管弦乐等曲风上表现更佳。 原文链接
14. DeepSeek-V4.1-Flash上线千问AI平台,API与Token Plan同步开放
DeepSeek-V4.1-Flash上线千问AI平台,开放API与Token Plan。开发者可经标准API接入,或在Qoder、千问APP、Codex等工具调用,用于代码、文档、视觉理解与智能体任务。该模型为轻量旗舰,552B MoE非对称架构,输入激活约8B、输出约16B,原生支持图文理解,上下文最长100万token。 原文链接
15. OpenAI 推出 Agents API:把 Codex 拆成云端服务,"造 Agent" 变成一次 API 调用
OpenAI发布四项更新,涵盖智能体、语音、数据与金融。其中Agents API最受关注,将Codex能力拆解为云端服务,以“能力即服务”降低智能体开发门槛,标志其从卖单一模型转向构筑开发者生态,是Codex布局的关键落地。 原文链接
16. 京东在 JDD 上甩出可交互视听世界模型:EchoWM 开源,长视频生成同步冲到 10 分钟以上
京东在JDD大会上发布JoyAI-Echo两项进展:音视频生成模型升级至1.5,持续生成超10分钟;开源可交互视听世界模型EchoWM,融合原生视听生成与用户控制,让AI内容从“能看”走向“能进、能探索”。长视频采用音视频Memory Bank架构,支持多镜头生成。 原文链接
17. 豆包手机助手消费者版发布:推出 GUI 协议,三方 App 可自主拒绝 AI 自动操作
豆包手机助手消费者版正式发布,相比预览版更强调稳定性、日常可用性与交互体验。支持语音、AI键等多种唤醒方式适配不同场景;专属AI键具备指纹鉴权,验证后无需二次解锁即可执行任务;语音唤醒针对远场、内噪及嘈杂环境进行优化。 原文链接
18. 月费10美元!开源AI编码工具 OpenCode Go 宣布实现收支平衡
OpenCode联合创始人Dax Raad宣布,月费10美元的OpenCode Go已连续两周实现收支平衡。在多数AI编码工具仍烧钱或靠卖数据变现的背景下,此举标志低价AI订阅模式商业可持续性获突破。该服务以宽松速率限制和稳定访问,为开发者提供高性价比开源AI编码。 原文链接
行业动态
19. Anthropic CEO 呼吁前沿 AI 限速,奥特曼与马斯克接连站台
Anthropic CEO达里奥·阿莫迪呼吁放缓前沿AI发展,提出以“可核验性”为核心的三步方案:企业引入驻场第三方评估、美国与盟友协同、全球协作。他认为AI递归式自我改进已出现,6至12个月后智能体或借僵尸网络控制互联网,因此须放慢能力提升,将时间投入可靠性、对齐、可解释性与测试评估。 原文链接
20. Anthropic 牵手 Rum Group 签下 137 亿美元算力大单,背后是特朗普关联的社交老玩家
Anthropic与Rum Group签下六年137亿美元算力采购协议。Rum Group起家社交媒体,与特朗普政府关系密切,使Anthropic算力供给再添政治背景合作方。这也是其近一年接连布局云计算大单的最新动作,合作方名单持续扩大。 原文链接