阿里预览 2.4 万亿参数 Qwen3.8 Max,称仅次于 Fable 5
阿里预览了 Qwen3.8-Max,一个 2.4 万亿参数的多模态模型,Qwen 团队称它比肩顶级系统、仅次于 Anthropic 的 Claude Fable 5。模型已在阿里的 Token Plan 订阅和 Qoder agent 平台上线,并承诺很快开放权重。这一说法在上海世界人工智能大会上抛出,把阿里同时摆到美国前沿实验室和国内对手 Moonshot Kimi K3 的对面。
阿里预览的 Qwen3.8 Max 有 2.4 万亿参数,自称仅次于 Fable 5;Moonshot 的 Kimi K3 在前端代码榜超过 Claude 和 GPT-5.6,但在 FrontierMath Tier 4 只拿 39%,而美国实验室接近 90%;OpenRouter 本周 token 用量前五名,全是中国的开源权重模型。硅谷整个周末都在争一件事:模型最聪明,还算不算护城河。北京在上海世界人工智能大会上顺势加码,习近平宣布成立世界人工智能合作组织,给全球南方国家 5000 个培训名额。算力这头一样紧:英伟达 GPU 开始配给,SK 集团会长说内存价格「异常之高」,AWS 一个计费 bug 一度告诉一名客户欠费 17 亿美元;民间在全美 42 个州办了 142 场反数据中心抗议,纽约州推进超大规模数据中心暂停令。钱照样在走:OpenEvidence 逼近 200 亿美元,Valar Atomics 拉着红杉冲 60 亿,OpenRouter 收到几十亿美元的收购意向。一条主线贯穿全天:能力变成大路货的速度,比它周围的芯片、电力和政治落定的速度更快。
阿里预览了 Qwen3.8-Max,一个 2.4 万亿参数的多模态模型,Qwen 团队称它比肩顶级系统、仅次于 Anthropic 的 Claude Fable 5。模型已在阿里的 Token Plan 订阅和 Qoder agent 平台上线,并承诺很快开放权重。这一说法在上海世界人工智能大会上抛出,把阿里同时摆到美国前沿实验室和国内对手 Moonshot Kimi K3 的对面。
Moonshot 的 Kimi K3 成为首个登顶 Code Arena 前端榜的中国模型,大幅领先 Claude Fable 5 和 GPT-5.6 Sol。但在高阶数学上,它在 FrontierMath Tier 4 只拿约 39%,而 OpenAI 和 Anthropic 的模型接近 90%。这种分裂让争论更激烈:中国实验室到底是追平了真活,还是只追平了便宜刷分的那部分。
在 OpenRouter 上,周 token 用量最高的五个模型全是中国开源权重系统——来自腾讯、小米、DeepSeek、MiniMax 和 Z.ai。由于大多数企业活儿并不需要最聪明的模型,投资人对 Axios 说,开源系统可能很快接掉约 95% 的查询,只把最难的 5% 留给美国的高价模型。一位 CTO 把用前沿 AI 干日常活比作「开法拉利去全食超市买菜」。
在上海世界人工智能大会上,习近平宣布成立世界人工智能合作组织,并向全球南方国家提供 5000 个 AI 培训名额,计划与东盟、非盟、金砖设合作中心。中国还推销出口项目,如覆盖 30 国的「妈祖」气象预警系统,以及常州的城市级「绿色 token 工厂」。这些动作勾勒出一套游离于西方影响之外的平行 AI 治理与基建秩序。
草根组织 Humans First 称在全美 42 个州组织了 142 场抗议,反对「无人担责」的数据中心扩建;与此同时纽约州州长推进全美首个超大规模数据中心暂停令——David Sacks 在 All-In 上公开反驳。审批门槛也在抬高成本:甲骨文把新墨西哥的 Project Jupiter 从燃气轮机改为更贵的燃料电池,多花几十亿;一名背景有争议的开发商则出价 100 亿美元,要建加州最大的数据中心。地方政治,而不只是物理定律,正成为 AI 基建的真实约束。
英伟达 GPU 短缺加剧,迫使云厂商配给算力,创业公司只能把工作负载挪到哪里有芯片就用哪里。连受益于 AWS 供给紧张的 Nebius,涨价后也已售罄。这场紧张为 Together、Runpod 等替代 AI 云打开窗口,去争夺下一代 AI 创业公司。
Kimi 模型的开发商 Moonshot 已告诉投资人,最快六个月内准备赴港上市。其年度经常性收入 6 月达到 3 亿美元,较 4 月的 2 亿大幅增长。此举让这家中国上升最快的 AI 实验室,在模型正引发全球关注之际接入公开资本市场。
阿里芯片部门平头哥开源软件,降低迁移到其「真武」AI 计算架构的门槛,包括为 SAIL 平台移植的 Triton 语言。此举跟随华为和摩尔线程的类似动作,中国 GPU 厂商试图打破英伟达 CUDA 的统治。在出口管制下,松动 CUDA 锁定是中国打造自给 AI 硬件栈的关键一环。
马斯克称 xAI 新的 2 万亿参数模型「各方面」都优于此前的 1.5 万亿版本,将于下周完成初步训练。他说它可能超过 Kimi,同时保持 Grok 4.5 的速度和 token 效率。这一进展让 xAI 在中国开源权重模型主导用量之际,仍留在前沿规模竞赛中。
SK 集团会长崔泰源称内存芯片价格「异常之高」,并警告若不增产,新进入者可能挑战在位者;他正考虑在美国建一座半导体厂扩大供给。这股紧张已传导到产品:据报英伟达 RTX 50 Super 显卡已就绪,却因 3GB GDDR7 模组价格高达 2GB 的三倍而卡住上市。内存和电力成本正悄悄侵蚀每一美元 AI 投入能买到的算力。
Greg Brockman 称 GPT-5.6 Sol 在网络安全上达到顶尖水平,在发现和修复新型漏洞上有显著成果,现已通过 OpenAI Daybreak 向防御方开放。这一说法把前沿实验室的招牌押在高价值、安全攸关的活儿上——那正是便宜开源模型仍难企及的部分。
蚂蚁、腾讯、阿里和百度借 WAIC 发布企业级 AI agent 产品,随着 agent 应用加速,国内争夺企业客户的竞争升温。华为云推出 AgentArts 平台和 openJiuwen 框架,面向生产级 agent 部署。另有中国厂商称,AI 手机真正的战场是 agent 操作系统的入口和服务分发,而非模型能力本身。
英国 AI 安全研究所发现,GLM-5.2、DeepSeek V4-Pro 等开源权重模型在网络能力上与闭源前沿模型的差距已缩到四到七个月,而 2025 年初还是六到十个月。研究还发现开源模型上的安全措施基本无效。随着危险能力以低成本扩散,防御方备战的时间越来越少。
硅谷正围绕 AI 重塑团队规模:Instagram 的 Adam Mosseri 说他把平均团队砍到约一半,变成四到六名通才工程师的「pod」,让贝索斯的「两张披萨」法则退场。在专业服务业,据《金融时报》,企业在重新设计招聘、培训和文化,而非简单裁掉初级岗位。但员工在反弹——凯撒医疗的护士说 AI 和监控正在同时拖累他们的工作和患者护理。
旧金山市检察官 David Chiu 向苹果和谷歌发出停止令,要求下架 AI「脱衣」和换脸应用——这些应用绝大多数被用来针对女性和女孩。官方估计两家公司从中赚取了数百万美元费用,并称两家早已知道这些应用违反州法。此举加剧了围绕生成式 AI 滥用工具的平台责任之争。
创业市场正倾向整合。为开发者对接数百个 AI 模型的 OpenRouter,已就一桩可能估值几十亿美元的出售进行洽谈。随着融资枯竭、公开市场软件估值下滑,今年有 160 多家企业软件创业公司面临被迫出售的压力,许多正围绕 AI 重塑自己。与此同时,英伟达收购 Groq 重燃对高价并购的希望,芯片创业公司抢着融资数十亿美元。
据英国《金融时报》,苹果向数十名如今就职于 OpenAI 的前员工发出法律信函,人才与商业机密之争升级。此举凸显在 AI 抢人大战加剧之际,在位巨头对技术诀窍的防守有多激进。该报道在 Hacker News 引发大量关注,被视为苹果在 AI 上防守姿态的信号。
投资人和研究者正聚拢到「世界模型」这一方向——一条让 AI 用远更少样本学会技能的路径,Y Combinator 专门用节目讨论 JEPA 和面向机器人、自动驾驶的样本高效强化学习。谷歌 DeepMind 添了一把火,称其 GenCeption 研究显示视频生成器已经包含计算机视觉一直缺的世界模型——用几乎全合成的数据在深度估计和分割上追平顶尖水平。这条线指向文本为主的大模型之外、扎根物理动态的模型。
帮助医生检索医学信息的 AI 聊天机器人 OpenEvidence,在收到约 200 亿美元估值的投资意向后,考虑融资约 2 亿美元。这家高速增长的公司是应用层价值在特定垂直领域沉淀的招牌案例。这一估值凸显了资本对嵌入高风险专业工作流的 AI 工具有多渴求。
The Information 梳理了特朗普政府如何从「不干预」的 AI 立场,转向导致美国限制顶级 AI 模型的干预主义。这一在第二任期早期开始的转向,重塑了前沿实验室和开源权重之争的政策背景。它标志着 AI 治理已成为美国产业和国家安全战略中一个主动的杠杆。
《华尔街日报》报道,CIA 特工 Jonny Gannon 监视阿联酋 AI 公司 G42 以查其与中国的关联,并通过打消华盛顿的疑虑,帮阿联酋扩大对美国 AI 芯片的准入。这一叙述揭示了在美国管控最先进硬件流向之际,间谍活动与芯片外交如何交织。它是 AI 算力地缘政治的一个鲜活案例。
AWS 一处计费故障生成了严重失真的预估费用,一名平时月账单不到 5 美元的客户,看到预估金额高达 17 亿美元。该帖以逾 2000 分登上 Hacker News 榜首,其他人也报告了类似的幽灵账单。这提醒人们:即便在超大规模层面,云成本工具仍然脆弱且不透明。
核能创业公司 Valar Atomics 拟以约 50 亿美元投前估值融资 10 亿美元,红杉资本正洽谈领投。这笔融资契合资本涌入下一代电力的浪潮——AI 的能源需求正撞上电网和审批的天花板。这表明投资人押注:表后供电和先进核能是算力扩建的核心。
科学家用 AlphaFold 和定向进化设计出一种新型酶,可降解细胞外基质中与衰老相关的分子 CML,All-In 播客对此有讨论。在对老年人皮肤样本的实验中,它清除了 55% 的 CML,把皮肤的生物年龄逆转到 31 岁。支持者称这一路径可能催生万亿美元的抗衰老产品市场——是 AI 设计蛋白走向真实应用的鲜活例子。
Index Ventures 联合创始人 Neil Rimer 预测,AI 创造的历史级财富终将被再分配,无论自愿与否。新钱已经显形:据《旧金山标准报》分析,OpenAI 和 Anthropic 员工向竞选捐款的力度和一致性,超过当年 IPO 后的谷歌人或 Meta 人;财富激增还把私人飞机市场推向高热。AI 收益的高度集中,正从一个财务故事变成政治和文化故事。
新研究不断落到同一个失效模式上:据《The Register》,有研究发现使用 AI 的人会变得更自信,即便准确率下降,也更不愿承认自己不知道的东西。RadLE 2.0 基准发现,读 X 光片的 AI 模型常带着十足自信给出错误诊断,仍落后于人类放射科医生。另有研究显示,当模型模仿作者文风时,主流 AI 文本检测器漏检高达 18% 的 AI 文本——科学写作更高达 48%。
据路透引用 Ortex 数据,随着 SpaceX 股价跌破 IPO 发行价,空头录得约 87 亿美元利润。这是对这桩备受追捧的上市罕见的看跌一击,也表明即便招牌名字也难逃 AI 时代的市场轮动。它给「稀缺性科技股只涨不跌」的假设降了温。
《华尔街日报》报道,基于内幕信息的政治押注正在华盛顿蔓延,白宫律师对匿名者在 Polymarket 上押注伊朗停火时机拉响警报。官员们正头疼:预测市场的赌注已多深地织入政府运作。随着链上博彩市场走向主流,这一报道引出关于信息泄露和利益冲突的新问题。
文化界对 AI 的反弹在加剧。《奥德赛》导演克里斯托弗·诺兰称 AI 明显是一匹「特洛伊木马」,调侃说「谁都知道希腊人就在里面」。作家戴夫·埃格斯受邀向约 200 名 OpenAI 员工演讲,却当面告诉他们 ChatGPT 对教育者的影响是「灾难性的」,并指责公司在「让整整一代人噤声」。这些高调批评凸显 AI 建造者与创作、教育世界之间日益扩大的裂痕。
纽约市可能要求房东和中介披露房源中对 AI 的使用,市长 Mamdani 表示他们不能偷偷用 AI 图片来推销房屋。该提案登上 Hacker News 榜首,针对可能向租客歪曲真实空间的 AI 生成图像。它是城市层面强制在商业中披露生成式 AI 内容的早期案例。