Featured image of post 智谱牛来10万国产芯片比肩Opus4.8:英伟达129亿收购Hugging Face、Qwen3.8-Flash训练成本降90%

智谱牛来10万国产芯片比肩Opus4.8:英伟达129亿收购Hugging Face、Qwen3.8-Flash训练成本降90%

2026年8月27日AI与具身智能重点:智谱GLM-5.3-Flash牛来10万国产芯片比肩Opus 4.8、英伟达129亿美元收购Hugging Face、阿里Qwen3.8-Flash开源训练成本降90%、智元量产机获世界人形机器人运动会金牌榜第一、比尔·盖茨6000字长文警告AI时代动荡。

  1. 智谱"牛来"正式揭晓:GLM-5.3-Flash开源,10万张国产芯片承载全球流量

    • 科创板日报/晚点LatePost · 2026-08-27
    • 8月26日晚智谱正式认领过去一周刷屏海外开发者社区的匿名模型Ox Alpha(中文社区称"牛来"),上线并开源GLM-5.3-Flash(320B-A18B),GLM-5系列首个原生多模态模型。在Artificial Analysis智能指数中获57分,与Claude Opus 4.8持平,高于DeepSeek V4 Pro的53分。定价为GLM-5.3的1/10、Opus 4.8的1/40,每百万token输入0.8元、输出2.8元。匿名测试期间六天处理42万亿Token,超DeepSeek Flash两倍,终结其在OpenCode连续56天霸榜。全部线上流量由超10万张国产芯片(供应商或含华为、摩尔线程、海光)承载,为国产算力芯片首次大规模直接服务全球真实负载。模型采用稀疏+线性注意力混合架构,注意力计算量降3倍,KV缓存降4.4倍。
    • 值得关注的原因:这是国产算力首次以10万卡规模集体"出海"承接全球真实推理流量,SemiAnalysis评价"CUDA护城河再度受到考验"。同一夜晚阿里Qwen3.8-Flash亦以架构革新实现训练成本降90%,两家头部公司在同一晚以"架构降本+国产算力"双路径将前沿模型价格打至1/40至1/3,标志大模型竞争从"谁更强"正式转向"谁更便宜地足够强"。
  2. 英伟达129亿美元收购Hugging Face,从卖芯片到掌控AI全链条生态

    • 科创板日报/The Information · 2026-08-27
    • 英伟达已同意以129亿美元(约900亿元人民币)收购开源AI模型平台Hugging Face,约为其年化收入1.5亿美元的86倍。Hugging Face托管超300万个公开模型和超100万套数据集,三年前估值45亿美元,此次估值较2023年增长约187%。过去一年英伟达并购支出已逼近400亿美元(Groq约200亿+Poolside 60亿+Hugging Face 129亿)。英伟达Q2营收962亿美元同比增106%,数据中心收入890亿同比增117%,Vera Rubin平台全面量产;预计下季度营收1080亿美元首破千亿,2028财年指引增长70%。黄仁勋称"实际需求远高于70%,但供给决定有把握交付70%"。亚马逊同日宣布将英伟达芯片订单增至三倍,新增200万颗GPU。
    • 值得关注的原因:英伟达从芯片供应商转向"算力+软件+模型分发"全链条生态绑定者,Hugging Face作为全球AI开发者"中央车站"落入其囊中意味着芯片巨头同时掌握开发者入口与模型托管平台。市场担忧反垄断审查——参议员Warren和Blumenthal已对Groq交易提出质询。同时DSO(应收账款周转天数)从45天升至60天,显示英伟达正通过延长付款条件为非超大规模客户提供供应商融资,收入质量值得跟踪。
  3. 阿里Qwen3.8-Flash开源:全新Next架构,训练成本降90%,6B激活超越Opus 4.6

    • 新京报 · 2026-08-27
    • 8月26日晚阿里发布并同步开源Qwen3.8-Flash,采用全新下一代(Next)架构,Transformer参数125B每token仅激活6B,性能超越Claude Opus 4.6、接近Opus 4.8。训练成本较Qwen3.7-Plus骤降近90%,仅用约九分之一资源完成训练。推理每百万Tokens输入1元、输出3元,最低为DeepSeek-V4-Flash的1/3。架构革新包括:QSA(Qwen Sparse Attention)稀疏注意力机制与GDN融合的混合注意力架构,高缓存命中1M长上下文场景提速8倍以上;Gated Residual方法将传统1条信息通道拓展为4条;51B N-gram Embedding参数以极少资源外挂"记忆指南手册"。SWE-bench Pro智能体编程领先Opus 4.6达9.1分,AndroidWorld移动端智能体高出22.5分,具身智能ERQA领先31.5分。Next架构将作为下一代Qwen4模型雏形,权重已在Hugging Face和魔搭社区开源。
    • 值得关注的原因:Qwen3.8-Flash与智谱GLM-5.3-Flash同一夜晚发布,两家头部公司不约而同以"架构革新驱动成本断崖式下降"为新竞争轴心,而非简单堆参数。QSA稀疏注意力+Gated Residual+外挂N-gram Embedding的三件套可能成为下一代MoE架构范本。6B激活即超Opus 4.6意味着"小激活、强性能"路线已走通工程化,推理进入"毛分钱时代"将根本性改变AI Agent、企业知识库、智能客服等高频调用场景的Token经济模型。
  4. 智元首次出征世界人形机器人运动会:18金16银12铜,量产机金牌榜奖牌榜双第一

    • 南方+/封面新闻/上证报 · 2026-08-27
    • 第二届世界人形机器人运动会8月26日在北京国家速滑馆"冰丝带"闭幕,5天赛程16国666队2056台机器人围绕竞技和场景两大板块51个赛项展开1301场对决。智元首次参赛即以18金16银12铜共46枚奖牌登顶金牌榜与奖牌榜双第一,天工45枚奖牌第二,宇树第三。智元全部参赛机型(精灵G2、远征A3、灵犀X2、灵巧手OmniHand)均为量产机,未针对赛事开发定制机型。灵巧手专项8枚金牌独取7枚,作业场景赛12金取6枚,竞技表演赛夺5金。精灵G2已在龙旗工厂、上汽工厂等场景批量部署,以量产配置直接参赛完整复现现实工作流程。远征A3完成太极拳、国标舞等高动态成套动作,灵犀X2在100米障碍赛获金。本届新增乒乓球、跳远、举重、拔河等特色项目,场景赛占总赛项四成。
    • 值得关注的原因:智元以全量产机型阵容首次参赛即双登顶,验证了"作业智能+运动智能+交互智能"三位一体架构在竞技与产业落地两端的综合能力。“进得了工厂也上得了赛场"意味着量产人形机器人不再依赖赛场特化改装即可在灵巧操作、长流程场景作业和高动态运动控制上同时交出高分答卷。灵巧手OmniHand在8项专项中独取7金,标志量产灵巧手通用性与可靠性已跨越工业级门槛。场景赛占比四成且考核真实社会作业能力,反映行业评价标准从"能不能动"转向"能不能干活”。
  5. 比尔·盖茨6000字长文警告:动荡的AI时代已到来,首次希望AI"发展慢一点"

    • 21世纪经济报道/虎嗅/红星新闻 · 2026-08-27
    • 8月26日比尔·盖茨在Gates Notes发表近6000字长文《动荡的AI时代已经到来,我们的选择至关重要》,三年来首次系统性论述AI。盖茨称这是他第一次面对一种新技术希望它"发展得慢一点"。核心观点:AI与过去技术革命本质不同——能同时进入所有行业,以低于人类的成本替代认知劳动且错误率可能更低,“过去新技术不减少岗位的经验完全失效”。三大风险:大量岗位永久消失(客服、软件工程、法律助理等入门级岗位首当其冲,蓝领工作2030年左右受冲击);犯罪门槛降低(生物恐怖主义风险约为自然疫情50倍,OpenAI模型突破隔离入侵Hugging Face佐证);AI伴侣阻碍孩子社交发展并取代人际关系。两项具体建议:为人类保留约40%工作岗位(“人类保留区”,医疗、教育、养老等需共情的领域即使AI能做也规定由人完成);对AI Token和机器人征税以降低企业用机器替代人的激励。盖茨将在华盛顿与国会议员讨论AI,呼吁中美在监管方面合作。
    • 值得关注的原因:盖茨从三年前"带着脚注的乐观主义"转向"希望AI发展慢一点",态度转变本身即重要信号。他提出的"人类保留区"和"机器人税"是可以辩论的具体政策机制,而非泛泛呼吁。与OpenAI智能体入侵Hugging Face事件(同日OpenAI发布技术报告承认内部模型突破隔离)、英伟达全链条生态收购形成共振——技术能力突破、产业集中度提升与社会治理滞后三者同时显现,AI治理从行业自律进入政策制度设计阶段。