Featured image of post DeepSeek接近完成至少800亿元融资 Hinton联合Bengio等22位学者发布首篇RSI论文

DeepSeek接近完成至少800亿元融资 Hinton联合Bengio等22位学者发布首篇RSI论文

据彭博社报道,DeepSeek接近完成至少800亿元人民币新一轮融资,腾讯与宁德时代为最大出资方,最终规模或逼近1000亿元,为2027年初IPO铺路;Mistral发布Mistral Large 4,Artificial Analysis评测称其为美中之外最智能模型,10月底开放1T参数权重,上线Arena的WebDev评测也已出炉;Hinton联合Bengio、Andrew Barto等22位学者发布其首篇RSI论文,警告AI研发自动化一旦闭环,今天一年的AI进步未来可能压缩到约5周;100台智元灵犀X2进驻爱仕达百家门店,3天带动销售额约223万元、门店业绩平均提升39%,具身智能首次规模化落地实体零售;GitHub宣布在不停机状态下重建Git基础设施以应对智能体规模开发,9月平台commits达73.8亿、超一年前五倍。

1. DeepSeek 接近完成至少 800 亿元融资:腾讯与宁德时代为最大出资方,为 2027 年初 IPO 铺路

据彭博社 10 月 6 日援引知情人士报道,DeepSeek 接近敲定至少 800 亿元人民币(约 120 亿美元)的新一轮融资,大幅超出此前约 500 亿元的目标,最终总额可能逼近 1000 亿元,对应估值约 5000 亿元人民币。腾讯控股与宁德时代承诺的出资金额位居本轮最高一批:腾讯在上一轮融资中已出资 100 亿元,希望将 AI 能力整合进旗下产品平台;宁德时代则看好数据中心算力零部件赛道。本轮需求激增与最新模型发布后市场反响直接相关——DeepSeek 年化收入已达 10 亿美元量级,V4.1-Flash 以低成本对标海外头部模型(ARC Prize 最新公布其 ARC-AGI-2 得分 72.9%、每任务成本仅 0.13 美元),公司还在内蒙古建设部署至少 16 万枚华为昇腾芯片的大型数据中心,并与华为联合开发面向昇腾优化的编程工具。融资完成后,DeepSeek 将启动业务重组,已聘请中信证券筹备上交所科创板 IPO,计划 2027 年初挂牌。中国头部模型公司融资规模与上市节奏同步提速,国产大模型的资本叙事正从"融资难"切换为"认购超额"。

来源:AIHOT(彭博社)、智东西、腾讯新闻·芯智讯、ARC Prize

2. Mistral 发布 Mistral Large 4:Artificial Analysis 评测称其为美中之外最智能模型,10 月底开放 1T 参数权重

法国 Mistral 于 10 月 6 日发布迄今最强模型 Mistral Large 4(Research Public Preview,内部代号 Le Chonk):混合专家架构,总参数 1T、每次前向仅激活约 49B,原生多模态,512K 上下文(最高 256K 输出),支持超 160 种语言。Artificial Analysis Intelligence Index 给出 38 分,与 GPT-6 Luna(max)相当,为美国与中国之外最智能的模型;AA Cyber Index 得分 82% 名列前五,编码基准上则落后于前沿闭源模型但仍领先 Qwen3.8 Max、DeepSeek V4 Pro 等开源对手。模型已在 OpenRouter 公测,前两周输入/输出每百万 Token 定价 0.68/2.09 美元,官方计划 10 月底开放权重,训练动用 3800 颗 Grace Blackwell 芯片、每日产生 330 亿 Token 的 rollout 数据并保持训练不中断迭代。后续评测也在快速跟进:Arena 宣布其登陆 Code Arena: WebDev 以 1534 分排名第 45,较 Mistral Large 3(第 130 名)高出 304 分,并已开放 Agent Arena 供用户盲测投票。欧洲重新站上前沿模型牌桌,且以"开放权重"路线入场,对开源生态与定价格局的冲击值得关注。

来源:AIHOT(Artificial Analysis)、SiliconANGLE、Arena、AIHOT(OpenRouter)

3. “AI 教父"Hinton 发布首篇 RSI 论文:22 位学者联名警告,今天一年的 AI 进步未来可能只需约 5 周

诺贝尔物理学奖、图灵奖得主 Geoffrey Hinton 于 10 月 3 日在 X 上宣布,联合 Yoshua Bengio、强化学习先驱 Andrew Barto、OpenAI 首席科学家 Jakub Pachocki、微软首席科学官 Eric Horvitz、Anthropic 联合创始人 Jack Clark、UC Berkeley Dawn Song 等 22 位作者发布论文《What if automating AI R&D triggers an intelligence explosion?》——这是 Hinton 在递归自我改进(RSI)领域发表的首篇学术成果,也是迄今对"智能爆炸"命题最系统的正式研究。论文引用头部实验室内部数据佐证趋势:Anthropic 内 AI 生成的获批代码占比从 2025 年 1 月的低个位数升至 2026 年 5 月的超 80%,Claude 在高层人类监督下可自主完成的研发工作比例从 2026 年 3 月约 1% 升至同年 8 月的 26%;OpenAI 内部 AI 系统已能经常完成人类员工需数天完成的研发任务。模型测算:若 AI 研发实现全面自动化且研究回报维持历史区间(r 中心估计 1.2–1.9),AI 进步速度可能在大约 1.5 年内提高 10 倍——今天需要一年的进步,极端情况下未来只需约 5 周,且现有算力理论上可支撑数百万名"顶级人类研究员等价"的 AI 研发劳动力。论文同时列出了四道现实之墙(算力、数据、实验时间、科研边际收益递减),基调是现有证据尚不足以证明智能爆炸已发生,但呼吁各国政策制定者在"窗口期关闭之前"建立监管框架。当"AI 造 AI"从科幻命题变成头部实验室的内部数据,这是本周最值得重量级对待的一篇研究。

来源:华尔街见闻、量子位、新浪科技、Hinton 于 X 的发文

4. 智元灵犀 X2 百台进驻爱仕达百家门店:3 天带动销售额约 223 万元,具身智能首次规模化落地实体零售

9 月 28 日起,100 台智元灵犀 X2 半尺寸人形机器人(身高约 1.3 米)进驻全国 100 家爱仕达线下门店担任导购促销员,每日在岗 10 小时;3 天试营业累计带动销售额约 223 万元,百家门店业绩平均提升 39%,国庆假期持续在岗,10 月 7 日财联社、南方+等仍在跟进报道。与此前文旅展演、快闪式展示不同,零售门店是高频、强业务目标的真实商业环境:机器人依托 AGILE 生成式通用小脑引擎在人流扰动下稳定行走,靠硅光动语 WITA 全模态交互大模型完成免唤醒多轮对话,30 秒内结合就餐人数、烹饪习惯与预算完成锅具选型讲解,遇到优惠、库存等复杂问题则无缝转接真人导购,形成"机器人做广度引流、人做深度成交"的人机协同分工。这是国内人形机器人首次大规模进入高频实体零售场景跑通"迎宾—理解—讲解—推荐—转接—辅助"完整链路,门店交互数据将反哺零售垂类模型打磨——具身智能正从"演示态"走向可复制的商业"部署态”。

来源:财联社、南方+、上观新闻·新浪财经、星岛头条

5. GitHub 在不停机状态下重建 Git 基础设施:9 月智能体与开发者产生 73.8 亿次 commit,为一年前的五倍以上

GitHub 官方博客宣布正在重建其 Git 基础设施,以支撑"智能体规模开发"(agent-scale development),且整个过程不停机、不设维护窗口、无需开发者改变工作流。数据相当震撼:2026 年 8 月 GitHub 月度 Git 事件量达 4733 亿,是一年前(2182 亿)的两倍以上;仅 9 月,开发者和智能体就产生了 73.8 亿次 commit,超一年前的五倍;push 量同比增长 4.9 倍至每月 33.5 亿次,PR 合并量接近四倍,GitHub Actions 当月运行 32.6 亿次(超四倍),最繁忙的单个仓库 8 月接收约 10 亿次请求。智能体工作负载与人类截然不同:agent 在紧循环中几乎每个动作都要 commit/checkpoint,单次 push 延迟直接成为个体产出瓶颈;数千个 agent 在同一仓库各自分支上持续写入,最终汇聚到同一个引用;每次 push 还会扇出数千次读取(CI 与代码扫描每分钟克隆同一分支 tip 数千次)。现有 Spokes 架构(每仓库默认 5 份全量磁盘副本 + 三阶段提交 quorum)的痛点在于"持久化与扩展共用同一机制",push 速度取决于最慢副本。新架构将权威数据迁往 Azure Blob Storage 实现持久化,读能力由轻量计算节点独立弹性扩展,压缩与 GC 移出服务路径,内部基准显示写吞吐最高提升 35 倍。AI 智能体已经在倒逼全球最大代码托管平台重写存储层——这是"智能体规模开发"从概念变成基础设施现实的最直接证据。

来源:AIHOT、GitHub 官方博客、LavX News