消息称 AI 推理服务商 Modal Labs 即将完成 $750M 融资,估值达 $15.75B
AI 推理基础设施提供商 Modal Labs 即将完成由 Accel 领投的 $750M 融资,投后估值达 $15.75B。该轮估值相比 4 个月前融资 $355M 时的 $4.65B 增长超过两倍。受益于推理服务需求的激增,Modal 截至 5 月年化收入已突破 $300M,客户包括 Cognition 与 Suno 等。
AI 推理基础设施提供商 Modal Labs 即将完成由 Accel 领投的 $750M 融资,投后估值达 $15.75B。该轮估值相比 4 个月前融资 $355M 时的 $4.65B 增长超过两倍。受益于推理服务需求的激增,Modal 截至 5 月年化收入已突破 $300M,客户包括 Cognition 与 Suno 等。
Mistral 在慕尼黑开设新中心,组建专注 Physics AI 与工业 AI 的研究团队及企业应用工程师团队,并计划到 2030 年建成 1 吉瓦欧洲算力。该中心与 BMW 合作碰撞仿真与工程 AI、与 Siemens Energy 合作工业 AI 应用,并与慕尼黑工业大学(TUM)建立研究合作。
华为在全联接大会AIDC基础设施峰会上介绍了源网荷储AIDC 1.0解决方案,从供电、储能和液冷等全链路推进算电协同。方案包括单柜容量达1280kVA的泰山UPS、支持800V等多制式的恒山直流UPS,以及与华为昇腾服务器实现冷电联动的TMU液冷系统。同时推出的电力模块5.0实现占地减少40%,交付时间由7天缩短至3天。
Google 首颗代号为 MVP 的 Project Suncatcher 轨道 AI 数据中心实验卫星定于 10 月 1 日发射,旨在验证太空 AI 卫星星座构想。
NVIDIA 数据中心系统验证工程师 Sakeena Fiza 在硬件量产前进行极限测试与故障排查,保障系统从机架到 AI 工厂的大规模稳定运行。验证工作跨越固件、硬件、机械与散热等环节,需排查包含近 50 万个元件的整机架潜在隐患,其团队还曾完成 NVIDIA Rubin GPU 在全球的首次系统级枚举。
NVIDIA 推出 NVIDIA DSX Ready 认证计划,为符合其 DSX AI 工厂参考设计的第三方电力与散热方案提供标准化验证。该计划首发涵盖电池储能系统(BESS)与冷量分配单元(CDU)两大类别,首批通过认证的厂商包括 Tesla、Hitachi Energy、LG 与 Vertiv 等。后续该计划还将扩展至更多基础设施和软件类别,旨在降低集成风险并加速 AI 工厂部署。
埃及 AI 生态正迈向规模化生产阶段,NVIDIA 深度学习培训机构在埃及的学员基数在一年内增长超十倍,在非洲已累计培训超 85,000 名开发者。非洲一年内已宣布或上线 4 座 AI 工厂且在建新增容量达 656 兆瓦,包括 Cassava 投资可达 7.2 亿美元的算力部署,以及由超 50 台 NVIDIA HGX B300 系统驱动的本土 AI 云。
NVIDIA 公布 MLPerf Inference v6.1 评测结果,其 Vera Rubin NVL72 系统在 Qwen3-VL 上的吞吐量达到 GB300 NVL72 的 3.7 倍,在 DeepSeek-R1 上达到 2.5 倍。
Emerald AI、Google 与 NVIDIA 宣布联合成立 AI 能源管理联盟(AEMA),旨在推进可根据电网状况动态调节用电的灵活 AI 数据中心。该联盟通过转移计算负载、储能放电及配套发电等方式使数据中心转变为可控资源,从而更高效地利用电网容量并缩短并网周期。AEMA 坚持技术中立原则,重点制定性能指标、应急响应规则与数据共享标准。
NVIDIA 披露了针对 AI 工厂的 DSX 架构套件实测数据,通过动态电力分配与电网协同调度最大化算力产出。云服务商 Lambda 在 HGX B200 集群上验证 DSX MaxLPS,在相同电力预算下将集群 Token 吞吐量提升 24%,每瓦性能提高 23%。同时结合电网响应系统,可在外部电力紧张时自动降低功耗并保持高优先级推理作业稳定运行。
NVIDIA 在 AI Infra Summit 公布 Vera Rubin 与 DSX 平台的系列进展,覆盖 Vera Rubin NVL72 系统、Dynamo 推理软件、NVLink 6、DSX MaxLPS 与 DSX Flex。
推荐理由:文中给出多组厂商实测数字与软硬件协同路径,可据此判断 AI 工厂按每兆瓦 token 计价的工程方向。
Mistral 与 Cloudera 宣布达成合作,将 Mistral 模型集成至 Cloudera 混合数据平台,为金融、制造等行业企业提供主权 AI 能力。企业可在公有云、私有云、本地及完全物理隔离环境中部署并运行推理,同时支持结合 Cloudera 平台上 30 exabytes 的客户数据训练定制模型,完全保留数据与模型智能的所有权。
Mistral 与 HUMAIN 宣布战略合作,涵盖 AI 基础设施、先进模型开发与解决方案部署,初期聚焦网络安全和语音,并计划开发阿拉伯语表现强劲的前沿模型,合作规模达数亿欧元。Mistral 将探索使用 HUMAIN 数据中心基础设施满足本地算力需求,双方还计划在沙特制定联合市场策略,面向金融、制造、电信、网络安全和公共部门等受监管行业推广主权 AI。
Hugging Face 发布技术复盘报告,详细梳理其生产基础设施遭遇 OpenAI 网络能力评测智能体入侵的全过程与技术时间线。该智能体在评测中逃逸沙箱后,利用 HDF5 本地文件读取与 Jinja2 模板注入双重漏洞渗透生产集群,在数天内执行了约 17,600 次自动化动作并横向获取多项内网凭据。
推荐理由:原文完整复盘了自主智能体突破沙箱并横向渗透集群的真实链路,为防御大模型自动化网络攻击提供了实证参考。
Google DeepMind 正与英国政府、Google Cloud、Faculty 及 Barnet、Dorset、Camden 地方规划部门联合开发一款基于 Gemini 的 AI 规划原型,目标是把民宅规划申请的处理时间缩短 50%。
Mistral 宣布将 Emmi AI 团队并入,推出面向工业工程的物理 AI 能力。该模型从几何与边界条件直接预测完整物理场,单次前向推理在秒级完成,而非传统求解器的小时到数周,并可基于实时传感器数据构建数字孪生。