Aniimo 首发登陆 GeForce NOW,007 First Light 新增路径追踪
Pawprint Studio 的 Aniimo 本周随发售同步登陆 GeForce NOW,这是一款免费开放世界捉宠 RPG,玩家可用 Aniipods 捕捉 Aniimo 并 Twine 变身,无需等待 45GB 下载即可在 Steam Deck 和新支持的 Firefox 浏览器上串流。
Pawprint Studio 的 Aniimo 本周随发售同步登陆 GeForce NOW,这是一款免费开放世界捉宠 RPG,玩家可用 Aniipods 捕捉 Aniimo 并 Twine 变身,无需等待 45GB 下载即可在 Steam Deck 和新支持的 Firefox 浏览器上串流。
Cooley 基于 ChatGPT Work 构建了 GO Public,为 IPO 流程引入智能化支持。该工具旨在帮助律师更早发现潜在问题,从而将专业判断集中在最关键的业务环节。
GitHub 团队利用 Copilot App 与 Copilot CLI,将原本基于 Node.js/TypeScript 的 Copilot Agent 运行时完全重写为超过 80 万行生产级 Rust 代码。
推荐理由:文章详细记录了用多智能体并发协作重写大型生产项目的架构拆分与控制策略,展示了高阶开发者的监督方法。
OpenAI 推出面向法律领域的 Astra for Law,将前沿智能引入法律业务。该方案支持定制律所工作流并连接法律数据源,同时为处理客户机密工作提供法律级安全控制能力。
OpenAI 公布了一套用于追踪、调查和披露模型失准的框架。该框架同步公开了六份关于模型出现意外或令人担忧行为的具体报告。
OpenAI 与 AARP 合作,将在美国 10 座城市为 1,000 名老年人提供免费的 ChatGPT 实操工作坊。该项目旨在帮助老年群体安全掌握实用的 AI 技能,将人工智能技术融入日常生活。
NVIDIA 公布 MLPerf Inference v6.1 评测结果,其 Vera Rubin NVL72 系统在 Qwen3-VL 上的吞吐量达到 GB300 NVL72 的 3.7 倍,在 DeepSeek-R1 上达到 2.5 倍。
Emerald AI、Google 与 NVIDIA 宣布联合成立 AI 能源管理联盟(AEMA),旨在推进可根据电网状况动态调节用电的灵活 AI 数据中心。该联盟通过转移计算负载、储能放电及配套发电等方式使数据中心转变为可控资源,从而更高效地利用电网容量并缩短并网周期。AEMA 坚持技术中立原则,重点制定性能指标、应急响应规则与数据共享标准。
OpenAI 推出由 AI 驱动的新型广告体验,包含赞助型智能体(Sponsored Agents)与面向营销人员的工具。同时,该体验还提供了与 HubSpot 和 Shopify 的平台集成。
Hex 借助 GPT-6 Astra 赋能其数据智能体,将分析解答转化为交互式可视化报告,便于员工进行成果展示与分享。
ChatGPT Work 与 Codex 分析功能可帮助团队全面掌握 AI 的使用情况与支出成本。该功能还能协助识别团队的培训需求,进而将技术采用与实际业务成果直接挂钩。
Mozilla 宣布与 Mistral 达成合作,由 Mistral 模型为 AI 浏览助手 Firefox Smart Window 测试版提供支持。该功能首批面向法国和北美用户开放,可协助用户解析复杂搜索并基于标签页提取信息。服务强调隐私保护,对话默认不保存于 Mozilla 服务器,且 Mistral 遵循零数据留存协议。
推荐理由:原文展示了开源模型与浏览器端结合的落地形式,读者可以参考其在本地化支持与零数据留存上的集成方案。
OpenAI 最新发布的经济研究展示了员工如何超越传统岗位角色使用 AI。该研究探讨了哪些全新的工作活动正在融入日常业务,成为员工工作中反复出现的常态化组成部分。
曼彻斯特大学研究团队利用 NVIDIA Earth-2 旗下的 CorrDiff 与 StormCast 生成式框架,成功构建了覆盖全英国的空气污染预测模型。该模型在英国 Isambard-AI 超算的单个 8-GPU 节点上仅用 2 天完成训练,分辨率达 2-3 平方公里,并可在桌面级 DGX Spark 系统上运行推理与训练。团队后续计划开源相关训练数据与工作流。
黄仁勋在 Salesforce Dreamforce 大会发表演讲,Salesforce 同期宣布基于 NVIDIA Nemotron 3 Super 构建其首个 CRM 推理模型 Koa。黄仁勋指出 AI 安全本质上是工程问题,企业未来都将转向智能体架构。Koa 完全由 Salesforce 在自有基础设施上采用合成数据训练,计划于 10 月展开客户试点并在 2026 年冬季正式上线。
Google Research 提出 Retrieve-for-Train 框架,通过离线强化学习发现符合奖励的 fan-out 查询并编译为监督信号,再蒸馏进一个 53.9M 参数的扩散检索器,在推理时以单次非自回归前向直接生成完整结果集,无需 CoT 推理 token。
Google DeepMind 正式推出 Gemini 3.8 Live 与 Gemini 3.8 Live Extended Thinking 实时对话模型,主打近实时推理与语音智能体任务执行能力。
推荐理由:官方展示了实时多步推理与边思考边交谈的交互机制,为语音智能体的落地架构提供了参考范式。
NVIDIA 披露了针对 AI 工厂的 DSX 架构套件实测数据,通过动态电力分配与电网协同调度最大化算力产出。云服务商 Lambda 在 HGX B200 集群上验证 DSX MaxLPS,在相同电力预算下将集群 Token 吞吐量提升 24%,每瓦性能提高 23%。同时结合电网响应系统,可在外部电力紧张时自动降低功耗并保持高优先级推理作业稳定运行。
NVIDIA 在 AI Infra Summit 公布 Vera Rubin 与 DSX 平台的系列进展,覆盖 Vera Rubin NVL72 系统、Dynamo 推理软件、NVLink 6、DSX MaxLPS 与 DSX Flex。
推荐理由:文中给出多组厂商实测数字与软硬件协同路径,可据此判断 AI 工厂按每兆瓦 token 计价的工程方向。
IBM Research 在 Hugging Face 博客介绍 ALTK-Evolve 新增的 consistency guidelines 与 Consistency Analyzer,用于衡量并改善智能体在重复运行下的不稳定问题。
推荐理由:原文提出 Pass^k 与一致性差距的度量,并给出把差距减半的检测与修复方法,可用于判断智能体上线后的可靠性。
费城儿童医院基于 MONAI 和 NVIDIA Warp 物理引擎 Newton 构建心脏建模与仿真系统,将患儿心脏 3D 建模及器械植入模拟时间从数小时压缩至数秒或近实时。该方案结合 CT、MRI 与超声图像进行快速分割和生物力学模拟,已在全美 20 多家儿童医院推广,协助医生在术前评估人造瓣膜与封堵器适配度并制定个体化手术方案。
Fyxer 结合 OpenAI 模型、微调技术、记忆功能与真实用户反馈,打造受人信赖的 AI 高管助理。该系统能够协助整理收件箱,并以每位用户的个性化口吻起草电子邮件。
Perplexity 已在端到端系统中采用 GPT-6 Astra,用于撰写沟通内容、修改软件以及监控生产系统。与早期模型相比,团队对其运行的人工检查介入频率显著降低。
GitHub 市场团队通过 GitHub Copilot、GitHub Actions 和 Issue 构建了自动化流程,将活动运营从前期策划、报名筛选到会后 CRM 录入实现全流程代码化。
GPT-6 Astra 提升了 Devin 测试软件并验证其正常运行的能力。该改进旨在帮助工程师减少代码审查工作量,从而更快交付更多代码。
OpenAI 分享了其在线存储系统 Habitat 的架构演进历程。该系统已从最初的 Python 库发展为全球分布式存储平台,目前支撑超过 10 亿 ChatGPT 用户,并处理每秒 2200 万次(22M requests per second)的请求量。
Google Research 提出工具使用数据集生成框架 ToolGrad,采用“先答案后问题”范式并借助文本梯度反馈,能以更低成本高效构建复杂的真实 API 工作流。
GitHub Copilot app 集成了 Diff、终端和浏览器三个内置面板,允许开发者在单一界面内完成智能体生成代码的审查、运行与预览。Diff 面板用于高亮对比增删行,终端面板支持直接执行项目运行脚本与多窗口切换,浏览器面板则提供 Pick & Polish 工具以便选中 UI 元素让智能体继续调整并直接创建 PR。
César de la Fuente 实验室利用 Codex 与 ChatGPT 检索现存及已灭绝物种的基因组。该研究团队借助这两项工具寻找潜在的抗菌候选分子,以应对耐药性感染问题。
OpenAI 宣布在 ChatGPT Work 中推出 Data agent。该智能体支持用户使用自然语言连接企业数据、挖掘业务洞察,并借助 AI 构建交互式仪表盘。
推荐理由:官方简短介绍了该智能体连接企业数据与构建交互仪表盘的场景,读者可据此了解其工作流支持方向。
Mistral 与 Cloudera 宣布达成合作,将 Mistral 模型集成至 Cloudera 混合数据平台,为金融、制造等行业企业提供主权 AI 能力。企业可在公有云、私有云、本地及完全物理隔离环境中部署并运行推理,同时支持结合 Cloudera 平台上 30 exabytes 的客户数据训练定制模型,完全保留数据与模型智能的所有权。
OpenAI 与美国总务管理局(GSA)合作,向符合条件的联邦、州、地方及部落政府提供 0 美元许可费和 50% 的使用费折扣。同时,合作还将为这些公共部门提供扩展的网络防御支持。
OpenAI 推出面向金融服务的 ChatGPT(ChatGPT for Financial Services),结合内置金融数据与 GPT-6 Astra 模型。该产品旨在支持金融研究、财务建模以及直接交付客户的材料制作。
推荐理由:该版本将内置金融数据与前沿模型整合,直接支持调研、建模和材料生成,便于金融从业者评估定制化工具对专业流程的支持能力。
OpenAI 推出 Agents API,这是一项用于构建和启动云端智能体的托管服务。该服务由 Codex harness 提供支持,具备任务编排、长时运行会话以及工具调用能力。
推荐理由:该接口将智能体编排、长时会话和工具调用封装为托管服务,便于开发者降低云端智能体的构建与维护成本。
Hugging Face 演示了基于 Gradio Workflow 搭建的 Workflow1111 项目,通过 73 个节点和 11 条流水线重构了 AUTOMATIC1111 的主要功能。
推荐理由:原文详细拆解了用节点图组合多模态模型与本地函数的架构,读者可据此参考如何将复杂应用封装为标准接口与智能体工具。
Hugging Face 介绍了在 HF Jobs 上结合 TRL 与 vLLM 运行异步 GRPO 训练的架构实践。
推荐理由:方案给出了无需跨节点NCCL进行强化学习训练的轻量架构,读者可以参考其对象存储同步与KV缓存前缀路由的工程实现。
OpenAI 在 API 中推出 GPT-Live-1,支持自然的全双工语音对话。该模型具备更强的指令遵循能力,并支持自定义声音以及电话协议集成。
推荐理由:该模型在 API 中支持全双工语音交互与电话集成,为开发者构建实时语音应用提供了新的官方原生接口。
Paul Christiano 正式加入 OpenAI 基金会董事会及其安全与安保委员会。他将为该委员会带来在 AI 对齐、安全及行业标准领域的专业经验。
Chris Lehane 提出,更强大的 AI 能力需要更充分的安全证据、共享标准以及持久的政策行动。他呼吁各方抓住当前依然开启的政策窗口期,尽快落实相关治理举措。
Mistral 协助欧洲能源运营商将 40,000 行 Fortran 77 遗留科学计算代码迁移为 C++,并系统总结了 AI 智能体在遗留代码现代化中的实践方案。
推荐理由:原文总结了科学计算遗留系统迁移的工程实践,展示了数值一致性验证和人机协同智能体工作流在代码重构中的落地方法。