强化新加坡 AI 未来:Google DeepMind 达成全新国家级合作伙伴关系
Google DeepMind 与新加坡政府达成国家级 AI 合作,围绕医疗、科研与教育等领域启动多项前沿 AI 落地计划。合作包括研发基于 Gemma 的视障跑步助手、向当地中小学及初级学院教师提供 Gemini for Education、利用 AlphaFold 开展流行病研究,并联合 IMDA 等机构研发多模态多语言安全基准。
Google DeepMind 与新加坡政府达成国家级 AI 合作,围绕医疗、科研与教育等领域启动多项前沿 AI 落地计划。合作包括研发基于 Gemma 的视障跑步助手、向当地中小学及初级学院教师提供 Gemini for Education、利用 AlphaFold 开展流行病研究,并联合 IMDA 等机构研发多模态多语言安全基准。
剑桥大学教授 Clare Bryant 正在使用 Co-Scientist 寻找新发传染病跨物种传播引发重症的分子开关与预防方案。该工具通过分析研究提案与未公开实验数据生成并排序假说,直接锁定了此前未被关注的关键蛋白质及特定氨基酸。团队正构建突变细胞系进行测试,原本需要 2 至 3 年的靶点确定工作有望缩短至 6 个月内完成。
Calico Life Sciences 的 Matt Onsum 与 Katherine Labbé 正使用 Google DeepMind 的 Co-Scientist 梳理衰老生物学中零散的发现并生成可验证的假设。
Google DeepMind 展示了爱丁堡大学团队利用 Co-Scientist 加速代谢功能障碍相关脂肪性肝炎(MASH)机制研究的成果。面对多靶点组合疗法搜索空间过大的问题,Co-Scientist 梳理肝脏生物学与药理学文献并生成假说,指出 NLRP3 炎症小体是连接炎症与代谢的关键分子桥梁。
MIT 的 Ritu Raman 与波士顿儿童医院的 Ryan Flynn 借助 Google DeepMind 的 Co-Scientist,将各自的组织模型与 RNA 表面图谱工具结合,用于 ALS 研究。
Google DeepMind 正式推出 Gemini 3.5 模型系列并上线首发版本 Gemini 3.5 Flash,主打长流程编码与复杂智能体任务执行。该模型在 MCP Atlas 达 83.6%、Terminal-Bench 2.1 达 76.2%,输出 token 速率达到其他前沿模型的 4 倍,系列旗舰 3.5 Pro 计划于下月推出。
推荐理由:模型在兼顾生成速率的同时强化了编码与多步智能体执行能力,可作为评估长流程任务端到端自动化成本的重要参考。
Google 推出一种结合三维场景理解与生成式 AI 的照片重构技术,并已在 Google Photos 的 Auto frame 功能中正式上线。该方案将图像处理解耦为 3D 场景与相机参数估计、潜在扩散模型修补两个阶段,能够在拍照后自动调整虚拟相机机位与焦距,并修复人像广角畸变。用户在编辑包含人物的照片时,可直接在构图候选项中选择重构视角的一键优化效果。
推荐理由:该方案将单张照片解耦为三维场景估计与扩散模型修补两阶段,展示了借助空间感知调整成像视角并消除畸变的新思路。
Google DeepMind 推出新型分布式训练架构 Decoupled DiLoCo,通过将训练任务划分为解耦的计算岛并结合异步数据流,实现跨远距离数据中心的低带宽与高容错模型训练。
Google DeepMind 宣布与 Accenture、Bain & Company、BCG、Deloitte 和 McKinsey 达成合作,加速推动全球企业的智能体转型与前沿 AI 规模化落地。合作伙伴将获得 Gemini 等前沿模型的早期访问权,并与 DeepMind 技术团队合作开发金融、制造等行业解决方案。该合作旨在弥合目前仅 25% 组织实现 AI 规模化投产的应用鸿沟。
Google DeepMind 正式推出文本转语音模型 Gemini 3.1 Flash TTS,支持通过自然语言音频标签精确控制语音风格、节奏和表达,并原生支持多说话人对话与 70 多种语言。
推荐理由:该模型通过自然语言行内标签实现对语调和语速的精细调度,为构建多角色对话系统提供了更具成本效益的语音方案。
Google DeepMind 推出专为机器人设计的具身推理模型 Gemini Robotics-ER 1.6,大幅增强了空间推理、多视角理解以及任务完成判定能力。
推荐理由:该模型增强了空间指向、多视角任务完成判定与工业仪表读取能力,有助于开发者为实体机器人构建高阶环境理解与决策系统。
Google DeepMind 推出基于 Gemini 的 AI 鼠标指针原型,让指针能结合屏幕视觉与语义上下文直接理解用户意图。团队提出了保持工作流连贯、减少冗长提示词、支持指代交互以及将像素转化为可操作实体四项原则。目前该功能已在 Google AI Studio 开放实验体验,并逐步整合至 Chrome 浏览器与 Googlebook 笔记本。
推荐理由:原文提出了结合视觉语义与光标位置的交互原则,为大模型如何摆脱独立对话框并融入日常系统界面提供了具体设计参考。
Google Research 在 The Check Up 活动上公布了一系列医疗健康 AI 突破,涵盖个人健康助手、临床辅助决策系统及开源开发者工具。团队展示了具备多模态推理能力的多智能体系统 AMIE 在临床问诊中的实测进展,并推广支持 3D 影像的开源医疗模型 MedGemma;同时公布了乳腺癌早筛研究以及用于识别癌症基因突变的研究工具 DeepSomatic。
推荐理由:文章系统梳理了前沿医疗多模态模型与多智能体系统从实验室算法走向临床筛查、开发者生态和基因组学研究的落地链路。
Google 与 BIDMC 合作完成前瞻性临床研究,验证对话式医疗 AI 系统 AMIE 在门诊初级保健就诊前采集病史的安全性与可行性。在对 100 名患者的测试中,医生实时监督下未触发任何安全终止事件,盲审评估显示 AMIE 的鉴别诊断质量与全科医生相当,90% 病例的前 7 项鉴别诊断命中 8 周后的最终确诊结果。
推荐理由:该研究将对话式医疗 AI 从模拟环境推进到真实门诊预诊流程,在人工监督下验证了病史采集的安全性和鉴别诊断表现。