跳到正文

#Google

今日 6 条
8月27日周四
  1. Google DeepMind61

    Google DeepMind 试点双盲 AI 评测以应对基准测试污染

    Google DeepMind 宣布试点双盲 AI 评测方案,利用密码学安全环境防止前沿专有模型在测试前获取题目,以解决基准测试污染问题。团队联合新加坡 AI 安全研究所、OpenMined、AVERI 与 MLCommons,在隐私保护环境中对 Gemini Flash Lite 模型进行机密基准测试。该机制通过技术与密码学保障替代单纯的合同与日志约束,提升模型能力评测的完整性与可信度。

    推荐理由:文章介绍了通过密码学安全环境防止基准测试数据污染的试点方案,为解决模型预先窥题和评估失真提供了工程化参考。

  2. Google Research42

    GlucoFM:面向连续血糖监测的基础模型

    Google 提出面向连续血糖监测(CGM)的自监督基础模型 GlucoFM,采用分离慢速血糖趋势与短期波动的双流架构。该模型基于 109,066 小时无标签数据预训练,在 14 项临床预测评估中平均 PR-AUC 达 58.8,较同数据基准提升 4.1 点,并在两小时餐后血糖反应(PPGR)预测中取得最低平均绝对误差。

8月26日周三
  1. Google Research47

    AgentHands:在 XR 中为空间定位智能体对话生成交互式手势

    Google Research 推出研究原型 AgentHands,通过将大语言模型推理映射为 3D 物理动作,为 XR 环境中的 AI 智能体生成与语音同步的交互手势。系统结合轻量级物体注册、手势事件库与本地解析器,利用词级时间戳让虚拟手在空间中精准执行指示与动作模拟。该方案在兰花养护和 3D 打印机操作等场景中显著提升了空间交互指导的直观性。

8月22日周六
8月21日周五
  1. Google Research45

    Google:移动数据如何让大语言模型更深入理解地点

    Google 推出 ME-POIs 框架,将聚合匿名的移动模式与文本描述融合,让大语言模型生成兼顾地点语义与动态功能的向量嵌入。在未见地点测试中,该框架使访问意图预测相对提升 81.9%,价格等级分类提升 75.1%,繁忙度估算准确率提高 24.7%。其空间多尺度传播机制还能迁移周边特征,有效缓解长尾商户的数据稀疏问题。

8月17日周一
  1. Google Research59

    Google Research 推出 PhotoScan 框架,利用手机照片估算身体成分与心脏代谢风险

    Google Research 推出深度学习研究框架 PhotoScan,可直接通过智能手机拍摄的 2D 照片估算体脂率、躯干臀腿脂肪比(A/G)及内脏皮下脂肪比(V/S)。在独立临床验证队列中,结合该身体成分特征后胰岛素抵抗分类的 AUROC 达到 0.760,表现接近临床双能 X 射线吸收测量仪(DXA)金标准的 0.773,并明显优于传统智能手表的生物电阻抗测量。

8月14日周五
  1. Google DeepMind83

    Google DeepMind 发布 Gemini 3.7 Flash

    Google DeepMind 正式推出面向编程与 AI 智能体的工作流模型 Gemini 3.7 Flash,在软件工程、知识处理和 Web 开发上均有提升。

    推荐理由:原文给出了编程和复杂工作流的实测基准数据与首发半价方案,读者可以据此评估在生产环境中替换现有轻量模型的性价比。

8月12日周三
  1. Google DeepMind70

    Google DeepMind 推出手语转文本模型 SL2T

    Google DeepMind 推出多语言手语转文本模型 SL2T,并在 Pixel 11 的 Gboard 与 Live Transcribe 中率先支持美式手语转英语输入。该模型使用覆盖 50 多种手语的超 100,000 小时数据联合训练,借助端侧 MediaPipe Holistic 提取身体姿态关键点坐标直接翻译为文本,在 FLEURS-ASL 基准测试中达到 70 BLEURT 分数。

    推荐理由:该模型将端侧姿态坐标提取与云端序列翻译结合并绕过中间标注,为视觉多模态语言落地提供了具体方案。

  2. Google Research66

    Google Research 提出知识画像框架:大模型事实性瓶颈在于检索而非编码

    Google Research 提出知识画像框架与 WikiProfile 基准,指出前沿大语言模型的事实性瓶颈已从知识编码转向知识检索。评测显示 Gemini-3-Pro 与 GPT-5 等前沿模型已编码 95%–98% 的事实,但仍有 26%–34% 的事实无法直接检索。开启思考机制能够找回 40%–65% 已编码却无法直接检索的事实,显著缓解长尾事实检索困难与反向诅咒现象。

    推荐理由:原文通过实验证明前沿模型的事实错误主要源于检索障碍而非参数缺失,为利用思考机制和后训练改善知识调用提供了新视角。

  3. Google Research74

    Google 推出 AMIE (Video) 实时视频临床问诊系统

    Google Research 与 Google DeepMind 推出基于 Gemini 与 Project Astra 的临床问诊系统 AMIE (Video),支持在实时视频问诊中感知非语言线索并引导虚拟体检。

    推荐理由:研究提出了拆分对话、规划与感知的异步多智能体架构,为高延迟深度推理与低延迟实时音视频交互的共存提供了参考方案。

8月6日周四
  1. Google DeepMind78

    Google DeepMind 开源气旋预测模型 WeatherNext

    Google DeepMind 联合多家气象机构在《Nature》发表研究并开源 WeatherNext 系列模型,在热带气旋路径、强度及风场结构预测上平均获得额外 24 小时的精度提前量。

    推荐理由:该成果证明大尺度低分辨率输入结合生成网络同样能精准预测极端气旋,为极端气象预警提供了开源且低计算门槛的方案。

7月31日周五
7月30日周四
  1. Google DeepMind65

    Google DeepMind 在 Flow Music 中推出音乐生成模型 Lyria 3.5

    Google DeepMind 宣布在 Google Flow Music 中上线最新音乐生成模型 Lyria 3.5,全面升级音乐性、歌词、人声表现和创作控制。新模型支持更复杂的旋律结构与发音更准、情感更自然的人声,同时增强了歌词生成的提示词遵循度,并允许用户直接调整输出的节奏与时长。

    推荐理由:模型在旋律、歌词、人声以及节奏和时长控制上的升级,为创作者在音乐生成工具中微调成品提供了更细致的调节空间。

7月28日周二
  1. Google DeepMind76

    Google DeepMind 发布 Gemini Robotics 2 机器人模型系列

    Google DeepMind 发布机器人模型系列 Gemini Robotics 2,首次实现对人形机器人的全身运动控制、高灵巧度末端操作及多机器人协作。该系列包含负责视觉语言动作控制的 VLA 模型、负责长流程规划的具身推理模型 ER 2,以及适配新本体仅需数小时数据的端侧模型 On-Device 2。

    推荐理由:该系列将控制范围扩展至人形机器人全身协调与灵巧操作,为具身智能从桌面任务迈向多机长周期协作提供了落地方案。

7月23日周四
  1. Google Research74

    Google 提出 SymptomAI:用于日常症状评估的对话式 AI 智能体研究

    Google Research 联合 Google DeepMind 推出 SymptomAI 研究,探索利用基于 Gemini Flash 2.0 的对话式 AI 智能体进行端到端症状问诊与鉴别诊断。

    推荐理由:这项研究通过上万名真实用户的随访与穿戴设备生理数据,展示了具备主动追问能力的对话式模型在日常鉴别诊断中的可行性。

  2. Google Research67

    Google 提出基于强化学习的量子纠错控制框架:在量子计算运行中实现自主校准

    Google Research 与 Google DeepMind 在 Nature 发表研究,提出一种利用强化学习(RL)自主调控量子纠错的框架,使量子计算机无需停机即可动态校准控制参数以对抗硬件漂移。

    推荐理由:Google 将强化学习引入量子纠错控制,利用运行中生成的错误检测信号动态抵御硬件漂移,为避免中断计算进行校准提供了可行方案。

7月22日周三
7月21日周二
  1. Google DeepMind82

    Google DeepMind 发布 Gemini 3.6 Flash、3.5 Flash-Lite 与 3.5 Flash Cyber

    Google DeepMind 正式推出 Gemini 3.6 Flash、3.5 Flash-Lite 以及专用于网络安全的 3.5 Flash Cyber 模型,重点提升智能体工作流的 token 效率与执行速度。

    推荐理由:模型通过减少输出 token 消耗和推理步骤降低智能体运行成本,为开发者部署高吞吐工作流提供了兼顾速度与精度的选型参考。

7月20日周一
7月17日周五
  1. Google DeepMind71

    Google DeepMind 发布轻量网络安全模型 Gemini 3.5 Flash Cyber

    Google DeepMind 发布 Gemini 3.5 Flash Cyber,这是基于 3.5 Flash 微调的轻量网络安全模型,用于快速发现、验证和修补漏洞,将由 CodeMender 通过限定访问试点向政府和可信合作伙伴提供。

    推荐理由:官方给出轻量安全模型在多个漏洞基准上的对比与限政府合作伙伴的试点安排,可了解攻防两侧能力变化。

7月16日周四
  1. Google Research44

    Google Research 揭秘扩散模型的创造力来源

    Google Research 在 ICLR 2026 发表的研究揭示,扩散模型的“创造力”并非随机巧合,而是源于神经网络训练中的得分平滑(score smoothing)现象。由于权重衰减等正则化效应,模型学到的是平滑后的近似得分函数,避免了单纯记忆复刻训练数据。这种平滑机制促使去噪过程在训练数据点之间实现插值,从而稳定生成逼真的全新样本。

7月13日周一
7月9日周四
  1. Google Research70

    Google 提出 SensorFM:面向可穿戴健康数据的传感器基础模型

    Google Research 联合 Google DeepMind 推出可穿戴健康数据基础模型 SensorFM。该模型基于 500 万参与者超过 1 万亿分钟的未标注多模态传感器信号进行预训练,通过自适应掩码框架直接适应数据缺失,在心血管、代谢、睡眠和心理健康等 35 项任务中均展现出跨领域迁移能力。

    推荐理由:作者利用自监督掩码学习打通了多源可穿戴传感器数据,为稀缺医疗标注场景下的生理特征建模提供了通用方案。

7月8日周三
7月3日周五
  1. Google DeepMind56

    Google DeepMind 与 A24 达成影视技术研究合作,Google 亦完成对 A24 投资

    Google DeepMind 与电影公司 A24 宣布建立长期研发合作,同时 Google 完成了对 A24 的投资。双方将把技术创新直接锚定在创意制作流程中,由电影创作者参与未来工具与新工作流的塑造,并向研发团队提供一线反馈。合作初期聚焦于弥合前沿技术与娱乐制作的断层,具体技术成果与里程碑将随联合开发逐步推进。

7月1日周三
  1. Google Research45

    Google 将 Heat Resilience 数据扩展至全球 50 多个城市

    Google Research 发布了覆盖全球 9 个国家 50 多个城市的建筑级屋顶反照率扩展数据集,并通过新上线的 Heat Resilience Earth Engine App 开放。该技术利用机器学习融合 Sentinel-2 与 30-cm 高分辨率卫星影像,反照率精度 RMSE 达到 0.04。建模显示,基于该数据针对性规划凉爽屋顶最高可将极端城市高温降低 0.5°C。

6月30日周二
  1. Google Research74

    Google 发布表格数据零样本基础模型 TabFM

    Google Research 推出面向表格数据分类与回归的零样本基础模型 TabFM,无需手动训练、特征工程或超参数调优即可在单次前向传播中完成预测。模型融合行列交替注意力与行压缩机制,完全基于结构因果模型生成的数亿个合成数据集预训练。目前该模型已在 GitHub 与 Hugging Face 开源,并原生接入 Google Cloud BigQuery 支持直接通过 SQL 调用。

    推荐理由:该模型将上下文学习范式引入表格数据分析,读者可以了解如何省去传统树模型繁琐的特征工程与调优流程。

6月27日周六
6月25日周四
  1. Google Research38

    Google 通过线性弹性缓存优化云经济性

    Google 提出线性弹性缓存(linear elastic caching),将缓存逐出建模为“滑雪租赁问题”,利用轻量级机器学习动态调整缓存生命周期。在 Google Spanner 生产环境集成数月的测试中,该方法使内存占用减少 15.5%,总拥有成本(TCO)降低约 5%,实际 I/O 成本影响仅 0.5%。

  2. Google Research66

    Google 研究揭示推理过程如何解锁大模型的参数化知识

    Google Research 团队在 COLM 2026 入选论文中揭示,让大模型生成推理轨迹能显著解锁单跳事实问答中原本难以直接读取的参数化知识。该提升主要由提供额外前向计算的计算缓冲效应,以及自发生成相关背景事实的事实预热机制共同驱动。研究同时发现中间推理若夹杂单条幻觉事实会导致最终正确率骤降,建议通过测试期轨迹验证或过程奖励强化真实性。

    推荐理由:研究揭示了思维链除任务拆解外还能辅助参数化记忆检索的双重机制,为理解思考型模型的知识召回与幻觉抑制提供了控制实验依据。

  3. Google DeepMind70

    Gemini 3.5 Flash 内置 computer use 工具

    Google DeepMind 宣布 computer use 成为 Gemini 3.5 Flash 的内置工具,开发者可通过 Gemini API 和 Gemini Enterprise Agent Platform 构建能在浏览器、移动端和桌面环境中感知、推理并执行操作的智能体。

    推荐理由:Original text explains the capability and API access methods for integrating computer use into the main Gemini Flash model, allowing readers to assess how to build cross-platform automation agents.

6月22日周一
6月17日周三
  1. Google Research41

    Google Earth AI 助力自然恢复:从像素到规划

    Google 发布基于 Earth AI 的矢量化生态数据集,将常规卫星难以识别的树篱、矮树林和石墙等细粒度乡村特征转化为可操作清单。该框架基于在超 3 亿张卫星图像上预训练的 RSF Vision-Transformer 骨干网络,结合亚米级图像与 1 米 LiDAR 数据解决了复杂的重叠空间拓扑难题。

6月16日周二