跳到正文

#产品更新

今日 2 条
今天9月29日周二
  1. Microsoft Research58

    微软研究院发布生物学 AI 研究系统 Quine

    微软研究院推出面向复杂生物学研究的 AI 系统 Quine,由生物多模态世界模型与交互式实验调度框架组成。在与 Broad 研究所合作的胰腺癌研究中,系统在一个周末内预测并筛选出能诱导肿瘤细胞状态转换的候选化合物,并在湿实验中完成验证。微软同步启动了 Quine Fellows 访问计划,并计划未来通过 Microsoft Discovery 等产品逐步扩大访问权限。

  2. AWS Machine Learning Blog63

    xAI Grok 4.7 正式上线 Amazon Bedrock

    xAI 的 Grok 4.7 模型已正式登陆 Amazon Bedrock,提供 500K token 上下文窗口并支持 low 至 xhigh 四档推理强度调节。该模型主打长任务自我验证与代码及专业知识工作,在 Bedrock 上通过跨区域推理配置文件提供服务。调用端兼容 OpenAI SDK 与 AWS Converse API,同时支持隐式提示词缓存和 Bedrock Guardrails。

    推荐理由:该集成提供了跨区域推理与四档推理强度控制,开发者可直接在云端现有合规框架内调用长上下文模型。

9月25日周五
  1. Google DeepMind74

    Google DeepMind 推出 Gemini 3.8 Live 实时数字人功能 Live Avatar

    Google DeepMind 推出 Gemini 3.8 Live 的 Live Avatar 功能,为原生实时对话模型提供低延迟的流式视频虚拟形象。该功能支持自然表情和精准唇形同步,可在 97 种语言间无缝切换,并支持在保持对话流畅的同时于后台异步调用工具执行复杂任务。输出内容均默认嵌入 SynthID 水印防伪,即日起在 Gemini Enterprise 开放可用。

    推荐理由:原文展示了流式视频形象与后台异步工具调用的结合,读者可以据此评估实时数字人在企业端交互场景中的落地可行性。

9月24日周四
  1. Google DeepMind61

    Google 推出 Private AI Compute 安全服务端内存架构,实现跨设备持久 AI 记忆

    Google 宣布为 Private AI Compute 平台引入服务端安全持久内存架构,在保持端侧隐私标准的同时支持跨设备保留长期 AI 上下文。该架构结合硬件安全飞地、端到端加密通道和仅由设备端持有的解密密钥,云端仅在隔离内存中临时解密处理并即时重新加密,确保数据对包括 Google 在内的第三方不可见。

    推荐理由:原文解决了传统云端隐私计算无状态导致无法跨设备保留上下文的问题,展示了云端大模型在严格硬件加密下维持长期记忆的可行路径。

9月23日周三
  1. OpenAI News60

    GPT-6 改进提示词缓存机制

    OpenAI 介绍了 GPT-6 在提示词缓存(prompt caching)上的优化机制,旨在降低推理延迟与成本。该更新支持更高的缓存命中率,并引入了全新诊断工具、显式断点以及精细控制能力。

    推荐理由:材料指出了 GPT-6 提示词缓存的命中率优化与显式断点控制,有助于开发者降低调用延迟与成本。

9月22日周二
  1. NVIDIA Blog49

    NVIDIA:为什么规模化部署物理 AI 需要全层级安全

    面对自动驾驶与机器人的规模化部署,NVIDIA 提出物理 AI 必须贯穿硬件、软件与 AI 行为等全生命周期安全,并推出全栈安全系统 NVIDIA Halos。针对自动驾驶,Halos 涵盖 DRIVE AGX Thor 计算平台与 Alpamayo 开源推理模型;针对机器人,Halos 整合 IGX Thor 工业模块与 Isaac Lab 仿真验证,支持第三方系统级认证。

9月21日周一
  1. Hugging Face Blog61

    Hugging Face 发布 tokenizers v1 候选版:编码速度提升 3 至 30 倍

    Hugging Face 推出 tokenizers v1 候选版本,在完全保持原有输出 token ID 与 API 兼容的前提下,将十个模型家族的单线程编码速度提升了 3 至 30 倍。

    推荐理由:原文系统拆解了通过位流指令替代正则切分与无分配合并循环等工程优化,对高吞吐文本处理工作流具有实用参考价值。

9月17日周四
  1. OpenAI News41

    OpenAI 推出 Astra for Law

    OpenAI 推出面向法律领域的 Astra for Law,将前沿智能引入法律业务。该方案支持定制律所工作流并连接法律数据源,同时为处理客户机密工作提供法律级安全控制能力。

9月16日周三
  1. Mistral AI60

    Mistral 与 Mozilla 合作将开源模型引入 Firefox Smart Window

    Mozilla 宣布与 Mistral 达成合作,由 Mistral 模型为 AI 浏览助手 Firefox Smart Window 测试版提供支持。该功能首批面向法国和北美用户开放,可协助用户解析复杂搜索并基于标签页提取信息。服务强调隐私保护,对话默认不保存于 Mozilla 服务器,且 Mistral 遵循零数据留存协议。

    推荐理由:原文展示了开源模型与浏览器端结合的落地形式,读者可以参考其在本地化支持与零数据留存上的集成方案。

  2. NVIDIA Blog53

    NVIDIA 详解 DSX AI 工厂方案:固定电力预算下 Token 吞吐提升 24%

    NVIDIA 披露了针对 AI 工厂的 DSX 架构套件实测数据,通过动态电力分配与电网协同调度最大化算力产出。云服务商 Lambda 在 HGX B200 集群上验证 DSX MaxLPS,在相同电力预算下将集群 Token 吞吐量提升 24%,每瓦性能提高 23%。同时结合电网响应系统,可在外部电力紧张时自动降低功耗并保持高优先级推理作业稳定运行。

9月12日周六
9月10日周四
  1. OpenAI News60

    OpenAI 在 ChatGPT Work 中推出 Data agent

    OpenAI 宣布在 ChatGPT Work 中推出 Data agent。该智能体支持用户使用自然语言连接企业数据、挖掘业务洞察,并借助 AI 构建交互式仪表盘。

    推荐理由:官方简短介绍了该智能体连接企业数据与构建交互仪表盘的场景,读者可据此了解其工作流支持方向。

  2. OpenAI News60

    OpenAI 推出面向金融服务的 ChatGPT

    OpenAI 推出面向金融服务的 ChatGPT(ChatGPT for Financial Services),结合内置金融数据与 GPT-6 Astra 模型。该产品旨在支持金融研究、财务建模以及直接交付客户的材料制作。

    推荐理由:该版本将内置金融数据与前沿模型整合,直接支持调研、建模和材料生成,便于金融从业者评估定制化工具对专业流程的支持能力。

  3. OpenAI News69

    OpenAI 推出 Agents API

    OpenAI 推出 Agents API,这是一项用于构建和启动云端智能体的托管服务。该服务由 Codex harness 提供支持,具备任务编排、长时运行会话以及工具调用能力。

    推荐理由:该接口将智能体编排、长时会话和工具调用封装为托管服务,便于开发者降低云端智能体的构建与维护成本。

9月8日周二
  1. Google DeepMind71

    Google DeepMind 推出 AlphaGenome Atlas 人类基因组突变预测图谱平台

    Google DeepMind 正式推出 AlphaGenome Atlas 平台,预计算并收录了人类基因组中全部 90 亿个单核苷酸变异的分子生物学影响。该 1PB 规模的数据集配套推出了综合致病性评估的 AVI 评分,可同时覆盖蛋白质编码区与占 98% 的非编码调控区。目前该图谱已通过免费网站门户和 API 开放学术研究使用,后续将登陆 Google Cloud。

    推荐理由:平台预先计算了人类基因组 90 亿个突变的分子影响,科研人员无需自行推理即可直接排查致病位点。

9月5日周六
  1. GitHub Blog · AI & ML74

    GitHub Copilot 推出 Project HydraFusion 多模型编排预览

    GitHub Copilot 推出 Project HydraFusion 研究预览版,通过在跨厂商多模型间进行运行时编排来优化编码任务。系统会根据任务能力信号在单模型直出、级联升级和模型间交叉审查三种执行模式中动态选择,以平衡质量、成本与延迟。

    推荐理由:原文给出了单模型、级联和交叉审查三套编排机制及评测对比,为工程团队降低高阶模型调用成本提供了可借鉴范式。

9月3日周四
  1. Google DeepMind57

    Google DeepMind 推出 Fairwind 计划,提供 Gemini 3.8 Flash Cyber 与自主漏洞修复能力

    Google DeepMind 宣布启动面向政府与受信任合作伙伴的 Fairwind 计划,提供自主发现和修复网络安全漏洞的高级防御能力。该计划结合专用模型 Gemini 3.8 Flash Cyber 与 CodeMender 框架,可在几分钟内为组织生成并验证可直接部署的安全补丁。目前全球已有超 650 家伙伴参与,覆盖公共部门、关键基础设施运营商与核心技术平台。

9月2日周三
9月1日周二
8月25日周二
  1. Hugging Face Blog76

    Gradio 推出内置工作流功能 gr.Workflow

    Gradio 推出内置的 gr.Workflow 功能,支持将多步 AI 流水线定义为类型化节点图并提供拖拽式交互画布。每个节点均可独立运行且中间结果可见,工作流无需额外配置即可自动转为独立的 REST API 端点。开发者可以连接自定义 Python 函数、Hugging Face 推理提供商或 Spaces,并结合 ZeroGPU 在云端执行本地模型。

    推荐理由:原文解析了如何用可视化画布串联模型、函数与外部空间,读者可据此低成本搭建多节点流水线与接口服务。

8月20日周四
  1. Mistral AI71

    Mistral 推出 Agentic Search 多步检索功能

    Mistral 推出检索层工具 Agentic Search,通过多步循环让模型在长文档与复杂数据中自主导航、查阅和验证信息。系统提供 search、open、navigate、read 和 grep 五项工具,现已集成至 Mistral Search Toolkit 以及 Studio 和 Vibe 的 Libraries。

    推荐理由:原文对比了传统单次检索与带文件导航的多步检索循环,为长文档与复杂报表的架构选型提供了实测参考。

8月18日周二
  1. Hugging Face Blog60

    Sentence Transformers v6.0 新增 MultiVectorEncoder 支持 ColBERT 式晚交互检索

    Sentence Transformers v6.0 新增第四种模型类型 MultiVectorEncoder,用于 ColBERT 式晚交互检索,可直接加载 PyLate、Stanford-NLP ColBERT 检查点以及 colpali-engine 的视觉文档检索模型,API 与已有的 dense、sparse、reranker 模型一致。

    推荐理由:原文给出多向量检索的完整用法与召回代价对比,读者可据此判断何时该用晚交互模型替代单向量嵌入。

8月13日周四
  1. Hugging Face Blog48

    OlmoEarth Studio 推出 OlmoEarth 嵌入向量自定义导出功能

    OlmoEarth Studio 推出开源 OlmoEarth 基础模型的嵌入向量导出功能,支持生成 COG 格式的地球观测特征表示。用户可通过 UI 或 API 自定义区域,并选配 Nano(1.4M)、Tiny(6.2M)或 Base(89M 参数)编码器及 10 至 80 米分辨率。生成的 int8 向量可直接用于相似度检索与少样本分割等下游任务,相关源码与模型权重均已公开发布。

8月11日周二