跳到正文

产品更新

AI 产品与应用的功能上新、改版与商业化动态——谁家的产品变强了、变贵了、能用了。

54条精选相关主题模型发布行业动态AI 编码

最新精选

第 1–20 条 · 共 54 条
今天9月29日周二
  1. The Decoder80

    Manus 2.0 发布,支持视频剪辑、多人游戏与手机远程运行智能体

    Manus 发布 2.0 版本,把 AI 智能体扩展为平台,用户可编辑视频、托管多人游戏,并通过手机远程运行个人智能体。新的 Cascade 智能体框架在一种测试配置下比上一代系统少用 23.2% 的 token,运行成本降低 32%。

    推荐理由:Manus 2.0 把智能体扩展成平台,附带 Cascade 的 token 与成本对比数据可作效率参照。

  2. AWS Machine Learning Blog63

    xAI Grok 4.7 正式上线 Amazon Bedrock

    xAI 的 Grok 4.7 模型已正式登陆 Amazon Bedrock,提供 500K token 上下文窗口并支持 low 至 xhigh 四档推理强度调节。该模型主打长任务自我验证与代码及专业知识工作,在 Bedrock 上通过跨区域推理配置文件提供服务。调用端兼容 OpenAI SDK 与 AWS Converse API,同时支持隐式提示词缓存和 Bedrock Guardrails。

    推荐理由:该集成提供了跨区域推理与四档推理强度控制,开发者可直接在云端现有合规框架内调用长上下文模型。

9月25日周五
  1. Google DeepMind74

    Google DeepMind 推出 Gemini 3.8 Live 实时数字人功能 Live Avatar

    Google DeepMind 推出 Gemini 3.8 Live 的 Live Avatar 功能,为原生实时对话模型提供低延迟的流式视频虚拟形象。该功能支持自然表情和精准唇形同步,可在 97 种语言间无缝切换,并支持在保持对话流畅的同时于后台异步调用工具执行复杂任务。输出内容均默认嵌入 SynthID 水印防伪,即日起在 Gemini Enterprise 开放可用。

    推荐理由:原文展示了流式视频形象与后台异步工具调用的结合,读者可以据此评估实时数字人在企业端交互场景中的落地可行性。

9月24日周四
  1. Google DeepMind61

    Google 推出 Private AI Compute 安全服务端内存架构,实现跨设备持久 AI 记忆

    Google 宣布为 Private AI Compute 平台引入服务端安全持久内存架构,在保持端侧隐私标准的同时支持跨设备保留长期 AI 上下文。该架构结合硬件安全飞地、端到端加密通道和仅由设备端持有的解密密钥,云端仅在隔离内存中临时解密处理并即时重新加密,确保数据对包括 Google 在内的第三方不可见。

    推荐理由:原文解决了传统云端隐私计算无状态导致无法跨设备保留上下文的问题,展示了云端大模型在严格硬件加密下维持长期记忆的可行路径。

9月23日周三
  1. OpenAI News60

    GPT-6 改进提示词缓存机制

    OpenAI 介绍了 GPT-6 在提示词缓存(prompt caching)上的优化机制,旨在降低推理延迟与成本。该更新支持更高的缓存命中率,并引入了全新诊断工具、显式断点以及精细控制能力。

    推荐理由:材料指出了 GPT-6 提示词缓存的命中率优化与显式断点控制,有助于开发者降低调用延迟与成本。

9月22日周二
9月21日周一
  1. Hugging Face Blog61

    Hugging Face 发布 tokenizers v1 候选版:编码速度提升 3 至 30 倍

    Hugging Face 推出 tokenizers v1 候选版本,在完全保持原有输出 token ID 与 API 兼容的前提下,将十个模型家族的单线程编码速度提升了 3 至 30 倍。

    推荐理由:原文系统拆解了通过位流指令替代正则切分与无分配合并循环等工程优化,对高吞吐文本处理工作流具有实用参考价值。

9月16日周三
  1. Mistral AI60

    Mistral 与 Mozilla 合作将开源模型引入 Firefox Smart Window

    Mozilla 宣布与 Mistral 达成合作,由 Mistral 模型为 AI 浏览助手 Firefox Smart Window 测试版提供支持。该功能首批面向法国和北美用户开放,可协助用户解析复杂搜索并基于标签页提取信息。服务强调隐私保护,对话默认不保存于 Mozilla 服务器,且 Mistral 遵循零数据留存协议。

    推荐理由:原文展示了开源模型与浏览器端结合的落地形式,读者可以参考其在本地化支持与零数据留存上的集成方案。

9月10日周四
  1. OpenAI News60

    OpenAI 在 ChatGPT Work 中推出 Data agent

    OpenAI 宣布在 ChatGPT Work 中推出 Data agent。该智能体支持用户使用自然语言连接企业数据、挖掘业务洞察,并借助 AI 构建交互式仪表盘。

    推荐理由:官方简短介绍了该智能体连接企业数据与构建交互仪表盘的场景,读者可据此了解其工作流支持方向。

  2. OpenAI News60

    OpenAI 推出面向金融服务的 ChatGPT

    OpenAI 推出面向金融服务的 ChatGPT(ChatGPT for Financial Services),结合内置金融数据与 GPT-6 Astra 模型。该产品旨在支持金融研究、财务建模以及直接交付客户的材料制作。

    推荐理由:该版本将内置金融数据与前沿模型整合,直接支持调研、建模和材料生成,便于金融从业者评估定制化工具对专业流程的支持能力。

  3. OpenAI News69

    OpenAI 推出 Agents API

    OpenAI 推出 Agents API,这是一项用于构建和启动云端智能体的托管服务。该服务由 Codex harness 提供支持,具备任务编排、长时运行会话以及工具调用能力。

    推荐理由:该接口将智能体编排、长时会话和工具调用封装为托管服务,便于开发者降低云端智能体的构建与维护成本。

9月8日周二
  1. Google DeepMind71

    Google DeepMind 推出 AlphaGenome Atlas 人类基因组突变预测图谱平台

    Google DeepMind 正式推出 AlphaGenome Atlas 平台,预计算并收录了人类基因组中全部 90 亿个单核苷酸变异的分子生物学影响。该 1PB 规模的数据集配套推出了综合致病性评估的 AVI 评分,可同时覆盖蛋白质编码区与占 98% 的非编码调控区。目前该图谱已通过免费网站门户和 API 开放学术研究使用,后续将登陆 Google Cloud。

    推荐理由:平台预先计算了人类基因组 90 亿个突变的分子影响,科研人员无需自行推理即可直接排查致病位点。

9月5日周六
  1. GitHub Blog · AI & ML74

    GitHub Copilot 推出 Project HydraFusion 多模型编排预览

    GitHub Copilot 推出 Project HydraFusion 研究预览版,通过在跨厂商多模型间进行运行时编排来优化编码任务。系统会根据任务能力信号在单模型直出、级联升级和模型间交叉审查三种执行模式中动态选择,以平衡质量、成本与延迟。

    推荐理由:原文给出了单模型、级联和交叉审查三套编排机制及评测对比,为工程团队降低高阶模型调用成本提供了可借鉴范式。

9月3日周四
9月2日周三