跳到正文

全部动态

今日 0 条
9月23日周三
  1. Simon Willison88

    Claude Opus 5.5 与 GPT-6 Sol、Luna 实测体验及价格战分析

    Anthropic 与 OpenAI 分别发布 Claude Opus 5.5 和 GPT-6 Sol、Luna,以大幅降价引发新一轮前沿模型价格战。GPT-6 Luna 将输入价格降至每百万 token 0.10 美元,Opus 5.5 输入降价 20% 且缓存读取价格降低 60%。

    推荐理由:文章梳理了多款新模型的价格落点与降幅,并记录了深度思考模式在生成任务中耗尽上下文的实测表现。

  2. Ars Technica · AI71

    Anthropic Opus 5.5 与 OpenAI GPT-6 Sol、Luna 发布:能力小幅提升、成本大幅下降

    Anthropic 与 OpenAI 相继发布新模型,共同点是能力小幅提升、使用成本大幅下降。Anthropic 称相比 Opus 5,Opus 5.5 在默认设置下处理典型工作负载可节省接近 40% 成本,因为 token 单价下降且完成任务所用 token 更少;该模型在网络安全、生物学等高风险领域能力突出,相关请求可能被自动透明地路由到旧模型。

  3. OpenAI News60

    GPT-6 改进提示词缓存机制

    OpenAI 介绍了 GPT-6 在提示词缓存(prompt caching)上的优化机制,旨在降低推理延迟与成本。该更新支持更高的缓存命中率,并引入了全新诊断工具、显式断点以及精细控制能力。

    推荐理由:材料指出了 GPT-6 提示词缓存的命中率优化与显式断点控制,有助于开发者降低调用延迟与成本。

  4. Ars Technica · AI68

    微软联合多方打击利用 AI 窃取 1.2 万个账户的犯罪平台 EvilTokens

    微软周二宣布主导了一项全行业联合行动,成功打击了名为 EvilTokens 的订阅制诈骗平台,该平台在数月内利用 AI 聊天机器人盗取了 12000 个微软账户。EvilTokens 自 2 月起在 Telegram 上以 1500 美元首付款加每月 500 美元订阅费运营,其核心 AI 聊天机器人可自动化分析受害者收件箱中的信任关系与付款授权,并能伪造可信联系人草拟欺诈邮件诱导转账。

  5. Ars Technica · AI79

    加拿大不列颠哥伦比亚省起诉 OpenAI 要求为枪击案受害社区赔偿新建学校

    加拿大不列颠哥伦比亚省起诉 OpenAI,指控其模型缺陷与未向警方预警的行为助长了枪手的暴力意图,并要求 OpenAI 承担包括出资新建学校在内的巨额赔偿。诉状指出 OpenAI 关闭了阻断相关聊天的功能,且模型规范要求在涉及暴力对话时默认假定善意而不探究意图,涉嫌违反其公开承诺的安全预警职责。原告还要求法院下令对 OpenAI 实施定期独立审计,以确保高风险暴力对话能及时移交执法部门。

    推荐理由:诉讼聚焦 AI 厂商对暴力意图识别及向执法机构预警的法律责任,展示了模型安全规范在应对现实危害时面临的司法问责风险。

9月22日周二
  1. MIT Technology Review · AI36

    别被这个夏天的 AI 炒作骗了:从 Claude Mythos 到 OpenAI Astra 的真相

    Anthropic 的 Claude Mythos 宣称比安全专家更擅长发现软件漏洞,OpenAI 与 Hugging Face 的黑客事件后 Anthropic 和 Meta 也袒露类似情况。网络安全专家认为事件更多源于 OpenAI 忽视基本安全实践,而非模型失控;数学家则指 OpenAI 的 Astra 并未带来深刻突破,并指控其抄袭。

  2. Hugging Face Blog57

    oMLX 创作者 Jun Kim 加入 Hugging Face,加速推进 Apple MLX 生态建设

    oMLX 创建者兼维护者 Jun Kim 正式加入 Hugging Face,全职投入支持 Apple MLX 社区与本地 AI 生态。oMLX 将从个人业余项目升级为获得资金支持的完全维护项目,继续保持 Apache 2.0 开源协议;未来重点之一是简化流程,加速将 transformers 模型定义转换为能在 MLX 上运行的参考实现。

  3. NVIDIA Blog46

    NVIDIA 推出 DSX Ready 认证计划,规范 AI 工厂电力与散热产品

    NVIDIA 推出 NVIDIA DSX Ready 认证计划,为符合其 DSX AI 工厂参考设计的第三方电力与散热方案提供标准化验证。该计划首发涵盖电池储能系统(BESS)与冷量分配单元(CDU)两大类别,首批通过认证的厂商包括 Tesla、Hitachi Energy、LG 与 Vertiv 等。后续该计划还将扩展至更多基础设施和软件类别,旨在降低集成风险并加速 AI 工厂部署。

  4. NVIDIA Blog49

    NVIDIA:为什么规模化部署物理 AI 需要全层级安全

    面对自动驾驶与机器人的规模化部署,NVIDIA 提出物理 AI 必须贯穿硬件、软件与 AI 行为等全生命周期安全,并推出全栈安全系统 NVIDIA Halos。针对自动驾驶,Halos 涵盖 DRIVE AGX Thor 计算平台与 Alpamayo 开源推理模型;针对机器人,Halos 整合 IGX Thor 工业模块与 Isaac Lab 仿真验证,支持第三方系统级认证。

  5. NVIDIA Blog35

    从赋能到落地:埃及 AI 生态迈向生产级规模

    埃及 AI 生态正迈向规模化生产阶段,NVIDIA 深度学习培训机构在埃及的学员基数在一年内增长超十倍,在非洲已累计培训超 85,000 名开发者。非洲一年内已宣布或上线 4 座 AI 工厂且在建新增容量达 656 兆瓦,包括 Cassava 投资可达 7.2 亿美元的算力部署,以及由超 50 台 NVIDIA HGX B300 系统驱动的本土 AI 云。

9月21日周一
  1. Microsoft Research54

    微软在 Nature 发表小分子逆合成预测模型 RetroChimera 并开源

    微软在《Nature》发表小分子逆合成预测模型 RetroChimera 并开源代码与权重,通过学习重排序策略融合了 Transformer 生成式模型与图神经网络模板模型。在盲测中,化学专家对其单步反应预测的评价超过先前模型与文献记录反应,在 10 个高难度目标分子的多步合成测试中成功规划出 9 个。项目代码已按 MIT 协议托管于 GitHub,并接入 Microsoft Foundry。

  2. NVIDIA Blog47

    NVIDIA:AI 安全是一个工程问题,如何在 AI 智能体技术栈各层构建防护

    NVIDIA 强调 AI 安全是需在模型、工作流及运行时全栈设立强制边界的工程问题,并开源了安全运行时 OpenShell。OpenShell 独立于智能体自身的推理决策提供沙箱执行环境,从底层管控文件、网络和系统资源访问。Cisco 的 DefenseClaw 与 JFrog 已接入该架构,分别提供治理层以及技能扫描和策略控制支持。

  3. Hugging Face Blog45

    像物理学家一样剪枝大语言模型:将块删除建模为伊辛优化问题

    新研究将大语言模型的 Transformer 块剪枝建模为约束二进制优化与伊辛玻璃问题,通过最小化能量确定最优删除组合。该方法利用 Hessian 矩阵捕捉层间耦合相互作用,无需逐一运行基准测试即可低成本评估海量配置。在 Llama-3.3-70B-Instruct 的 50% 压缩测试中,其 MMLU 得分比现有最佳块删除方法高出近 23 个百分点。

  4. Import AI17

    Import AI 473:美国超级智能战略、人脑组织小鼠模型与机器诠释学

    RAND 发布报告,建议美国在通往超级智能的不确定路径上采取"自由行动"战略,以保留地缘政治优势并确保人类存续,核心包括构建人机生态系统、AI 安全架构、改造国安体系及提升社会应对能力。研究人员还将人类脑组织培育进刻意清除脑细胞的小鼠体内,作为研究载体。

  5. MIT Technology Review · AI53

    MIT科技评论:解决美墨边境“虚拟墙”AI监控失效的4个建议

    《麻省理工科技评论》联合调查发现美墨边境超1050人在AI监控塔附近死亡,暴露出算法未检出目标、设备损坏及警员忽视警报等系统性漏洞。文章针对边境虚拟墙的失效提出4条政策建议:全面审计监控塔附近的死亡情况、修正移民死亡与遗骸的追踪机制、准确记录监控技术促成抓捕的真实案例,以及将每次死亡事件按潜在监控失效开展专项调查。

  6. MIT Technology Review · AI71

    美国斥资数十亿美元建立边境 AI 监控系统,为何仍难阻止越境人员死亡

    《MIT 科技评论》联合调查显示,2015 年至 2026 年初,有超过 1050 人在美国海关与边境保护局部署的监控塔探测范围内死亡。调查指出,包括 Anduril 制造的 AI 自主监控塔在内的设备,经常因算法漏检、掩体伪装、地形盲区以及边境巡逻人员未能及时响应而失效。尽管美国政府计划继续斥资数十亿美元扩建上千座 AI 监控塔,但相关监管部门至今缺乏追踪系统真实有效性与死亡案例的内部审计机制。

  7. MIT Technology Review · AI51

    《麻省理工科技评论》如何绘制美墨边境“虚拟墙”监控下的死亡分布地图

    《麻省理工科技评论》公布了一项历时 15 个月的调查方法,团队通过整合近 4000 起移民遗骸记录与数百座边境监控塔数据,构建出美墨边境“虚拟墙”附近的死亡分布地图。调查过程中借助 Anthropic 的 Claude 模型解析了数千页警方报告并提取坐标,并结合卫星历史影像与高程数据测算塔架存在时间与视线遮挡情况。

  8. NVIDIA Blog35

    5 家利用 NVIDIA AI 推动清洁能源的公司

    NVIDIA 在纽约气候周展示了 5 家利用其 AI 技术加速清洁能源转型的代表企业。ThinkLabs AI 基于 CUDA 将电网互联评估时间从 30-45 天缩减至 2 分钟;Redwood Materials 在 Blackwell 平台上运行 AI 层调度回收电池供电。