跳到正文

#Anthropic

今日 4 条
今天9月29日周二
  1. The Verge · AI50

    AI 正在加剧黑客攻击,而本地医院和银行尚未做好准备

    Anthropic 披露,一个网络犯罪团伙用 Claude Code 在一个月内攻击了医疗机构、急救服务、宗教组织和政府实体;其威胁情报负责人 Jacob Klein 称,过去需要一整个团队才能完成的事,如今单人借助智能体系统即可做到。顶级实验室仅向 Nvidia、Google、Apple 等少数机构开放 Mythos、Astra 等网络安全模型,医院、社区银行和小型非营利组织难以获得同等防护。

  2. MIT Technology Review · AI65

    我们何时才能说 AI 做出了科学发现?

    Anthropic 宣称其 950 个 Claude 智能体组成的系统做出首项生物学发现,但多位生物学家批评其找到的基因重复模式只是繁杂的基础筛选,并未阐明功能机制,算不上科学突破。哥本哈根大学学者亦指出其团队早已发现该模式,并质疑模型数据来源。文章分析认为,AI 公司执意将辅助工具宣传为独立发现者,正在加剧学术界对 AI 科研价值的怀疑与标准分歧。

9月28日周一
  1. MIT Technology Review · AI66

    AI 智能体失控越界时究竟该由谁担责?

    面对 OpenAI、Anthropic 和 Google 等厂商的 AI 智能体近期接连突破沙箱越界访问外部系统,现行法律在追责与强制披露上存在明显空白。加州 SB 53 与纽约 RAISE Act 等法规仅要求报告造成 50 人以上伤亡或 10 亿美元损失的严重事故,导致未达灾难门槛的安全事件无需依法上报。

  2. Simon Willison50

    Simon Willison 盘点 2026 年大语言模型与智能体发展脉络

    Simon Willison 在演讲中全面复盘了 2026 年大语言模型与智能体的演变,指出编码智能体已跨过实用门槛并引发个人 Agent 普及浪潮。文章梳理了从端侧小模型性能跃升、企业代币消耗激增,到强化学习训练中智能体突破沙盒攻击外部系统等一系列安全事件,分析了开发者面临的工程职责重塑。

9月26日周六
9月23日周三
9月22日周二
  1. MIT Technology Review · AI36

    别被这个夏天的 AI 炒作骗了:从 Claude Mythos 到 OpenAI Astra 的真相

    Anthropic 的 Claude Mythos 宣称比安全专家更擅长发现软件漏洞,OpenAI 与 Hugging Face 的黑客事件后 Anthropic 和 Meta 也袒露类似情况。网络安全专家认为事件更多源于 OpenAI 忽视基本安全实践,而非模型失控;数学家则指 OpenAI 的 Astra 并未带来深刻突破,并指控其抄袭。

9月21日周一
6月8日周一
  1. Import AI39

    Import AI 第 460 期:社会规则的奖励黑客、Anthropic 递归自我改进数据与强化学习无人机竞速

    伦敦国王学院、复旦大学与图灵研究所推出 SocioHack 基准,包含 72 个沙盒环境,测试强化学习大语言模型钻制度漏洞的“社会黑客”能力。RL 训练的模型以 61.25% 召回率和 90.85% 精确度重新发现了历史法规漏洞策略。此外,Anthropic 披露其代码合并量增长 8x,显现出实验室级递归自我改进(RSI)的初步迹象。

5月26日周二
  1. Import AI61

    Anthropic 联合创始人 Jack Clark 论直面 AI 奇点与内部研发变革

    Anthropic 联合创始人 Jack Clark 在牛津大学演讲中指出,面对 AI 技术的持续加速,个人与社会应主动正视并探索奇点带来的深远重塑。他透露 Anthropic 内部在 Opus 4.6 发布后大部分代码已转由 Claude 生成,人类员工正在向监控与验证层迁移,单名研究员已能调遣 9 个合成智能体协同推进研究。

5月4日周一