AINews:Opus 5.5 擅长生成讲解视频
AINews 汇总 9/24/2026-9/25/2026 期间消息,指出 Opus 5.5 本周发布后社区反响积极,尤其在生成讲解视频上表现突出。Opus 5.5 以 88.4% 登顶 SimpleBench,被 @skalskip92 评为 Anthropic 迄今最强视觉模型,成本比 Fable 5.1 低约 60%,但弱于 GPT-6 Astra。
AINews 汇总 9/24/2026-9/25/2026 期间消息,指出 Opus 5.5 本周发布后社区反响积极,尤其在生成讲解视频上表现突出。Opus 5.5 以 88.4% 登顶 SimpleBench,被 @skalskip92 评为 Anthropic 迄今最强视觉模型,成本比 Fable 5.1 低约 60%,但弱于 GPT-6 Astra。
xAI 的 Grok 4.7 模型已正式登陆 Amazon Bedrock,提供 500K token 上下文窗口并支持 low 至 xhigh 四档推理强度调节。该模型主打长任务自我验证与代码及专业知识工作,在 Bedrock 上通过跨区域推理配置文件提供服务。调用端兼容 OpenAI SDK 与 AWS Converse API,同时支持隐式提示词缓存和 Bedrock Guardrails。
推荐理由:该集成提供了跨区域推理与四档推理强度控制,开发者可直接在云端现有合规框架内调用长上下文模型。
AI Evaluator Forum 发布第三方 AI 评估基线标准 AEF-1,获 xAI、OpenAI 与 Anthropic 共同签署,规范评估机构的访问权限、利益冲突与透明度。Anthropic 承诺向第三方评估团队开放工位与内部工具等深度权限以核验安全实践;与此同时,业内围绕放缓前沿研发与优先加强工程管控爆发了激烈争论。
牛津大学、英国AI安全研究所、斯坦福大学和伦敦政治经济学院的研究者发现,在涉及18,978段对话、6,923人的四项实验中,AI系统在文本说服上稳定强于人类专家,包括经过数小时结构化训练并有1000英镑奖金激励的精英辩手。