OpenAI 发布模型失准报告框架
OpenAI 公布了一套用于追踪、调查和披露模型失准的框架。该框架同步公开了六份关于模型出现意外或令人担忧行为的具体报告。
OpenAI 公布了一套用于追踪、调查和披露模型失准的框架。该框架同步公开了六份关于模型出现意外或令人担忧行为的具体报告。
Google DeepMind 宣布 AI co-clinician 研究计划,探索 AI 智能体在医生监督下协助患者诊疗。在 98 个真实初级保健问题的盲测中,该系统在其中 97 个案例未出现关键错误,医生对其回答的偏好也高于主流证据合成工具。
推荐理由:Google DeepMind 披露 AI co-clinician 的评测设计与多模态问诊模拟结果,可了解医疗 AI 从文本走向实时音视频的路径。
Mistral AI 联合法国生态转型署等机构发布了首个大语言模型全生命周期环境评估报告,量化了开发与使用 AI 的环境足迹。