跳到正文
原文
Hugging Face Blog·· 2026-07-16AI 评分48

模型路由并不简单:成本、复杂度与延迟背后的系统优化难题

Model Routing Is Simple. Until It Isn’t.

AI 导读

在 AppWorld Test Challenge 的 417 个任务上,同一 CodeAct 智能体运行 Claude Sonnet 4.6 总成本 79 美元(0.19 美元/任务),而 GPT-4.1 花费 155 美元(0.37 美元/任务),几乎翻倍,原因在于缓存读取定价带来的差异被单纯看价格表的思路忽略了。

来源:Hugging Face Blog · huggingface.co