跳到正文

#部署/工程

今日 7 条
7月6日周一
6月25日周四
  1. Google Research38

    Google 通过线性弹性缓存优化云经济性

    Google 提出线性弹性缓存(linear elastic caching),将缓存逐出建模为“滑雪租赁问题”,利用轻量级机器学习动态调整缓存生命周期。在 Google Spanner 生产环境集成数月的测试中,该方法使内存占用减少 15.5%,总拥有成本(TCO)降低约 5%,实际 I/O 成本影响仅 0.5%。

6月17日周三
5月27日周三
5月6日周三
  1. Google DeepMind64

    Google DeepMind 展示 AlphaEvolve 一年成果:从 DNA 测序到 TPU 设计

    Google DeepMind 汇总了 Gemini 驱动的编码智能体 AlphaEvolve 发布一年来的落地成果。它帮助 DeepConsensus 将变异检测错误降低 30%,把电网 AC Optimal Power Flow 的可行解比例从 14% 提升到 88%以上,并在量子模拟中给出误差低 10 倍的量子线路。

    推荐理由:一年来 AlphaEvolve 在基因测序、电网、TPU 与量子模拟等场景的落地数据,展示了编码智能体从演示走向基础设施的路径。

4月27日周一
4月22日周三
3月31日周二
  1. Mistral AI65

    Mistral AI 分享 Spaces CLI 设计实践:如何让命令行工具兼顾人类与智能体

    Mistral AI 总结了内部平台工具 Spaces CLI 的开发经验,提出了一套同时适配人类开发者与编码智能体的命令行设计原则。团队提出交互式输入均需提供对应的命令行参数与非交互模式默认值,通过 context.json 和 AGENTS.md 自动导出结构化上下文与执行规则,并消除工作目录等隐式状态依赖,使智能体能自主完成从脚手架创建到部署的全流程。

    推荐理由:文章总结了让命令行工具兼顾人类交互与智能体调用的五条工程规范,为开发者构建面向智能体的开发工具提供了可迁移的落地参考。

3月25日周三
  1. Google Research45

    TurboQuant:通过极致压缩重新定义 AI 效率

    Google Research 推出向量压缩算法 TurboQuant,结合 PolarQuant 极坐标量化与 1-bit QJL 残差纠错技术,在零精度损失的前提下大幅降低 KV cache 内存开销。该算法在 Gemma 和 Mistral 等开源大语言模型上通过了 LongBench、RULER 等长上下文基准评测,在显著压缩 KV 内存占用的同时优化了向量检索效率。

1月22日周四
10月24日周五
  1. Mistral AI56

    Mistral AI 推出企业级生产平台 Mistral AI Studio

    Mistral AI 推出企业级生产平台 Mistral AI Studio,旨在帮助企业打通从提示词开发到稳定生产的全流程闭环,目前已开放 Private Beta 申请。该平台包含可观测性与评测系统、基于 Temporal 构建的高容错 Agent Runtime 以及管理资产与权限的 AI Registry 三大模块,并支持混合云与私有化部署。

6月11日周三
6月4日周三
  1. Mistral AI60

    Mistral AI 推出企业级 AI 编码助手 Mistral Code

    Mistral AI 正式推出面向企业研发团队的 AI 编码助手 Mistral Code,已在 JetBrains 和 VSCode 开放内测。该产品基于开源项目 Continue 构建,由 Codestral、Codestral Embed、Devstral 和 Mistral Medium 四款模型驱动,支持云端或本地隔离环境部署。

    推荐理由:产品采用单一厂商全栈交付模式并支持本地私有化部署,为受合规监管的企业提供了可自主微调的端到端编码方案。

5月7日周三
  1. Mistral AI63

    Mistral 推出 Le Chat Enterprise,由 Mistral Medium 3 驱动

    Mistral 发布 Le Chat Enterprise,一款由全新 Mistral Medium 3 模型驱动的企业 AI 助手,包含企业搜索、Agent 构建器、数据与工具连接器、文档库、自定义模型和混合部署等功能,全部功能将在未来两周内逐步上线。

    推荐理由:Mistral 把企业搜索、Agent 构建与混合部署打包进同一订阅,可观察欧洲厂商做企业 AI 的路线选择。

  2. Mistral AI76

    Mistral AI 发布 Mistral Medium 3 模型

    Mistral AI 正式推出企业级模型 Mistral Medium 3,主打前沿性能与高性价比。该模型在综合基准测试中达到 Claude Sonnet 3.7 90% 以上的表现,并在编码与理科任务中超越 Llama 4 Maverick,API 定价为每 1M token 输入 $0.4、输出 $2。

    推荐理由:原文对比了同代前沿模型的定价与基准表现,并给出了本地四卡及云端部署门槛,适合评估企业级替代方案的成本效益。