跳到正文
  1. The Decoder80

    Anthropic 发布 Claude Haiku 5.5,价格大幅下调并同步降低 Sonnet 5.5 缓存读取费用

    Anthropic 发布 Claude Haiku 5.5,这是其迄今最快、最便宜的小模型,平均价格比 Haiku 4.5 低约 75%,10 万 token 以内提示词的价格降幅最高达 90%,超过 10 万 token 的提示词则贵 5 倍。

    推荐理由:Haiku 5.5 的降价幅度与计算机使用、智能体编码基准跃升同时出现,可对照其与 Sonnet 5.5、GPT-6 Luna 的定位差异。

  1. OpenAI News62

    OpenAI 公布前沿模型在数学开放问题上的进展

    OpenAI 发布内部前沿模型在数学开放问题上的新结果,并在 GitHub 上公开 Lean 证明形式化与研究细节。材料仅提供摘要,未给出具体问题、模型名称或结果数据。

    推荐理由:OpenAI 公开内部前沿模型在数学开放问题上的结果与 Lean 形式化证明,可观察 AI 做数学研究的当前边界。

  1. NVIDIA Blog78

    NVIDIA GPU 如何加速 OpenAI GPT-6 Astra Ultrafast

    OpenAI 的 GPT-6 Astra Ultrafast 已在 OpenAI API 上线,并向符合条件的 ChatGPT Work 和 Codex 用户开放,运行在 NVIDIA Blackwell GPU 上。

    推荐理由:原文给出 Ultrafast 模式相对标准模式的加速倍数与开放入口,读者可据此判断它对编码智能体循环的实际影响。

  1. Google DeepMind86

    Google DeepMind 发布 Gemini 4 Argon 前沿模型

    Google DeepMind 发布新前沿模型 Gemini 4 Argon,先通过 Fairwind Program 向受信任的网络安全防御者开放,随后逐步扩展至开发者、企业和消费者。

    推荐理由:官方给出 Gemini 4 Argon 在编码、企业知识与网络安全防御上的基准表现和分阶段开放路径,可据此判断前沿模型的能力边界与获取节奏。

  1. Berkeley AI Research62

    从 CUDA 到 MLX:K-Search 如何把数十年内核经验带到 Apple Silicon

    IBM Research 与 UC Berkeley Sky Lab 将演化式内核搜索框架 K-Search 扩展到 MLX,并新增结构化 CUDA-to-MLX 翻译层,让已有 CUDA 内核作为知识库适配到 Apple Silicon。

    推荐理由:原文给出 CUDA 到 MLX 的翻译层设计与两组内核实测数据,读者可据此判断跨硬件内核迁移的可行路径。

已经到底了