04
10月
重点·来源 · github.com·2026/10/04
Claude Code v2.1.287 发布,引入插件深度修改和“You Should Know”代理
Claude Code 发布 v2.1.287 版本,新增了“Claude Mods”功能以支持插件更深层的行为修改,并推出了内置的“You should know”旁观代理来提醒用户或 Claude 可能遗漏的信息。
04
10月
重点·来源 · github.com·2026/10/04
llama.cpp b11390 版本发布,修复 CUDA MMQ 内存故障
llama.cpp 在 b11390 版本中修复了一个关键的 CUDA MMQ 内存故障,该故障发生在 `n_expert` 远大于 `n_ubatch` 的情况下。
04
10月
重点·来源 · github.com·2026/10/04
vLLM v0.31.0rc3 发布,Model Runner V2 支持随机虚拟输入
vLLM 的 v0.31.0rc3 版本更新,为 Model Runner V2 引入了对随机虚拟输入的支持,且 Claude Opus 5.5 被列为共同作者之一。
04
10月
重点·来源 · x.com·2026/10/04
llama.cpp 现已通过 `/v1/systemone` 端点支持决策模型
Georgi Gerganov 宣布,llama.cpp 现已集成决策模型,通过 `/v1/systemone` 端点可实现本地、高效且私密的 Jev 风格推理。
04
10月
重点·来源 · x.com·2026/10/04
DeepSeek-V4-Pro API 七五折优惠,Claude Code 集成支持 1M 上下文
DeepSeek-V4-Pro API 推出至2026年5月的七五折优惠,并宣布了集成更新,包括在 Claude Code 中将模型设置为 `deepseek-v4-pro[1m]` 可解锁 1M 上下文。
04
10月
重点·来源 · x.com·2026/10/04
Agent Arena 成本效益榜:Kimi K3 (Max) 表现突出
Arena.ai 的分析显示,在 Agent Arena 的顶级模型中,Kimi K3 (Max) 的成本效益最佳,其任务中位成本显著低于 Claude Opus 5.5。
04
10月
重点·来源 · x.com·2026/10/04
Arena.ai 在 Agent Arena 中引入帕累托前沿分析
Arena.ai 在 Agent Arena 中推出了帕累托前沿功能,允许用户比较模型在实际代理任务中的性能与任务中位成本,其中 Claude Opus 被列为前沿模型之一。
04
10月
重点·来源 · github.com·2026/10/04
Ollama v0.35.1-rc0 发布,新增显式模型能力支持
Ollama 在 v0.35.1-rc0 版本中新增了对显式模型能力的支持,允许在 Modelfiles 和请求中声明 `CAPABILITY`,并扩展到 GGUF 和 safetensors。