每日精选 · DAILY DIGEST

AI 资讯· news

我们从全球信息源中筛选,只把真正重要的发布、研究与产业动向交到你面前。

订阅每日邮件
共 23 篇·第 2 / 共 3 页
04
10月
趋势·来源 · developers.google.com·2026/10/04

Gemini Code Assist 更新 Agent 模式,支持 AI 排除文件与聊天代码建议

Google 宣布 Gemini Code Assist 推出多项更新,包括在 VS Code 插件中支持 Agent 模式,允许用户通过 `.aiexclude` 和 `.gitignore` 文件配置 AI 排除范围,并改进了聊天代码建议的预览显示。

04
10月
趋势·来源 · www.reddit.com·2026/10/04

Reddit 热议:Strata 推理引擎受关注,性能优化引发社区讨论

Reddit 社区围绕 Strata 推理引擎的性能表现展开热烈讨论,表明该类高度优化的本地推理解决方案正获得开发者社区的广泛认可。

04
10月
趋势·来源 · www.reddit.com·2026/10/04

Reddit 社区关注 Aleph-Alpha Kolibri-1 模型:78B 参数,支持 1M 上下文

Reddit r/LocalLLaMA 社区讨论了 Aleph-Alpha 发布的 Kolibri-1 模型,该模型拥有 78B 参数,但实际激活参数为 3.46B,并支持高达 1M token 的上下文长度,采用 Apache 2.0 许可。

04
10月
趋势·来源 · www.reddit.com·2026/10/04

独立开发者发布 Ninfer 4080,优化 16GB 显存 GPU 的 LLM 推理

一位独立开发者发布了 Ninfer 4080 项目,旨在优化 RTX 4080 等 16GB 显存 GPU 上的 LLM 推理性能,成功在 100k 上下文下运行 Qwen-3.8-27B-GSQ,达到 2720 tok/s 预填充和 262 tok/s 生成速度。

03
10月
趋势·来源 · www.reddit.com·2026/10/03

本地LLM爱好者幽默吐槽:钱包与睡眠正被“掏空”

r/LocalLLaMA 社区一位用户幽默地分享了其深入本地 LLM 实验所付出的巨大金钱和时间成本,显示出高昂的投入。

03
10月
趋势·来源 · www.reddit.com·2026/10/03

iPhone 变身 MacBook 副 GPU,加速 Qwen 3.8 27B 预填充

一位用户成功将 iPhone 用作 MacBook 的第二块 GPU,使 Qwen 3.8 27B 模型的预填充速度提升了29-44%,并能分担部分上下文窗口。

03
10月
趋势·来源 · developers.google.com·2026/10/03

Gemini Code Assist 更新:Gemini 2.5 GA,代理模式与代码建议

Gemini Code Assist 迎来多项更新,包括 Gemini 2.5 Pro 和 Flash 模型普遍可用,VS Code 代理模式及聊天代码建议预览功能改进。

03
10月
趋势·来源 · www.reddit.com·2026/10/03

Aleph-Alpha 发布 Kolibri-1:78B 参数,1M 上下文,Apache 2.0 许可

Aleph-Alpha 在 Hugging Face 上发布了 Kolibri-1,这是一款拥有 78B 参数(3.46B 活跃)、支持高达 1M 令牌上下文的开源模型,采用 Apache 2.0 许可证。