每日精选 · DAILY DIGEST

AI 资讯· news

我们从全球信息源中筛选,只把真正重要的发布、研究与产业动向交到你面前。

订阅每日邮件
共 49 篇· 2 / 共 7
16
7月
重点·来源 · x.com·2026/07/16

Thinking Machines 发布 ~1T 全能模型:百万级上下文窗口,多模态训练

Thinking Machines 发布了一款约 1T 参数的全能模型,拥有 1M 上下文窗口,并使用 48T 图像、文本和音频数据进行训练。

16
7月
重点·来源 · x.com·2026/07/16

腾讯发布 295B Hy3 模型:单 GPU 可部署,llama.cpp 可运行

腾讯发布了其旗舰级 295B Hy3 模型的 1 比特和 4 比特版本,该模型可部署在单 GPU 上并与 llama.cpp 兼容运行。

16
7月
趋势·来源 · www.reddit.com·2026/07/16

r/LocalLLaMA 社区探讨 2026 年 7 月最佳本地 VLM

r/LocalLLaMA 社区正在积极讨论并征集 2026 年 7 月份最佳本地视觉语言模型 (VLM) 的推荐,并考虑了实际评估的挑战。

16
7月
趋势·来源 · developers.google.com·2026/07/16

Gemini Code Assist 更新:Gemini 2.5 Pro/Flash 全面可用,代理模式预览,AI 排除文件配置

Google 的 Gemini Code Assist 获得多项更新,包括 Gemini 2.5 Pro 和 Flash 的全面可用、VS Code 中的代理模式预览以及配置 AI 排除文件的功能。

16
7月
趋势·来源 · arxiv.org·2026/07/16

多跳 LLM 代理中消息格式效应的研究

新研究探讨了消息格式如何影响多跳 LLM 代理中继,表明其效应取决于层级,并侧重于忠实性而非纠正性。

16
7月
趋势·来源 · arxiv.org·2026/07/16

研究提出 Toulmin 模型,用于可解释的机器学习诊断辅助

一篇新论文提出利用 Toulmin 论证模型,将机器学习预测转化为结构化、可解释的诊断辅助,尤其适用于基于图像的诊断。

16
7月
趋势·来源 · arxiv.org·2026/07/16

LLM 提示词封装器鲁棒性的格式敏感性指数研究

新研究引入了“格式敏感性指数”,以分析 LLM 基准测试中 token 控制的提示词封装器的鲁棒性和模式合规性,强调格式变化如何显著改变模型得分。

16
7月
趋势·来源 · arxiv.org·2026/07/16

CANDI:面向小众领域问答的上下文对齐研究

一篇新论文介绍了 CANDI,专注于上下文对齐,以提高大型语言模型 (LLMs) 在医疗或金融等小众领域问答中的表现。