16
7月
重点·来源 · x.com·2026/07/16
Thinking Machines 发布 ~1T 全能模型:百万级上下文窗口,多模态训练
Thinking Machines 发布了一款约 1T 参数的全能模型,拥有 1M 上下文窗口,并使用 48T 图像、文本和音频数据进行训练。
16
7月
重点·来源 · x.com·2026/07/16
腾讯发布 295B Hy3 模型:单 GPU 可部署,llama.cpp 可运行
腾讯发布了其旗舰级 295B Hy3 模型的 1 比特和 4 比特版本,该模型可部署在单 GPU 上并与 llama.cpp 兼容运行。
16
7月
趋势·来源 · www.reddit.com·2026/07/16
r/LocalLLaMA 社区探讨 2026 年 7 月最佳本地 VLM
r/LocalLLaMA 社区正在积极讨论并征集 2026 年 7 月份最佳本地视觉语言模型 (VLM) 的推荐,并考虑了实际评估的挑战。
16
7月
趋势·来源 · developers.google.com·2026/07/16
Gemini Code Assist 更新:Gemini 2.5 Pro/Flash 全面可用,代理模式预览,AI 排除文件配置
Google 的 Gemini Code Assist 获得多项更新,包括 Gemini 2.5 Pro 和 Flash 的全面可用、VS Code 中的代理模式预览以及配置 AI 排除文件的功能。
16
7月
趋势·来源 · arxiv.org·2026/07/16
多跳 LLM 代理中消息格式效应的研究
新研究探讨了消息格式如何影响多跳 LLM 代理中继,表明其效应取决于层级,并侧重于忠实性而非纠正性。
16
7月
趋势·来源 · arxiv.org·2026/07/16
研究提出 Toulmin 模型,用于可解释的机器学习诊断辅助
一篇新论文提出利用 Toulmin 论证模型,将机器学习预测转化为结构化、可解释的诊断辅助,尤其适用于基于图像的诊断。
16
7月
趋势·来源 · arxiv.org·2026/07/16
LLM 提示词封装器鲁棒性的格式敏感性指数研究
新研究引入了“格式敏感性指数”,以分析 LLM 基准测试中 token 控制的提示词封装器的鲁棒性和模式合规性,强调格式变化如何显著改变模型得分。
16
7月
趋势·来源 · arxiv.org·2026/07/16
CANDI:面向小众领域问答的上下文对齐研究
一篇新论文介绍了 CANDI,专注于上下文对齐,以提高大型语言模型 (LLMs) 在医疗或金融等小众领域问答中的表现。