arrow_back返回日报
2026.08.25DAILY REPORT

Nexus:同一内存上为Agent模型拼接KV缓存,工具调用提速

15 ·2026.08.25
01 / 研究2026.08.24 12:00

Nexus:同一内存上为Agent模型拼接KV缓存,工具调用提速

Nexus是一种针对MCP协议下Agent大语言模型的优化方法,通过在统一内存上拼接深度自适应KV缓存,并解耦检索与工具路由,大幅缩短了工具调用时的首字延迟。在MCP框架中,模型需要不断重新编码冗长的工具定义,导致预填充计算量随序列长度平方增长,成为主要瓶颈。Nexus直接优化了该过程,适用于工具规模庞大、频繁调用外部API的Agent应用,能显著降低响应等待时间。

022026.08.24 12:00

自我推测加速推理模型,减少延迟

arXiv 论文提出一种自我推测方法:通过让模型预测自己的推理轨迹来加速推理,无需外部草稿模型,尤其适合延迟敏感场景。

032026.08.24 12:00

新方法抑制注意力偏见,提升AI在超长电子病历上的推理能力

电子病历常超过10万token,大模型在处理时存在“lost-in-the-middle”现象,即对长文本中段信息的检索可靠度远低于首尾。研究者提出抑制性注意力机制来刻画和缓解这一问题。在临床长上下文推理任务中,该方法通过调整注意力分配,有效提升了对病历中段关键信息的识别准确率,为AI辅助诊断在真实复杂病历中的应用扫清了一个重要障碍。

042026.08.24 12:00

当干净数据有害:研究发现非独立分布数据破坏学习器的理论前提

经典PAC学习理论假设数据独立同分布,一项新研究揭示,当训练集中混入来自无关甚至敌对源、但标签正确的样本时,这种“干净”但非独立同分布的数据会破坏最优学习器的性能。论文将问题形式化为单调腐蚀下的学习,并分析其对模型泛化能力的影响。该结果提醒研究者,在数据收集和清洗时需关注样本分布,单纯追求标签正确并不足够。

052026.08.24 12:00

神经PDE算子遭“错误物理”后门攻击,数据投毒难被验证察觉

研究人员提出一种针对神经PDE算子的数据投毒攻击方法——跨参数重连。当模型利用可复用的求解器存档进行训练时,攻击者刻意构造“真实”但由错误物理规则生成的数据样本。由于模型验证常依赖于预测误差和与参数无关的合理性检查,这种带有错误物理的后门很难被察觉,可能导致模型解决特定问题时产生灾难性偏差。

062026.08.24 12:00

RLVR奖励模型存在多语言偏见,数学推理训练对非英语不公

研究揭示了强化学习验证奖励(RLVR)中的一个关键问题:当使用回答验证器作为奖励函数训练大模型数学推理时,该验证器被假设为语言无关,但实际上存在跨语言偏见。论文通过基准测试和回滚诊断,确认模型在不同语言上选择正确答案的能力存在瓶颈,即交叉语言选择瓶颈。这导致非英语环境下的训练效果受限。

07 / 资讯2026.08.25 00:11

Vercel:Turborepo缓存命中可防止构建机器降级

Elastic 构建机器现在会考虑 Turborepo 缓存命中来决定是否使用更小的构建机器。暖缓存构建不再触发降级。暖缓存构建比相同冷缓存构建使用更少的 CPU 和内存。基于较低的用量进行降级可能会留下

08 / 工具2026.08.25 04:56

GitHub:自动检查通过不代表alt text可访问

GitHub 博客宣布,为 GitHub 无障碍扫描器构建了一个插件,以确保替代文本真正可访问。该工具可帮助开发者验证自动检查可能遗漏的潜在问题。

092026.08.24 19:38

Linux技巧:把SQLite数据库当可执行文件用

Farid Zakaria 介绍了一种 Linux 模式:通过设置 SQLite 文件格式中 4 字节的应用 ID(文件偏移 68 字节)为 SELF(结构化可执行文件),将 SQLite 数据库文件直接用作可执行二进制文件。

10 / 发布2026.08.25 00:27

llm-anthropic 0.27发布:兼容Anthropic Python库v1.0.0

llm-anthropic 0.27 发布,主要兼容最近发布的 Ananthropic v1.0.0 Python 库,该库从 httpx 切换到 httpx2。OpenAI 在两周前的 v3.0.0 版本中也做了同样的改动。Anthropic 提供了迁移指南。

112026.08.24 20:00

GPT-5.6登陆Kiro,开发者获得更优性价比

OpenAI 宣布 GPT-5.6 现已在 Kiro 中可用,帮助开发者以更好的性价比规划、构建、审查和测试软件。

122026.08.25 07:40

Claude Code v2.1.243:新增循环使用统计与模型选择设置

Claude Code v2.1.243 更新:在 /usage 中添加 Loops 细分(每次循环运行次数、总 token 数、每次运行 token 数及最后运行时间),便于发现失控或繁琐的 /loop 任务;新增 modelPicker 设置,可用有序列表管理 /model 选择器。

132026.08.24 12:40

OpenClaw 2026.8.1-beta.3:支持GPT-5.6及多模型推理

OpenClaw 2026.8.1-beta.3 主要更新:在 OpenClaw 和 Codex 运行时中支持 GPT-5.6 Sol、Terra、Luna 和 Ultra 推理;Control UI 首次运行设置支持 Custodian 验证模型和可选频道设置;新增 Puppeteer 兼容的 CDP 中继,用于配对 Chrome 会话;支持显式外部网关。

142026.08.24 12:00

Vercel Sandbox全球可用,首批四个区域上线

Vercel Sandbox 现已在全球运行,首批覆盖四个区域:iad1(华盛顿)、sfo1(旧金山)、cle1(克利夫兰)和 cdg1(巴黎)。iad1 仍为默认区域。未来将支持所有 Vercel 区域。开发者可选择靠近数据库、对象存储和其他服务的区域。

152026.08.25 06:15

OpenAI Codex发布0.150.0-alpha.8

OpenAI Codex 发布了 0.150.0-alpha.8 版本,属于预发布版本,包含多项更新。

chat_bubble对今日内容有什么想法?