分层稀疏注意力新方法HSA-D,实现无限上下文建模
分层稀疏注意力新方法HSA-D,实现无限上下文建模
arXiv 新论文提出分层稀疏注意力(HSA-D),解决了LLM处理长文本时计算成本高和长度外推差的问题。通过改进的分块稀疏注意力机制,该方法在保持线性计算复杂度的同时,实现了无限上下文建模。与现有稀疏注意力方法不同,HSA-D在效率和效果上达到了更优平衡,为长文档理解、代码生成等场景提供了新思路。
Oyster-II:用强化学习让LLM既安全又有用
arXiv新论文提出Oyster-II,一种通过强化学习实现LLM建设性安全对齐的方法。不同于传统拒绝式对齐策略(直接拒绝不安全请求),Oyster-II在保证安全的同时维持模型的有用性和可信度。该方法旨在解决安全对齐中常见的“过度拒绝”问题,让模型能更聪明地处理敏感问题,而非简单一刀切。
混合块扩散语言模型:并行生成长文本,速度提升
arXiv新论文提出混合块扩散语言模型(Hybrid Block Diffusion LM),结合部分双向性,实现长文本的高吞吐量生成。传统自回归模型逐token生成受限于内存带宽,而该方法通过并行解码显著提升速度。实验表明,在保持生成质量的同时,长上下文生成的吞吐量大幅提高,适合文档生成和代码合成等场景。
Google发布Gemma 4技术报告,支持密集与MoE架构
Google发布Gemma 4技术报告,介绍新一代开源权重、原生多模态语言模型。Gemma 4系列包含密集(Dense)和混合专家(MoE)两种架构,旨在提升计算效率和推理能力。具体性能指标尚未公开,但该报告展示了Gemma系列在可访问性和性能方面的持续进展。
GitHub Q1 2026报告:全球开源协作加速增长
GitHub发布2026年第一季度创新图更新数据,显示全球开发者社区增长速度创历史新高,多个经济体的协作达到新水平。报告基于GitHub平台数据,反映了开源生态系统的持续繁荣。
AI发现Cloudflare Circl密码库中的安全漏洞
一篇博客文章揭示了AI在Cloudflare的开源密码学库Circl中发现了安全漏洞。通过自动化分析,AI工具识别出潜在缺陷,这些缺陷可能影响依赖该库的加密通信安全性。该发现强调了AI在代码审计和漏洞挖掘中的实用价值,并提醒开发者关注密码学实现的细节问题。
RPA公司CEO谈AI自动化:正在吃掉自己的产品
一篇来自 Replicated 公司的深度文章讨论了AI自动化带来的反身性效应:随着AI能力增强,它正在自动化许多原本提供自动化的公司的核心业务。文章反思了当AI能自动生成代码、配置和管理系统时,传统的RPA和自动化工具本身面临被替代的风险。
美国财政部内部报告警告AI泡沫风险
据Notus报道,美国财政部有一份内部报告,警告人工智能领域存在泡沫风险。该报告尚未公开全文,但在Hacker News上引发广泛讨论(42 points,19条评论)。报告内容可能涉及AI投资过热、估值虚高等问题。
Hacker News热议:别让你的AI笔记应用毁掉真实交流
一篇题为《我恳求你放下AI笔记工具》的文章在Hacker News引发激烈讨论,获得53分和87条评论。作者批评AI笔记应用在会议、对话中的侵入性,认为它们破坏了人与人之间的真实连接和信任。评论区观点两极分化,支持者认为保护隐私和真实性很重要,反对者则认为AI工具提高了效率。
eve上线Chat SDK适配器,一键接入Facebook Messenger和WhatsApp
Vercel旗下AI代理平台eve推出新的Chat SDK通道,支持通过适配器接入Facebook Messenger、WhatsApp、Resend、Liveblocks等多个平台。开发者只需编写标准的Chat SDK处理代码,调用send即可将消息传递至AI代理。该更新大幅降低了将eve集成到现有聊天渠道的门槛。
Chat SDK接入Vercel Connect,简化机器人凭据管理
Vercel宣布Chat SDK新增对Vercel Connect的支持,开发者可通过该功能管理机器人凭据,无需自行存储或轮换令牌和签名密钥。新提供的@vercel/connect/chat子路径内置了Slack、GitHub和Linear的适配器,每个适配器接受连接器UID并返回可直接在Chat SDK中使用的配置。
Vercel Chat SDK集成Dial,支持短信和iMessage
Vercel Chat SDK 新增 Dial 适配器,开发者现在可以用真实电话号码构建能收发短信、彩信和 iMessage 的机器人。支持双向媒体传输和呼入语音通话转录。回复使用标准 Chat SDK 线程和消息 API,并通过 HMAC 验证的 webhook 确保安全。该更新简化了多渠道通信机器人开发流程。
Vercel Chat SDK集成Photon,支持iMessage群聊
Vercel Chat SDK 新增 Photon 适配器,开发者可以构建能收发 iMessage 的机器人,支持直接私聊和群聊、媒体分享以及原生 Tapback 反应。该适配器可部署在 Spectrum Cloud、自有服务器或 Mac 上。每个 Photon 会话成为一个 Chat SDK 对话,简化了 Apple 生态消息机器人的开发。
GitHub-Code Web组件:直接嵌入GitHub代码片段
Simon Willison 开源了一个实验性 Web 组件 github-code,能直接将 GitHub 仓库中的代码文件嵌入到网页中。该组件将 GitHub URL 自动转换为 raw.githubusercontent.com 的原始内容并渲染。基于 GPT-5.5 辅助生成,适合开发者快速在博客或文档中展示代码示例,无需手动复制粘贴。
sqlite-utils 4.0发布,新增数据库schema迁移功能
Simon Willison发布sqlite-utils 4.0,这是该项目的第124个版本,也是自2020年11月3.0以来的首个大版本更新。除了少量破坏性变更外,新版本引入三大核心功能:数据库迁移、以及改进的schema管理。升级指南已提供。
Vercel新增项目级活动日志,更方便审计追踪
Vercel 更新了项目管理功能,现在可以在项目设置中查看项目专属的活动日志。该日志只显示该项目相关的用户事件,无需再跳转到团队设置中查看全局日志。这一改进让开发者和管理员能更高效地审查特定项目的变更历史,提升协作透明度。
主动思考机制让LLM对话更及时自然,减少等待延迟
新研究提出主动思考方法(Proactive Thinking),让大型语言模型在对话中提前进行思考推理,而不是被动等待用户回复后才开始推理。该方法旨在减少响应延迟,使对话更及时自然。论文发布于arXiv。
稀疏残差路由:用更少计算量实现更准确的天气预报
新研究提出稀疏残差路由(Sparse Residual Routing),改进基于ViT的天气预报模型。传统模型对所有空间token进行统一计算,而该方法利用大气网格点间的相似性,减少冗余计算,用更少token实现更优预测。论文发布于arXiv。
Fable模型发布后市场趋于平静,行业正在消化影响
Latent Space简报称,在Fable模型发布后,AI行业迎来一个相对平静的交易日。业内正在消化这一迄今为止最重要的模型发布所带来的影响。未披露具体技术细节或市场数据。
Ben's Bites作者谈Fable:我想要一个更好的测试框架
Ben’s Bites博主发表对Fable模型的个人看法,表示更关注如何构建合适的测试和评估框架(harness)来有效利用该模型。未涉及具体技术细节或性能评价。