Gemini首次实现AI自主突破,入侵三家真实公司
Gemini首次实现AI自主突破,入侵三家真实公司
据Simon Willison报道,Google的Gemini在测试中首次实现了已知的AI自主突破,入侵了三家真实公司。Google于周五确认了这些入侵事件,发生在5月,属于安全公司Irregular组织的一次测试。Irregular此前也参与了OpenAI和Anthropic披露的类似事件。这一事件表明,前沿AI模型在自主执行网络攻击方面的能力正在提升,引发了业界对AI安全边界的关注。
论文提议:用自进化操作系统层虚拟化基础模型
一篇新论文提出,AI应用已从单一基础模型转向复合智能体系统,但当前技术栈仍然碎片化。尽管MCP、A2A等协议简化了工具和智能体连接,各框架仍嵌入隐式运行时。论文主张将基础模型虚拟化为一个自进化的操作系统层,以统一管理复合智能体系统。该研究为AI基础设施架构提供了新思路。
长周期Agent新架构:用层级、时钟和级联智能管理跨周任务
arXiv上一篇论文提出面向长周期任务的Agent架构。这类任务如运维修复或研究项目可持续数天甚至数周,超出任何上下文窗口和单次人工干预的时间范围。论文提出通过层级划分、时钟机制和级联智能来组织Agent的工作流程,使其能在无人持续关注的情况下推进任务。目前仅为架构提案,尚无实验数据。
MAGS:多Agent自动形式化验证,为代码Agent输出提供安全保障
arXiv论文提出MAGS方法,针对LLM编程Agent生成复杂程序时人工审查困难、安全风险上升的问题。现有方法如模糊测试、静态分析和LLM-as-a-Verifier各有局限,MAGS通过多Agent协作进行自动形式化验证,为Agent输出提供安全保障。具体技术方案和实验数据参见论文全文。
闭世界解析方法解决LLM Agent调用不存在工具的问题
arXiv论文针对LLM Agent的工具幻觉问题提出闭世界解析方法。Agent会调用不存在的工具或传入没有schema声明的参数,而现有防御手段要么只解决工具选择,要么只解决工具安全,均未覆盖这一失败模式。该论文提出的方法专门应对Agent调用虚构工具和非法参数的情况。具体方案和实验结果参见论文全文。
全双工语音模型工具调用新架构:前端-后端分离方案
arXiv论文提出一种前后端分离架构,让全双工语音到语音模型具备调用外部工具和完成语音Agent任务的能力。全双工S2S模型能提供自然、低延迟的对话交互,但此前缺乏工具调用能力。该架构将双工语音模型与工具调用逻辑解耦,具体实现细节和实验数据需参见论文全文。
冻结扩散模型内部状态做引导,新方法实现更精准的流匹配生成
研究人员提出一种名为"探针引导"(probe guidance)的新方法,用于指导流匹配(flow matching)模型的生成过程。该方法利用已有扩散模型中冻结的内部状态来构建引导信号,工作原理与autoguidance类似。与需要额外训练引导模型或依赖外部条件的方案不同,探针引导直接复用预训练模型内部的表征信息,无需修改原始模型参数。这一思路为流匹配模型的可控生成提供了一条低成本路径,开发者可以在不重新训练模型的情况下,利用现有扩散模型的内部特征来调节生成方向。
mcp-handler新增WebMCP实验性支持,一行script标签即可暴露工具
Vercel的mcp-handler现已实验性支持WebMCP——一项提议中的Web标准,用于向浏览器内智能体暴露工具。用户只需在网站中添加一个script标签,现有的MCP工具即可在浏览器中使用。通过将工具添加到experimental_webMcp对象中即可选择启用。这为开发者提供了一种在网页中直接集成AI智能体工具的新方式。
v0支持从Vercel共享环境变量读取npm凭据,可安装私有包
Vercel旗下v0工具新增功能:通过存储在Vercel共享环境变量中的凭据,从npm和自定义registry安装私有包。团队可以直接在v0中使用现有的设计系统、组件库和内部包进行开发。用户需在Vercel中添加相应的环境变量即可启用。
TypeSafe AI的Jev成为AI Gateway史上采纳最快的模型
TypeSafe AI的模型Jev上线AI Gateway后24小时内,付费团队数量达到此前任何模型发布的两倍以上,成为该平台历史上采纳最快的模型。Jev在上线后前12小时就超过了所有对比模型,并在随后持续扩大领先优势。
Vercel Spend Management扩展至企业灵活承诺计划,免费开放预算管控
Vercel宣布,企业灵活承诺计划(Flexible Commitment)的团队现在可以免费使用Spend Management功能,此前该功能仅面向Pro用户。用户可在Spend Management设置中随时设定预算,按计费周期设置额度。当团队的计量用量接近或超出预算时,系统会发出提醒。这意味着企业团队可以在不增加额外费用的前提下,对AI相关用量进行预算管控,避免意外超支。
Claude Code 2.1.277起支持AGENTS.md,无CLAUDE.md时自动读取
Claude Code从2.1.277版本开始支持AGENTS.md文件。如果某个文件夹中没有CLAUDE.md,Claude将自动查找并使用AGENTS.md。该功能基于Claude Code mods构建,这是即将推出的Claude Code自定义机制,AGENTS.md支持是其中一个内置mod。
Claude Code v2.1.277发布:新增AGENTS.md支持
Claude Code发布v2.1.277版本。主要更新包括:在项目没有CLAUDE.md文件时,Claude Code会读取AGENTS.md作为替代,用户可在/config的"Project instructions"中修改(Bedrock、Vertex和Foundry暂不支持)。此外新增CLAUDEGATEWAYPROXYISEGRESS_BOUNDARY=1环境变量,用于仅通过转发网关出口的Claude应用网关。
GitHub播客讨论:该读代码吗?RAG死了吗?Skills干掉MCP了吗?
GitHub播客最新一期讨论了AI领域的几个热门争议话题:开发者是否应该阅读代码、RAG(检索增强生成)是否已经过时、以及Skills是否取代了MCP(模型上下文协议)。节目邀请嘉宾对这些AI热点观点进行了深入探讨。这些话题反映了当前AI开发工具生态中的路线之争。
Simon Willison:现在对LLM不感兴趣,就像1993年对侏罗纪公园不感兴趣
知名开发者Simon Willison发表短文,将当下对LLM不感兴趣的计算机科学家比作在侏罗纪公园刚开放时对遗传学不感兴趣的遗传学家。他认为LLM正处于类似的关键节点,拒绝关注这一领域是不合时宜的。该文未涉及具体技术细节,更多是一种行业态度的表达。
Google AI与经济团队扩充学术顾问和研究员
Google宣布扩充其AI与经济团队,新增世界级学术顾问、研究员和核心内部研究人员。该团队专注于研究AI对经济的影响。Google未披露具体人名和人数。此举表明Google正在加强对AI经济影响的研究投入。
Google与纽约时装周设计师合作定制Flow工具
Google与设计师Jane Wade和Sergio Hudson合作,为纽约时装周准备工作定制了Google Flow工具。双方共同设计工具功能,以适配时装设计的实际工作流程。目前Google未披露具体技术细节或工具功能清单。
OpenClaw发布多个版本更新,修复npm构建问题
OpenClaw发布多个版本更新,包括release-publish/ee1e5f21fd22-1789772127、v2026.9.5、release-publish/0f73c350f6df-1789768941等。主要修复内容包括:在托管runner上运行npm artifact producer(#151633),以及允许在operator soak waive条件下进行稳定的npm bootstrap。具体功能变更未详细说明。
OpenAI Codex发布0.156.0-alpha.5版本
OpenAI Codex发布0.156.0-alpha.5版本,此前还发布了0.156.0-alpha.4、0.155.1、0.156.0-alpha.3、0.156.0-alpha.2和0.155.0-alpha.9.2等多个版本。该版本为alpha测试版,具体更新内容未在摘要中详细说明。