Hermes Agent接入Vercel AI Gateway,可调用200多个模型
Hermes Agent接入Vercel AI Gateway,可调用200多个模型
Hermes Agent现已支持将Vercel AI Gateway作为推理层,并在Vercel Sandbox微虚拟机中运行代理命令。用户可通过AI Gateway访问200多个模型,token不加价,所有请求都会出现在AI Gateway仪表板中,便于统一监控使用量和费用。对开发者来说,这意味着可以在一个地方管理多种模型调用,同时获得隔离沙箱环境带来的安全性提升。
AMD收购AI推理公司Taalas,推理竞争再升温
AMD收购了AI推理公司Taalas,但未披露交易金额。这是继多家芯片厂商加大推理优化投入后的又一动作。AI推理市场的竞争正在加剧,AMD此举意在强化其在推理芯片领域的布局,与NVIDIA展开更直接竞争。具体产品路线和整合计划尚未公布。
Databricks用AI改写代码,成本降低70%
Databricks通过优化AI编码工具的使用策略,将相关支出降低了70%。该公司在官方博客中分享了具体做法:包括调整模型选择、改进提示词工程、实施缓存和批处理等策略,在不牺牲效率的前提下大幅压缩成本。这一案例显示,通过精细化管理,企业可以在AI工具支出上实现显著节省,而不是简单依赖更贵的模型。
Claude Code v2.1.224:新增自托管环境和归档插件源
Claude Code发布v2.1.224版本,带来两项重要更新:一是新增自托管环境,Team和Enterprise用户可以将自己的机器或容器作为Claude Code会话的运行场所;二是插件支持从HTTPS归档zip直接安装,无需git或npm。这对需要安全、合规运行环境的企业用户尤其有用,可以把Claude Code接入内部基础设施。
新研究:程序脚手架与模型参数协同进化,后训练效果更好
arXiv新论文提出一种后训练方法,将模型参数和推理时的程序化脚手架(procedural scaffolds)协同进化,而非像传统做法那样分别独立设计。该方法旨在让模型在训练阶段就内化复杂的推理流程,减少测试时对外部脚手架的依赖。初步结果显示,这种协同优化策略能让模型自动获取并内化更复杂的技能,但仍需更多验证。
OpenAI黑帽大会演讲披露Hugging Face事件完整时间线
OpenAI在周三的Black Hat安全大会上发表了关于"Hugging Face事件"的压轴演讲,视频已于昨日发布。演讲简短但信息密集,完整披露了事件发生的全部细节和过程。这是OpenAI首次公开回应此前的安全事件,对于关注AI安全和企业级AI部署的开发者来说,值得完整观看以了解事件全貌。
Oracle禁止OpenJDK代码库使用AI生成代码
Oracle已禁止在OpenJDK项目中提交AI生成的代码,尽管其CEO Larry Ellison此前声称Oracle本身并不编写自己的代码。这一政策引发开发者社区广泛讨论,365个点赞和246条评论表明该话题热度极高。此举可能影响Java生态系统的开发流程和AI辅助编程工具的使用。
Woodpecker蒸馏:用弱模型定位强模型推理中的局部错误
arXiv新论文提出Woodpecker蒸馏方法,核心发现是大模型在推理任务中的失败往往源于中间步骤的局部错误,而非整体能力不足。该方法利用弱模型来诊断强模型推理过程中的具体错误位置,为改进大模型推理能力提供了新思路。
QEvict:可恢复的量化KV驱逐方案应对长上下文注意力漂移
arXiv新论文提出QEvict方法,针对自回归大模型推理中KV缓存内存占用过大的问题。传统方法基于注意力分数驱逐不重要的token,但QEvict通过可恢复的量化驱逐策略,有效解决了长上下文解码中的注意力漂移问题,在降低内存消耗的同时保持模型性能。
PPDL:将LLM工作流转化为概率编程,让AI置信度可量化
PPDL框架将基于LLM的应用流程建模为概率程序,使开发者能够获得每次输出的置信度指标,而不仅仅是文本结果。该方法通过概率推理来捕捉LLM输出的不确定性,为构建可靠的LLM应用提供了新的技术路径。对开发者而言,这意味着不再需要盲目信任模型输出,而是可以在关键决策点上依赖置信度数据进行判断与容错设计。
PRISM方法:用多模态数据合成让AI学会识别指令优先级
PRISM是一种通过结构化多模态数据合成训练AI识别指令优先级的方法。当前多模态训练数据往往将复杂指令简化为单一问题,而真实场景下指令常捆绑多个不同权重要求。PRISM通过"评分量规理解"机制(rubric comprehension)帮助模型学会区分哪些需求更重要,提升复杂指令的跟随能力。
新研究:将3D建模与空间推理解耦,不再让两者互相拖累
这篇arXiv论文提出将3D感知与空间推理显式解耦,而不是通过大规模训练隐式地同时获取两者。研究发现,当两个任务被分开处理时,模型在各自的性能上均有提升,而联合训练中一个任务往往会占用另一个任务的模型容量。该范式为空间AI模型的架构设计提供了新思路。
Vercel容器镜像仓库支持公开访问,共享范围扩大
Vercel Container Registry新增公开仓库功能:任何拥有Vercel账号的用户都可以拉取和使用公开仓库中的镜像。此前共享仅限最多100个团队,公开后则对所有Vercel团队开放。公开访问为只读权限,镜像的修改和推送仍由所有者控制。这对需要跨团队分发镜像的开发者来说,共享流程变得更简单。
Vercel Audit Log Drains新增Datadog、Splunk和Panther支持
Vercel的Audit Log Drains功能现已支持将团队审计事件流式传输到Datadog、Splunk和Panther,此前仅支持自定义HTTPS端点和Amazon S3。该功能可转发团队Activity Log中的每个事件及附加审计元数据到指定目标,为开发者提供了更灵活的安全监控和日志分析选项。
HSP GRUPPE借助ChatGPT Enterprise提升税务咨询生产力
OpenAI官方发布案例研究,展示德国税务咨询公司HSP GRUPPE如何将ChatGPT Enterprise整合到日常工作中。该公司通过AI工具提升了生产力、改善了工作质量,并为税务咨询和客户服务创造了更多时间。这是企业级AI在专业服务领域落地的又一实际案例。
开发者用Codex+GPT-5.6复刻Claude Fable 5生成游戏
Simon Willison在周三演示了用Claude Fable 5一次性生成完整游戏"Raccoon Heist"后,决定用Codex + GPT-5.6 Sol Ultra组合挑战同样的任务。他将四年前用GPT-3和DALL-E生成的想法作为前提,测试不同AI工具的代码生成能力对比。
Token开支狂飙:企业争相削减AI成本
Simon Willison引用404 Media六月报道,称埃森哲内部泄露的会议录音显示,该公司发现"从内部数据看,问题不在我们的引擎",暗示Token消耗成本正在失控。越来越多的企业开始重新评估AI支出,寻找降低Token开销的策略。
AI精神病态成为管理层新的盲区
Fast Company文章指出,AI系统的异常行为(被比作"精神病态")正在成为企业领导层忽视的风险。Hacker News上该话题获得159个点赞和102条评论,显示科技从业者对此高度关注。文章呼吁管理者正视AI系统的不确定性,建立更完善的监控和干预机制。
科幻作家Scalzi:生成式AI像吉他英雄,只有假装创造没有真技能
知名科幻作家John Scalzi发表评论文章,将生成式AI比作吉他英雄游戏——看似在演奏,实则是按预设模式运行。他认为当前AI创作工具营造了"创造的幻觉",用户获得的是参与感而非真正的创作能力,文章在Hacker News引发63条讨论。这一观点代表了创作者群体对生成式AI的典型批判视角。
旧金山AI广告牌泛滥引发市民强烈不满
旧金山标准报道称,AI公司的广告牌正在充斥城市街头,被市民批评为"反乌托邦"和"不好笑"。Hacker News上该话题获得32个点赞和62条评论,反映科技社区对此现象也存在分歧。随着AI公司营销预算增加,这种城市视觉污染问题可能进一步加剧。