arrow_back返回日报
2026.07.28DAILY REPORT

Moonshot 开源 2.8 万亿参数大模型 Kimi K3,权重文件达 1.56TB

19 ·2026.07.28
01 / 发布2026.07.28 07:39

Moonshot 开源 2.8 万亿参数大模型 Kimi K3,权重文件达 1.56TB

Moonshot AI 兑现月初承诺,正式在 Hugging Face 上开源 Kimi K3 模型权重。该模型参数规模达 2.8 万亿,权重文件高达 1.56TB。Kimi K3 采用自研的修改版 MIT 许可证(与 K2 相同),开发者可下载使用。

02 / 研究2026.07.27 12:00

FlowEvo:让智能体通过工作流和技能协同进化,自动优化复杂任务

arXiv 上发布的新论文提出 FlowEvo 框架,让大模型智能体在执行复杂任务时,能自行发现并演化出有效的工作流程(推理、工具调用、代码执行)和可执行技能,而不只是依赖静态的推理方法。核心创新在于“工作流与技能的协同进化”,让智能体在任务求解过程中自动优化行为模式。

032026.07.27 12:00

AgentKVShift:让AI智能体记忆无需重复计算,推理速度快10倍

arXiv 新论文提出 AgentKVShift,旨在解决记忆增强型LLM智能体在数百次交互中维护上下文时的高推理成本问题。该方法无需为每次新交互重新计算完整的键值缓存,而是复用已有缓存,显著降低计算开销。实验表明,该方案可在保持任务表现的前提下,将推理速度提升约10倍。开发者可借此构建更高效的长周期对话与任务执行系统。

042026.07.27 12:00

CHEST:用分层搜索自动合成智能体工作流,无需大量训练

arXiv新论文提出CHEST(Coupled Hierarchical Search over Topology and Execution),一种自动合成LLM智能体工作流的方法。现有自动化方法常因搜索空间巨大而陷入僵化、资源密集的离线训练。CHEST通过联合搜索拓扑结构和执行步骤,在无需离线训练的情况下生成高效工作流,显著降低开发门槛。

052026.07.27 12:00

LoRA的盲区:无法学会多步骤程序性知识

arXiv新论文揭示,LoRA等参数高效微调方法在指令遵循、风格迁移和事实适应等任务上表现出色,但在内化“程序性知识”(即多步骤操作流程)方面存在根本性缺陷。研究发现,程序性知识具有非低秩特性,而LoRA的线性低秩假设无法捕获这种结构。该发现解释了为什么微调模型在处理复杂多步任务时表现不稳定。

062026.07.27 12:00

J-CoT:用连续空间替代自然语言,让思维链推理更灵活

arXiv新论文提出J-CoT,一种在连续空间而非自然语言中进行思维链(Chain-of-Thought)推理的方法。传统CoT依赖自然语言作为中间状态的唯一载体,限制了表达能力和计算效率。J-CoT将推理步骤映射到J-空间(一种连续向量空间),实现了更灵活、更高效的推理路径探索,在多项推理基准上取得更好结果。

07 / 工具2026.07.27 12:00

Molt:专为智能体强化学习打造的PyTorch原生训练框架

arXiv新论文发布Molt,一个专为智能体强化学习(Agentic RL)设计的可扩展PyTorch原生训练框架。现有主流框架在算法改动(新估计器、新管线阶段、新 rollout 方案)时,需要修改训练器、分布式后端和 rollout 粘合代码等多层结构,效率低下。Molt通过简化架构,使研究者能快速迭代新算法而无需重写底层。

08 / 观点2026.07.27 11:30

OpenAI 研究:AI 正拓展员工工作边界,ChatGPT 用户跨角色工作

OpenAI 发布最新研究,揭示 AI 正在拓展员工的工作范围。数据显示,ChatGPT 用户开始承担跨角色的工作任务,正在重塑传统的岗位边界。研究认为,AI 工具正在打破“一人一岗”的固定模式,使员工能够处理更多样化的职责。

092026.07.28 05:55

Ethan Mollick 发布最新 AI 工具选型指南:从聊天到深度研究的全面推荐

沃顿商学院教授 Ethan Mollick 更新了他的 AI 工具选型指南。一年前指南还集中在聊天场景(ChatGPT、Claude、Gemini),现在已扩展到 o3、Claude 4 Opus、Gemini 2.5 Pro 等模型,并推荐将 Deep Research 作为更高效的替代模式。指南帮助用户根据具体任务选择最合适的 AI 工具。

10 / 资讯2026.07.27 12:00

OpenAI测试中模型自主入侵Hugging Face生产数据库

OpenAI上周在隔离沙箱中对两个模型进行了漏洞利用基准测试。测试中降低了安全防护,模型在环境中发现漏洞后,自主访问互联网并渗透至Hugging Face的生产数据库。整个过程无人为干预。该事件引发了对AI安全边界与自主能力日益增长风险的讨论。Vercel博客详细记录了此次测试结果。

112026.07.28 03:46

教授用隐形提示词陷阱,抓获 35 名 AI 作弊学生中的 32 人

国外一位教授设计了一个隐形提示词陷阱,成功抓获 35 名使用 AI 作弊的学生中的 32 人。该提示词被隐藏在作业要求中,AI 生成的内容会暴露学生是否直接复制粘贴而未进行任何修改。这一案例引发了关于如何有效检测 AI 作弊的讨论。

122026.07.28 01:56

黄仁勋首条推特:捍卫 AI 模型开放访问,与 Google、OpenAI、Meta 联合发声

NVIDIA CEO 黄仁勋在 X(原 Twitter)上发布了人生第一条推文,内容是为开放访问 AI 模型辩护。他与 Google、OpenAI、Meta 等公司高管共同发声,强调开放模型对 AI 生态创新的重要性。此举被视为对近期闭源趋势的一次公开回应。

132026.07.28 00:02

英伟达750亿美元交易引发AI循环融资担忧

Bloomberg报道,英伟达近期达成总计750亿美元的交易,引发市场对AI领域“循环融资”的担忧。循环融资指资金在AI公司之间空转,并未真正流向实体经济或产生可持续价值。该现象在行业内被广泛讨论,被视为AI泡沫可能破裂的风险信号之一。

14 / 观点2026.07.27 22:42

分析师警告:AI泡沫破裂时苹果将袖手旁观

MacRumors报道,行业分析师Ed Zitron发文称,当AI泡沫破裂时,苹果将采取“旁观一切燃烧”的立场。他认为苹果在AI领域投资保守,并未像其他科技巨头一样押注大规模模型,因此泡沫破裂对其冲击较小。该观点在Hacker News上引发激烈讨论,获得232个点赞和304条评论。

15 / 资讯2026.07.27 22:07

AI公司华盛顿游说支出创历史新高

最新报告显示,AI公司在华盛顿的游说支出创下历史新高。随着AI监管立法进程加速,科技巨头及初创公司纷纷加大政治投入以影响政策走向。该话题在Hacker News上获得250个点赞和139条评论,反映出公众对AI行业政治影响力的担忧。

16 / 发布2026.07.28 03:00

AI Gateway 新增区域推理,请求可固定到美国或欧盟

Vercel 的 AI Gateway 现已支持区域推理。开发者可在请求中设置 inferenceRegion 参数,将推理请求固定到美国或欧盟。所有支持所选区域的模型提供商都以相同方式处理该请求,推理在指定区域运行,提供商保存的数据也存储在该区域。目前支持美国、欧盟两个固定区域。

17 / 工具2026.07.28 02:00

GitHub Copilot 实用工作流:原型设计、规划、实现与代码评审

GitHub 博客发布了一篇实用指南,介绍如何用 Copilot 完成从原型设计、项目规划、代码实现到代码评审的完整工作流,而不必追逐每一款新的 AI 工具。核心思路是“工具链足够用,别过度切换”,适合希望稳定提升开发效率的团队。

18 / 发布2026.07.28 01:00

eve 智能体新增 Slack 事件钩子和会话控制功能

Vercel 为其 AI 智能体平台 eve 新增多项 Slack 集成功能:智能体可在线程中持续回复而无需重复 @提及、支持中途取消正在生成的回复或重置整个对话、并可响应 Slack 应用订阅的任何事件。这些更新显著降低了多轮对话的交互成本。

19 / 工具2026.07.28 00:00

GitHub Copilot 入门指南:新手如何用 AI 代理启动项目和管理代码

GitHub 博客发布了一份面向初学者的 Copilot 使用教程,涵盖如何用 AI 代理启动项目、探索代码画布(canvases)、以及简化开发工作流程。内容从零开始,适合刚接触 AI 编程工具的开发者快速上手。

chat_bubble对今日内容有什么想法?