arrow_back返回日报
2026.07.17DAILY REPORT

Thinky发布975B开源多模态模型Inkling,Apache 2.0许可

20 ·2026.07.17
01 / 发布2026.07.16 14:18

Thinky发布975B开源多模态模型Inkling,Apache 2.0许可

Thinky发布其首个全尺寸LLM Inkling,这是一个975B总参数、41B激活参数的混合专家多模态模型,采用Apache 2.0开源许可,在45万亿tokens上训练。同时发布轻量版Inkling-Small(276B总参数、12B激活参数)。两个模型均支持文本、图像、音频和视频输入。

022026.07.17 04:19

月之暗面发布2.8万亿参数模型Kimi K3,承诺2026年开源

中国AI公司月之暗面发布其最强模型Kimi K3,拥有2.8万亿参数,即日起可通过官网和API使用。公司承诺于2026年7月27日前开源该模型权重,自称是首个“开源3T参数”模型。

032026.07.16 23:35

Mira Murati的Thinking Machines Lab发布首款开源模型Inkling

前OpenAI CTO Mira Murati创立的Thinking Machines Lab发布其首款开源模型Inkling。该模型为975B总参数、41B激活参数的混合专家Transformer,采用Apache-2.0许可,在45万亿tokens(含文本、图像、音频、视频)上训练,支持多模态输入。

04 / 观点2026.07.17 01:01

Replit工程师用AI半年内代码输出量翻三倍,质量不降反升

Replit 发布博客称,过去半年其工程师借助 AI 工具将代码输出量提升了近三倍。与此同时,代码审查时间保持稳定,回退率和生产事故未增加,质量指标反而提升,发布速度加快。这打破了传统认知中“速度与质量不可兼得”的权衡。

05 / 发布2026.07.17 09:00

Vercel Runtime日志新增缓存原因,助你提升命中率

Vercel 在 Runtime 日志中新增了“缓存原因”字段,显示请求未命中缓存的具体原因,例如基于时间或标签的重新验证。开发者可以利用该信息调试缓存未命中问题,优化缓存策略并提升命中率。该功能适用于 CDN 可缓存的所有响应,包括 ISR 和 Partial Prerendering。

06 / 工具2026.07.17 07:34

Firefox被编译成WebAssembly,浏览器里跑浏览器

开发者Puter成功将Firefox/Gecko编译为WebAssembly,使其能在一个浏览器中完整运行另一个浏览器。该项目利用Gecko强大的单进程支持实现了这一壮举。用户可在Chrome中打开一个运行在WebAssembly上的Firefox实例,并正常浏览网页。

07 / 发布2026.07.17 00:00

Google Vids更新:AI生成视频+个人数字分身

Google Vids推出两项更新:Gemini Omni支持AI视频生成,用户可通过文字描述创建、编辑视频;新增个人数字分身功能,用户可创建自己的虚拟形象并“出演”视频,让视频制作更简单快捷。

082026.07.17 00:00

OpenAI为青少年推出更安全的ChatGPT,含家长控制与学习工具

OpenAI 宣布为青少年升级 ChatGPT 安全措施,包括年龄适配的保护机制、学习工具、家长控制功能,并建立了专家合作伙伴关系。旨在让青少年在安全环境中使用 AI 辅助学习,同时让家长能有效监管。

092026.07.17 00:00

Google AI模式支持连接更多第三方应用

Google 宣布其 AI Mode 功能将支持用户安全地连接更多常用应用和服务,并直接在搜索结果中与之交互。用户无需离开搜索界面即可操作已关联的服务,提升了搜索与工作流的整合度。

102026.07.17 04:18

LM Studio发布Bionic:面向开源模型的AI Agent

LM Studio 正式发布 Bionic,一个专为开源模型设计的 AI Agent 产品。用户可在本地或云端运行开源模型,并通过 Bionic 实现自动化任务执行。该产品在 Hacker News 上获得 131 个点赞和 53 条评论。

112026.07.17 01:44

德国AI联盟发布开源模型Soofi S,30B参数登顶中英基准

德国AI联盟(German AI consortium)发布开源模型Soofi S,参数量30B。该模型在英语和德语基准测试中均取得最高分,包含中英双语能力。模型权重已开源,可在Hacker News等平台下载使用。

12 / 研究2026.07.16 12:00

新论文提出自校正耦合马尔可夫跳变过程,实现图像理解与生成同步

arXiv 新论文提出了一种自校正耦合马尔可夫跳变过程(Self-Correcting Coupled Markov Jump Processes),旨在让 AI 系统同时进行图像理解和生成,打破传统“理解”与“生成”分离的范式。受人类教师边讲边画启发,该方法让两种模态相互修正与重塑,模拟人类认知的耦合循环。

132026.07.16 12:00

GFlowRL:用分布匹配RL提升大模型推理多样性

新论文提出GFlowRL方法,将生成流网络(GFlowNets)应用于大语言模型的强化学习训练。与传统奖励最大化不同,GFlowRL通过匹配奖励分布来鼓励模型生成多样化推理路径,避免坍塌到单一最优解,特别适合大推理模型。

142026.07.16 12:00

KV缓存自适应过滤:诊断并纠正LLM推理中的结构角色偏见

一项新研究指出,现有注意力机制驱动的KV缓存压缩方法(如H2O)在处理密集模式输入时存在结构角色偏见,导致关键信息被错误丢弃。研究者提出自适应过滤策略,通过诊断信号能量分布来动态保留重要token,在不增加计算开销的前提下提升长上下文模型的推理准确性。该技术可直接应用于现有主流大语言模型的推理优化。

152026.07.16 12:00

黑盒干预审计:检测LLM思维链是否真的依赖前提

一项新研究提出“干预式基础审计”(Interventional Grounding Audits),这是一种黑盒、步骤级的测试方法,通过替换推理中的谓词来检测大语言模型(LLM)的思维链(CoT)是否真正依赖其陈述的前提。实验发现,许多看似逻辑严密的CoT推理实际上存在“前提漂移”——模型并未真正使用它声称要依赖的假设。该工具可帮助开发者评估LLM推理的可信度与一致性。

162026.07.16 12:00

ShortOPD:短序列蒸馏恢复剪枝LLM的生成能力

一项新研究针对结构化剪枝后大语言模型在自由生成任务上崩溃的问题,提出ShortOPD(Short-to-Long On-Policy Distillation)方法。该方法利用从短到长的在线蒸馏策略,仅用短序列训练即可恢复剪枝模型在长文本生成上的表现。实验表明,在多种生成基准上,被剪枝的LLM经ShortOPD恢复后性能接近甚至超过原模型,而模型体积显著减小。

172026.07.16 12:00

元学习偏好:一种低资源语言的多语言LLM对齐方法

新论文提出一种元学习方法,解决多语言大模型对齐中低资源语言缺乏人类偏好数据的问题。该方法通过从高资源语言中学习偏好元知识,再迁移到低资源语言,显著提升对齐效果,而不依赖大量低资源语言标注数据。

18 / 观点2026.07.16 23:13

6GB显存旧电脑也能训练AI鼓点生成模型

一篇技术教程详细讲解了如何利用一台仅有6GB显存的旧Linux桌面电脑,训练一个生成式AI底鼓(Kick Drum)扩散模型。文章从数据集准备、模型选择到训练优化全流程展开,重点展示了如何通过降低精度和调整参数来突破显存瓶颈。适合预算有限但想入门AI音频生成的独立音乐人和开发者。

19 / 工具2026.07.16 22:57

mermaid-ascii:将Mermaid图表转换为ASCII艺术的新工具

开发者Simon Willison介绍了一个名为mermaid-ascii的开源工具,它能将Mermaid流程图转换为纯文本ASCII艺术图形。该工具基于Go语言实现,相比此前Rust版本的方案功能更完整,已通过Claude进行WebAssembly编译。适合在终端、日志、代码注释等不支持渲染图表的场景下使用。

20 / 观点2026.07.17 04:03

100美元AI MV对决:Claude Fable 5 vs GPT-5.6 Sol

一篇对比评测文章使用100美元预算,通过Claude Fable 5和GPT-5.6 Sol分别生成AI音乐视频,从创意、一致性、画质等维度进行PK。该文在Hacker News上获得92分和102条评论。

chat_bubble对今日内容有什么想法?