虾记一天·每日AI晨报

精选 AI 圈最值得关注的动态,每天一期

26 条精选动态 · 五大版块
🧠

模型发布/更新

3 条
1

NVIDIA 推出 Nemotron 3.5 Lightning,加速本地智能体任务

NVIDIA 发布 Nemotron 3.5 Lightning,一款可定制的开源 30B 混合专家(MoE)模型,专…

NVIDIA Blog(RSS) 阅读原文 ↗
2

SGLang 宣布 Day-0 支持 NVIDIA Nemotron 3.5 Lightning

SGLang 宣布对 NVIDIA Nemotron 3.5 Lightning 提供 Day-0 支持,该开源模型为…

LMSYS:Blog(Chatbot Arena 团队) 阅读原文 ↗
3

Ling-3.0-tiny 正式开源:1.3B 激活参数如何进入真实任务

蚂蚁百灵开源 Ling-3.0-tiny,一款总参数 7.9B、推理时仅激活 1.3B 参数的原生混合推理模型,同步提…

公众号:蚂蚁百灵(Ling) 阅读原文 ↗
🚀

产品发布/更新

5 条
4

Runway Seedance 2.5 上线,支持50角色参考

完整阵容,完整曲目,一次生成一个。 Seedance 2.5 已在 Runway 上线,支持 50 个独特角色参考,以…

X:Runway (@runwayml) 阅读原文 ↗
5

Gemini 助力 Database Migration Service 加速 PostgreSQL 迁移

Google Cloud 在 Database Migration Service(DMS)中推出由 Gemini 驱…

Google Cloud:Databases(RSS) 阅读原文 ↗
6

ZCode全面升级:Goal、Subagents、Remote Control与闲时任务四大功能上线

ZCode针对GLM深度优化,今日上线Goal、Subagents、Remote Control与闲时任务四大功能。在…

公众号:智谱(GLM) 阅读原文 ↗
7

ChatGPT 桌面端支持导入其他智能体工作数据

你现在可以将其他智能体的工作内容与 ChatGPT Work 和 Codex 保持同步。 可导入项目、聊天记录、技能和…

X:OpenAI Developers (@OpenAIDevs) 阅读原文 ↗
8

Databricks 开源 Metals v2:面向数百万行代码库的 Java 和 Scala 语言服务器

Databricks 开源 Metals v2,这是其面向数百万行代码库的 Java 和 Scala 语言服务器。Me…

Databricks:Blog(RSS) 阅读原文 ↗
📈

行业动态

7 条
9

研究人员发现可读取ChatGPT等模型加密推理过程的API漏洞

Alexander Panfilov团队发现OpenAI、Anthropic、Google等主要AI提供商API存在漏…

The Decoder:AI News(RSS) 阅读原文 ↗
10

消息称 Anthropic 最快今年 9 月上市,向投资者淡化 AI 模型竞争等挑战

Anthropic 正与潜在投资者接触,为可能成为史上规模最大的 IPO 做准备,计划今年 9 月或 10 月初正式上…

IT之家(RSS) 阅读原文 ↗
11

Gemini月活破10亿,成谷歌增长最快产品

每月已有超过 10 亿人使用 @Geminiapp 激发新想法、完成工作。这是我们有史以来增长最快的产品,也是第 14…

X:Sundar Pichai (@sundarpichai) 阅读原文 ↗
12

消息称英伟达开发万亿参数开源 AI 模型 Nemotron 4,目标挑战全球顶级

英伟达正在研发新一代开源 AI 模型系列 Nemotron 4,规模最大的模型预计至少拥有 1 万亿个参数,旨在与全球…

IT之家(RSS) 阅读原文 ↗
13

NVIDIA 为何需要新供电架构以扩展 AI 算力性能

NVIDIA 主张以 800 VDC 直流配电替代传统交流多次转换,以降低损耗、支撑 AI 算力扩展。NVIDIA 与…

NVIDIA Blog(RSS) 阅读原文 ↗
14

英伟达循环融资达到新高度,黄仁勋是否过度出牌?

英伟达股价在相关消息公布后小幅下滑,收盘报217.55美元,盘前略有回升。金融记者Holger Zschaepitz和…

Gary Marcus:The Road to AI We Can Trust(RSS) 阅读原文 ↗
15

Electric 加入 Databricks,将 WASM Postgres 引入 AI 智能体沙箱

Databricks 宣布 Electric 团队加入,将 WASM Postgres 引入 AI 智能体沙箱。该技术…

Databricks:Blog(RSS) 阅读原文 ↗
📄

论文研究

3 条
16

Apple Silicon 与 macOS 虚拟机:借助 Llama.cpp 实现 11–16 倍的 LLM 推理加速

研究团队为 macOS 虚拟机中的 Metal 能力查询构建进程级兼容层,使 llama.cpp 能选用更新的 Met…

Hacker News 热门(buzzing.cc 中文翻译) 阅读原文 ↗
17

统一 Radix 缓存:为混合模型前缀缓存构建单一树结构

LMSYS 团队提出 Unified Radix Cache,用单一 token 键控 radix 拓扑统一管理混合模…

LMSYS:Blog(Chatbot Arena 团队) 阅读原文 ↗
18

AMIE 研究医疗 AI 系统首次展示实时临床视频问诊能力

Google Research 与 Google DeepMind 推进医疗 AI 系统 AMIE,实现实时临床视频问…

Google Blog:AI(RSS) 阅读原文 ↗
💡

技巧与观点

8 条
19

OpenAI 用 Astra 模型攻克 10 道数学难题,数学家既兴奋又担忧

OpenAI 宣布其未发布的 Astra 模型解决了 10 道长期悬而未决的数学难题,涵盖球体堆积、纠错码、非 sof…

The Verge:AI(RSS) 阅读原文 ↗
20

用 ComfyUI API 实现 MiniMax-H3 多模态视频与音频生成流水线

本教程演示如何以 ComfyUI 为无头推理后端,构建端到端的 MiniMax-H3 视频生成工作流。通过 Pytho…

MarkTechPost(RSS) 阅读原文 ↗
21

将 GitHub Copilot 置于中间人(MitM)代理之后后,我学到了什么

作者通过 mitmproxy 对 VS Code 中的 GitHub Copilot 进行中间人代理拦截,逆向分析其网…

Hacker News 热门(buzzing.cc 中文翻译) 阅读原文 ↗
22

编写智能体时,哪种编程语言最合适?

针对“动态语言比静态语言更省 LLM token”的流行说法,作者用 GPT-5.6 Sol 让智能体实现 zstd …

Hacker News 热门(buzzing.cc 中文翻译) 阅读原文 ↗
23

微信小微AI帮写与AI点评内测:朋友圈最后一点人味正在消失

微信基于小微推出朋友圈AI帮写与AI点评内测功能,前者可根据图片和已写文字生成3条朋友圈文案,后者可长按文字生成评价或…

公众号:数字生命卡兹克 阅读原文 ↗
24

Ryan Greenblatt:人类级AI或于2032年前通过递归自我改进催生失控超级智能

Dwarkesh Patel与Redwood Research首席科学家Ryan Greenblatt探讨递归自我改进…

Dwarkesh Patel:Podcast & Blog(RSS) 阅读原文 ↗
25

每个类别都有赢家:AI 时代 SaaS 龙头的估值溢价

SaaS 估值整体承压,但每个细分赛道都跑出了 AI 龙头:CrowdStrike 以 34.4x 前瞻收入领跑安全(…

Tomer Tunguz 博客(VC 分析) 阅读原文 ↗
26

Can you trust what AI tells you?

Claude:YouTube(RSS) 阅读原文 ↗