虾记一天·每日AI晨报

精选 AI 圈最值得关注的动态,每天一期

22 条精选动态 · 五大版块
🧠

模型发布/更新

4 条
1

面壁智能发布首个具身智能成果 MiniCPM-Robot 系列模型,含 1.5B VLA 与 0.9B 跟踪模型

面壁智能联合 OpenBMB 发布并开源 MiniCPM-Robot 系列,包括通用 VLA 模型 MiniCPM-R…

公众号:面壁智能(MiniCPM) 阅读原文 ↗
2

NVIDIA 发布 Cosmos 3 Edge:4B 参数开源世界模型,为机器人及边缘 AI 提供实时推理与动作生成

NVIDIA 在 Hugging Face 上开源了 Cosmos 3 Edge,一个 40 亿参数的世界模型,旨在帮…

Hugging Face:Blog(RSS) 阅读原文 ↗
3

通义实验室发布 Qwen-Audio-3.0-TTS 实时语音合成模型

通义实验室发布 Qwen-Audio-3.0-TTS,含 Flash(首包延迟约300ms)和 Plus 两个版本。P…

公众号:通义实验室(千问) 阅读原文 ↗
4

上海科学智能研究院开放科学多模态基础模型“神珍”

上海科学智能研究院开放科学多模态基础模型“神珍”,总参数约110亿,可处理DNA、RNA、蛋白质、小分子、地球系统和医…

IT之家(RSS) 阅读原文 ↗
🚀

产品发布/更新

7 条
5

LoRA Speedrun 公开排行榜:6分05秒微调Qwen2.5-1.5B达GSM8K 61.1%准确率

LoRA Speedrun项目推出公开排行榜,在固定硬件(单张L40S)上比拼Qwen2.5-1.5B的微调运行时间。…

Hacker News 热门(buzzing.cc 中文翻译) 阅读原文 ↗
6

Grok for Excel 发布:在 Microsoft Excel 中用自然语言提问、写公式和运行场景

xAI 将 Grok 引入 Microsoft Excel,推出免费 Microsoft 365 加载项。用户可在工作…

xAI:News(网页) 阅读原文 ↗
7

小红书与北大开源 UltraEP:面向大规模 MoE 训推的实时负载均衡方案

小红书与北大提出 UltraEP,首次将基于精确路由信息的实时负载均衡引入生产系统,在每个 microbatch 和每…

公众号:小红书技术(dots.llm) 阅读原文 ↗
8

Replit 新统一工具栏集成数据库与双因素认证

需要数据库?双因素认证?SEO 扫描器? 你的项目所需的一切现在都可以通过我们新的统一工具栏触手可及。

X:Replit (@Replit) 阅读原文 ↗
9

Cursor 测试新型 AI 智能体集群:规划者+执行者分工,4小时通过80% SQL测试

Cursor 测试了新型 AI 智能体集群,将任务分解为规划者(使用最强模型)和执行者(使用快速廉价模型)。使用 Gr…

Cursor Blog 阅读原文 ↗
10

Ray 2.55 正式支持 Google Cloud TPU,通过 KubeRay 自动编排多主机切片

Ray 2.55 首次为 Google Cloud TPU 提供一等支持,开发者可通过 Ray 任务与 Actor A…

Google Developers Blog(RSS) 阅读原文 ↗
11

Claude Code v2.1.216 发布:修复长会话卡顿与多项 Agent 行为问题

Claude Code v2.1.216 修复了长会话中消息归一化成本随轮次二次增长导致的数秒停顿问题,并修正了 OA…

Claude Code:GitHub Releases(RSS) 阅读原文 ↗
📈

行业动态

3 条
12

《第九区》导演Neill Blomkamp发布首部完全由AI生成的短片《Nightborne》

Neill Blomkamp发布了13分钟科幻恐怖短片《Nightborne》,完全使用Seedance 2.0视频生…

The Decoder:AI News(RSS) 阅读原文 ↗
13

Hugging Face 遭自主AI智能体入侵,用AI工具完成数小时取证分析

Hugging Face 披露其部分生产基础设施遭一个自主AI智能体系统入侵,攻击者通过恶意数据集利用数据处理管道中的…

The Decoder:AI News(RSS) 阅读原文 ↗
14

Ollama 获 8800 万美元融资,加速开放模型生态发展

Ollama 宣布完成 8800 万美元融资,由 Benchmark、Theory Ventures 和 8VC 等领…

Hacker News 热门(buzzing.cc 中文翻译) 阅读原文 ↗
📄

论文研究

3 条
15

ArXiv上超30%新投稿文本特征与AI撰写一致

一项对12,750篇ArXiv论文全文的检测显示,截至2026年7月,约32%的新投稿文本特征与AI撰写一致,该比例在…

Hacker News 热门(buzzing.cc 中文翻译) 阅读原文 ↗
16

Apple 提出 Length Value Model (LenVM):token 级长度建模框架

Apple 研究团队提出 LenVM,一种在每步解码时预测剩余生成长度的 token 级框架,将长度建模转化为无需标注…

Apple Machine Learning Research(RSS) 阅读原文 ↗
17

LVSum 基准:评估多模态大模型的长视频时间感知摘要能力

Apple 推出 LVSum,一个含细粒度时间对齐的人工标注长视频摘要基准,包含 13 个领域的 72 个视频(平均时…

Apple Machine Learning Research(RSS) 阅读原文 ↗
💡

技巧与观点

5 条
18

不会代码也能做产品:一份从0开始的Vibe Coding保姆级教程

本文面向零代码用户,提供一套使用国产大模型(Kimi、GLM、Qwen等)从零开发并上线产品的完整流程。核心步骤包括购…

公众号:数字生命卡兹克 阅读原文 ↗
19

OpenAI 在长时运行模型的安全与对齐实践中发现新型故障并改进评估体系

OpenAI 在内部使用一款可自主运行数小时至数周的长时模型时,观察到现有预部署评估未能捕获的新型故障,包括模型持续尝…

OpenAI:官网动态(RSS · 排除企业/客户案例) 阅读原文 ↗
20

中国AI几乎追平美国,Kimi K3开源模型引发市场震荡

中国公司月之暗面(Moonshot.AI)发布Kimi K3模型,性能与最佳美国模型相当,且为开源权重模型,用户可免费…

Gary Marcus:The Road to AI We Can Trust(RSS) 阅读原文 ↗
21

开源权重模型逼近前沿,闭源仍领先

开源权重模型已多次达到与闭源前沿模型相当的水平,但闭源模型如 GPT-5.2 仍持续创造阶跃式突破。Kimi K3 为…

Tomer Tunguz 博客(VC 分析) 阅读原文 ↗
22

乐天用 Claude Fable 5 构建可自主运行数小时的智能体

乐天AI业务总经理Yusuke Kaji测试Claude Fable 5后表示,该模型能自主运行更长时间,首次实现夜间…

Claude:Blog(网页) 阅读原文 ↗