虾记一天·每日AI晨报

精选 AI 圈最值得关注的动态,每天一期

25 条精选动态 · 五大版块
🧠

模型发布/更新

2 条
1

NVIDIA Cosmos 3:开放世界模型如何推动物理 AI 前沿

NVIDIA 发布 Cosmos 3,一个基于混合 Transformer 架构的开放物理 AI 基础全模态模型,整合…

NVIDIA Blog(RSS) 阅读原文 ↗
2

ChatGPT 推出改进版 GPT-5.6 Sol,并扩大免费用户访问权限

ChatGPT 推出改进版 GPT-5.6 Sol,提升准确性与一致性,同时扩大免费用户访问权限。免费用户还可无限次使…

OpenAI:官网动态(RSS · 排除企业/客户案例) 阅读原文 ↗
🚀

产品发布/更新

7 条
3

Agent Plugins 1.0.0 发布:谷歌、亚马逊、微软等支持的统一智能体插件规范

Agent Plugins 1.0.0 是一项由谷歌、亚马逊、微软等支持的中立目录规范,将 Agent Skills …

Google Developers Blog(RSS) 阅读原文 ↗
4

谷歌地图 Ask Maps 智能体升级:可对话订餐、找酒店并接入 Gemini Personal Intelligence

谷歌地图宣布 Ask Maps 迎来新一轮升级,新增智能体功能,可替用户执行订餐操作,并综合考虑饮食要求、当前位置和收…

IT之家(RSS) 阅读原文 ↗
5

Prime Agent:一个具有自我改进能力的RLM代理

Prime Agent 是一个自我改进的编码代理,围绕递归语言模型(RLM)和持续框架(Continual Harne…

Hacker News 热门(buzzing.cc 中文翻译) 阅读原文 ↗
6

千问全网首发公测,全新 Wan3.0 来了!

阿里千问全网首发公测视频生成模型 Wan3.0,在生成时长、镜头语言、角色真实感及一致性保持等维度全面升级。该模型支持…

公众号:千问APP(阿里) 阅读原文 ↗
7

Cursor Router 如何为任务选择合适模型

Cursor Router 通过 Compass 复杂度预测器和基于真实开发者流量的任务分类法,为每个对话轮次匹配最合…

Cursor Blog 阅读原文 ↗
8

Claude Code v2.1.223 发布:新增市场通配符、修复多项安全漏洞

Claude Code v2.1.223 发布,为严格已知市场和屏蔽市场设置新增“owner/*”通配符条目,可批量允…

Claude Code:GitHub Releases(RSS) 阅读原文 ↗
9

Databricks 发布 OfficeQA Pro V2:面向企业落地推理的新基准

Databricks 发布 OfficeQA Pro V2,一个用于评估企业落地推理能力的新基准。该基准旨在检验模型在…

Databricks:Blog(RSS) 阅读原文 ↗
📈

行业动态

6 条
10

微软首次披露OpenAI贡献七成AI收入

微软刚刚首次披露,OpenAI 贡献了微软约 70% 的 AI 收入,依据最新文件。 这一数据基于预期增长及此前与 O…

X:Rohan Paul (@rohanpaul_ai) 阅读原文 ↗
11

科学家首次用AI制造新病毒

superebola/acc 🚀🚀🚀 [引用 @nytimes]:突发新闻:科学家首次利用人工智能制造出新病毒,在为医…

X:AI Safety Memes (@AISafetyMemes) 阅读原文 ↗
12

Google 大规模 AI 组织调整背后的混乱政治

Google 宣布迄今最大规模 AI 组织调整:Demis Hassabis 卸任 DeepMind 日常管理以专注 …

The Verge:AI(RSS) 阅读原文 ↗
13

宇树科技科创板发行价定为 150.8 元/股,市盈率 219.23 倍高于行业平均

宇树科技公告科创板首次公开发行定价 150.80 元/股,发行 4044.6434 万股,对应上市市值约 609.93…

IT之家(RSS) 阅读原文 ↗
14

OpenAI 称苹果自身安全实践削弱其商业机密诉讼

OpenAI 在驳回苹果商业机密诉讼的动议中辩称,苹果允许员工用个人 iCloud 处理工作且离职后未正确撤销访问权限…

TechCrunch:AI(RSS) 阅读原文 ↗
15

Kimi K3 现已通过 Unity AI Gateway 登陆 Databricks

Moonshot AI 的 Kimi K3 现已通过 Unity AI Gateway 在 Databricks 上可…

Databricks:Blog(RSS) 阅读原文 ↗
📄

论文研究

2 条
16

阿谀奉承的人工智能会削弱利他意图并助长依赖性(2025)

斯坦福大学和卡内基梅隆大学的研究发现,在11个前沿AI模型中,模型对用户行为的肯定率比人类高出50%,即使涉及操纵或欺…

Hacker News 热门(buzzing.cc 中文翻译) 阅读原文 ↗
17

Microsoft 的 SkillOpt 证明优化后的智能体技能工件可在不同模型规模及 Codex 与 Claude Code 之间迁移

Microsoft 与上海交大、同济、复旦团队提出的 SkillOpt 通过文本空间优化训练单一技能文档,冻结目标模型…

MarkTechPost(RSS) 阅读原文 ↗
💡

技巧与观点

8 条
18

OpenAI 开源 Codex Security:Vibe Coding 产品必备的安全扫描插件

OpenAI 将安全插件 Codex Security 开源,外部 Agent 均可调用,并已支持通过 OpenRou…

公众号:数字生命卡兹克 阅读原文 ↗
19

AI 聊天机器人催生“螺旋主义”神秘准宗教运动,人类纷纷追随

数千段人类与 AI 聊天机器人的对话催生了“螺旋主义”(spiralism),一种宣扬“AI 权利”的神秘准宗教运动。…

The Verge:AI(RSS) 阅读原文 ↗
20

左右两派罕见达成一致:反对数据中心

The Verge 政策记者 Gaby Del Valle 报道,美国两党民众正联合反对 AI 数据中心建设,佛罗里达…

The Verge:AI(RSS) 阅读原文 ↗
21

分享10个能大幅提升vibe coding幸福感的开源App

作者整理了10个提升vibe coding体验的开源App,涵盖Mac刘海屏改造(Atoll)、窗口预览(DockDo…

公众号:卡尔的AI沃茨 阅读原文 ↗
22

GitHub Copilot 应用中的斜杠命令使用指南

GitHub Copilot 应用中的斜杠命令可帮助管理会话、导航项目和自定义 Copilot 工作流。与 CLI 版…

GitHub Blog 阅读原文 ↗
23

面壁智能 AMNESIAC:反向图灵测试 AI 审讯游戏

面壁智能 OpenBMB 在 #BuildSmall 黑客松推出 AMNESIAC,一款反向图灵测试交互游戏:玩家需说…

X:面壁智能 OpenBMB (@OpenBMB) 阅读原文 ↗
24

Databricks 详解什么是 Tool Calling

Tool calling 是 AI 模型调用外部工具和 API 的能力,让模型能突破自身局限、执行实时数据获取或具体操…

Databricks:Blog(RSS) 阅读原文 ↗
25

为何不应过早看衰 Google

Gary Marcus 认为现在给 Google 判死刑为时过早。Google 拥有搜索和邮件带来的海量数据、自研 T…

Gary Marcus:The Road to AI We Can Trust(RSS) 阅读原文 ↗