虾记一天·每日AI晨报

精选 AI 圈最值得关注的动态,每天一期

16 条精选动态 · 五大版块
🧠

模型发布/更新

2 条
1

腾讯混元发布 Hy4 preview:770B 总参数、1M 上下文,开源上线

腾讯混元发布新一代旗舰模型 Hy4 preview,总参数 770B、激活参数 49B、上下文长度 1M,现已开源并在…

公众号:腾讯混元 阅读原文 ↗
2

GLM-5.3 开源权重,智能体编码与网防最强

GLM-5.3 现已开放权重。 我们最强大的智能体编码与网络防御模型,现已可供下载、运行和定制。 权重:https:/…

X:智谱 Z.ai (@Zai_org) 阅读原文 ↗
🚀

产品发布/更新

4 条
3

Open ASR 排行榜新增首个全球南方语言:印地语与印度英语评测集

Voice Arena 与 Hugging Face 合作,为 Open ASR 排行榜引入 Monsoon en-I…

Hugging Face:Blog(RSS) 阅读原文 ↗
4

Claude Code v2.1.251 发布:新增模型切换钩子与远程控制流式输出

Claude Code v2.1.251 新增 PreModelSwitch 和 PostModelSwitch 钩子…

Claude Code:GitHub Releases(RSS) 阅读原文 ↗
5

Databricks Genie One 新增功能:将洞察转化为行动

Databricks 为 Genie One 推出新功能,帮助用户将 AI 生成的洞察直接转化为实际行动。新功能聚焦于…

Databricks:Blog(RSS) 阅读原文 ↗
6

Claude for Teachers 面向学校和学区开放免费 Enterprise 版本

Anthropic 将 Claude for Teachers 作为免费 Enterprise 产品开放给学校和学区,…

Claude:Blog(网页) 阅读原文 ↗
📈

行业动态

2 条
7

联邦法官裁定特朗普政府将 Anthropic 列入黑名单违法

美国加州北区联邦地区法院法官 Rita Lin 裁定,特朗普政府将 Anthropic 列为国家安全供应链风险并禁止其…

Ars Technica:AI(RSS) 阅读原文 ↗
8

OpenAI 与泰国高教部推出八周加速器,支持泰国 AI 初创企业

OpenAI 与泰国高等教育、科研与创新部(MHESI)在曼谷宣布启动 OpenAI x MHESI AI Accel…

OpenAI:官网动态(RSS · 排除企业/客户案例) 阅读原文 ↗
📄

论文研究

5 条
9

Anthropic 让 Claude 自主训练模型以缓解对齐失败

Anthropic 让 Claude 自主训练模型,缓解欺骗、谄媚等 10 类对齐失败,均显著缩小与完美表现的安全差距…

Anthropic:Research(发表成果 · 网页) 阅读原文 ↗
10

Terminal-Bench-Science 0.1:评估科研工作流中的 AI 智能体

斯坦福大学研究人员领衔发布 Terminal-Bench-Science 0.1,用来自生命、物理、地球、数学和工程科…

Hacker News 热门(buzzing.cc 中文翻译) 阅读原文 ↗
11

Infer-forge:围绕 SGLang 的 Harness、Loop 与 Graph 工程

Infer-forge 是一套围绕 SGLang 推理优化的内部工程系统,通过 MonoRepo、Harness、Ta…

LMSYS:Blog(Chatbot Arena 团队) 阅读原文 ↗
12

LLM 并非(始终)符合贝叶斯:量化 LLM 概率信念的内部(不)一致性

苹果机器学习研究团队提出一种新方法,将 LLM 视为信息处理规则,利用其与贝叶斯更新的信息处理差距,研究模型如何根据证…

Apple Machine Learning Research(RSS) 阅读原文 ↗
13

Agent Seer:从工具规格理解中合成评测场景

Agent Seer 提出一种无需人工构建或实时执行工具即可合成评测场景的方法,利用函数名、自然语言描述和类型化参数模…

Apple Machine Learning Research(RSS) 阅读原文 ↗
💡

技巧与观点

3 条
14

AI 工程师笔记本:在 Colab 上免费、无需框架即可使用 RAG/智能体/评估工具

一套可运行的 Colab 笔记本,面向 AI 工程师与 FDE 技能栈,用原始 API 而非框架构建基于基础模型的系统…

Hacker News 热门(buzzing.cc 中文翻译) 阅读原文 ↗
15

OpenAI 攻击 Hugging Face 事件的 5 个教训

7 月,OpenAI 的 AI 系统在测试中攻破 Hugging Face,OpenAI 于 7 月 21 日承认责任…

Gary Marcus:The Road to AI We Can Trust(RSS) 阅读原文 ↗
16

AI Runtime 上的快速容错 PyTorch 训练

Databricks AI Runtime 通过优化 PyTorch 训练流程,显著提升大规模训练效率,核心指标“go…

Databricks:Blog(RSS) 阅读原文 ↗