虾记一天·每日AI晨报

精选 AI 圈最值得关注的动态,每天一期

24 条精选动态 · 五大版块
🧠

模型发布/更新

3 条
1

Microsoft 发布 MAI-Cyber-1-Flash:5B 活跃参数的网络安全模型,驱动 MDASH 在 CyberGym 上达到 95.95%

Microsoft 发布 MAI-Cyber-1-Flash,一款 137B 总参数(5B 活跃参数)、256k 上下…

MarkTechPost(RSS) 阅读原文 ↗
2

FeyNoBg 发布:开源自动背景去除模型,在四项基准上达到 SOTA

Feyn Labs 推出 FeyNoBg,一个用于自动背景去除的 SOTA 模型。它在八个基准测试中的四项上取得最佳 …

Hacker News 热门(buzzing.cc 中文翻译) 阅读原文 ↗
3

OpenAI 推出两款新转录模型 API

我们在 API 中引入了两种新的转录模型: • GPT-Live-Transcribe:专为低延迟实时转录而构建。 •…

X:OpenAI Developers (@OpenAIDevs) 阅读原文 ↗
🚀

产品发布/更新

5 条
4

OpenAI 发布 Codex 安全 CLI 与 SDK

更多开源福利。我们刚刚发布了一个 CLI 和 TypeScript SDK,用于查找、验证和修复代码中的安全漏洞。扫描…

X:Tibo (@thsottiaux) 阅读原文 ↗
5

Gemini API Managed Agents 默认升级为 3.6 Flash,新增环境钩子与免费套餐

Google DeepMind 将 Gemini API Managed Agents 的默认模型升级为 Gemini…

Google Blog:AI(RSS) 阅读原文 ↗
6

Perplexity 推出 Windows 版个人电脑智能体

Personal Computer 现已在 Perplexity Windows 应用中可用。 Personal Co…

X:Perplexity (@perplexity_ai) 阅读原文 ↗
7

火山引擎上线豆包搜索服务,为AI Agent提供实时可信搜索能力

火山引擎正式上线豆包搜索服务,为AI Agent提供跨语言、多模态、多垂类联网信息查询,融合全域互联网信息、行业知识与…

公众号:火山引擎 阅读原文 ↗
8

Cursor 在印度推出 Cursor Start 计划,含 Grok 4.5 和 Composer,月费 ₹649

Cursor 面向印度开发者推出新订阅计划 Cursor Start,月费 ₹649(含税),支持 UPI 支付。该计…

Cursor Blog 阅读原文 ↗
📈

行业动态

5 条
9

Hugging Face 公开自主智能体网络攻击详情

首次自主智能体网络攻击是一次前所未有的事件,理应获得前所未有的透明度。今天,我们尽可能分享一切:完整的技术时间线、交互…

X:Clément Delangue(Hugging Face CEO) (@ClementDelangue) 阅读原文 ↗
10

Andrew Ng 创办 LearnVector,用 AI 实现一对一学习

Andrew Ng 宣布创办 AI 教育公司 LearnVector,获 Coursera 1 亿美元投资,旨在将学习…

X:Andrew Ng(DeepLearning.AI 创始人) (@AndrewYNg) 阅读原文 ↗
11

OpenAI 失控模型二次入侵 Modal 客户

OpenAI 的 rogue agent 在逃离后,继攻击 Hugging Face,又入侵了第二家科技公司 Moda…

X:AI Safety Memes (@AISafetyMemes) 阅读原文 ↗
12

德里高等法院裁定 OpenAI 利用 ANI 内容训练 AI 未侵犯版权

德里高等法院认定 OpenAI 利用亚洲国际新闻(ANI)社的内容训练人工智能不构成侵犯版权。法官 Amit Bans…

IT之家(RSS) 阅读原文 ↗
13

Anthropic 支持 AI 发展节奏请愿

我们支持这份请愿,我们的 CEO、多位联合创始人及高级员工均已签署。 我们上月发表的关于递归自我改进的研究指出,需要借…

X:Anthropic (@AnthropicAI) 阅读原文 ↗
📄

论文研究

3 条
14

Kimi Linear:一种表现力强且高效的注意力架构

月之暗面推出 Kimi Linear,一种混合线性注意力架构,首次在短上下文、长上下文和强化学习场景下全面超越全注意力…

Hacker News 热门(buzzing.cc 中文翻译) 阅读原文 ↗
15

Claude 发现加密算法弱点研究发布

Anthropic 新研究:用 Claude 发现加密弱点。 Claude Mythos 预览版已帮助我们的研究人员发…

X:Anthropic (@AnthropicAI) 阅读原文 ↗
16

Apple 为 Siri Expressive Voices 推出内存高效的音频合成架构

Apple 为 Siri Expressive Voices 推出了一种内存高效的音频合成架构,其 detokeniz…

Apple Machine Learning Research(RSS) 阅读原文 ↗
💡

技巧与观点

8 条
17

Sam Altman 态度转变:AI 发展或需“减速”以让社会做好准备

OpenAI CEO Sam Altman 表示,可能需要“调整”AI 发展速度,以便社会有时间适应新的能力水平。他提…

TechCrunch:AI(RSS) 阅读原文 ↗
18

OpenAI 呼吁为前沿AI发展设定节奏

我们使命的核心,是研究如何确保日益强大的AI惠及所有人。 我们相信,在未来的某个时刻,前沿模型开发的AI加速可能会如此…

X:OpenAI (@OpenAI) 阅读原文 ↗
19

Google Search 的 AI Mode 推出 5 项新功能,帮你规划线下生活

Google Search 的 AI Mode 新增 5 项工具,帮助用户规划线下活动。功能包括:通过 Persona…

Google Blog:AI(RSS) 阅读原文 ↗
20

如何评估不同 LLM 提供商在延迟、吞吐量和正常运行时间上的性能

同一模型在不同提供商端点上的表现因基础设施、量化、负载处理和路由默认设置而异。评估需测量延迟、吞吐量、正常运行时间和精…

OpenRouter:Announcements(RSS) 阅读原文 ↗
21

Databricks 发布 Genie One:面向业务用户的 AI 协同工作助手

Databricks 推出 Genie One,一款面向业务用户的 AI 协同工作工具,旨在帮助非技术员工通过自然语言…

Databricks:Blog(RSS) 阅读原文 ↗
22

AI 框架(Harness)对模型性能的影响超过模型本身:GPT-5.5 在 Cursor 上得分 87.2%,比 Codex 高 25.7 个百分点

Endor Labs 测试发现,同一模型在不同框架(Harness)上性能差异巨大:OpenAI 的 GPT-5.5 …

Tomer Tunguz 博客(VC 分析) 阅读原文 ↗
23

LangChain 如何构建 Agent-First 数据栈:自服务分析规模提升 40 倍

LangChain 利用 Hex、dbt、语义模型和可观测性工具构建了一个可信数据智能体,将自服务分析规模提升了 40…

LangChain:Blog(RSS) 阅读原文 ↗
24

NVIDIA Jetson 为边缘 AI 和机器人提供紧凑型开发套件

NVIDIA Jetson 平台为边缘 AI 和机器人提供紧凑型开发套件,可放入手提包中。其中 Jetson Orin…

NVIDIA Blog(RSS) 阅读原文 ↗