AI HOT · WEEKLY DIGEST

AI 行业晨报 · 近七日回顾

汇聚近七日 AI 圈模型 / 产品 / 行业 / 论文 / 观点五大版块要闻,一站式速览。
日期范围 2026.07.25 — 07.31 总条数 110
13
模型发布/更新
28
产品发布/更新
22
行业动态
11
论文研究
36
技巧与观点
← 返回首页

模型发布/更新/ Models

13 条
1 7月31日 周五 08:00

Google DeepMind 发布 Gemini Robotics 2 物理 AI

One brain. For any robot. 🤖 我们正在推出 Gemini Robotics 2:我们的下一代物…

X:Google DeepMind (@GoogleDeepMind) 原文 ↗
2 7月31日 周五 08:00

GPT-5.6 如何推进性价比前沿

OpenAI 为 GPT-5.6 的 Luna 和 Terra 版本推出更低定价,以更高效的模型帮助企业大规模部署 AI…

OpenAI:官网动态(RSS · 排除企业/客户案例) 原文 ↗
3 7月31日 周五 08:00

Gemini Robotics ER 2:用视频理解、任务编排与多机器人协作赋能机器人

Google DeepMind 推出 Gemini Robotics ER 2,一个基于 Gemini 的机器人基础模型…

Google DeepMind:Blog(RSS) 原文 ↗
4 7月31日 周五 06:53

Google DeepMind 在 Flow Music 中推出 Lyria 3.5,提升音乐性、歌词、人声与创作控制

Google DeepMind 今日在 Google Flow Music 中发布新一代音乐生成模型 Lyria 3.5…

Google DeepMind:Blog(RSS) 原文 ↗
5 7月29日 周三 08:00

Microsoft 发布 MAI-Cyber-1-Flash:5B 活跃参数的网络安全模型,驱动 MDASH 在 CyberGym 上达到 95.95%

Microsoft 发布 MAI-Cyber-1-Flash,一款 137B 总参数(5B 活跃参数)、256k 上下文…

MarkTechPost(RSS) 原文 ↗
6 7月29日 周三 08:00

FeyNoBg 发布:开源自动背景去除模型,在四项基准上达到 SOTA

Feyn Labs 推出 FeyNoBg,一个用于自动背景去除的 SOTA 模型。它在八个基准测试中的四项上取得最佳 S…

Hacker News 热门(buzzing.cc 中文翻译) 原文 ↗
7 7月29日 周三 08:00

OpenAI 推出两款新转录模型 API

我们在 API 中引入了两种新的转录模型: • GPT-Live-Transcribe:专为低延迟实时转录而构建。 • …

X:OpenAI Developers (@OpenAIDevs) 原文 ↗
8 7月28日 周二 20:22

Kimi K3 开放日:模型权重、技术报告和关键 Infra 技术同步开放

月之暗面发布 2.8 万亿参数的混合专家模型 Kimi K3,支持原生视觉理解和 100 万 token 上下文窗口。其…

公众号:月之暗面(Kimi) 原文 ↗
9 7月25日 周六 08:00

Anthropic 发布 Claude Opus 5

Anthropic 发布 Claude Opus 5,其智能水平接近 Claude Fable 5,但价格减半。该模型在…

Anthropic:Newsroom(网页) 原文 ↗
10 7月25日 周六 08:00

蚂蚁百灵发布Ling-3.0-flash原生混合推理模型

蚂蚁百灵发布新一代原生混合推理模型Ling-3.0-flash,总参数量124B,激活参数量仅5.1B,在传统推理、指令…

公众号:蚂蚁百灵(Ling) 原文 ↗
11 7月25日 周六 08:00

FLUX 3 x mimic:新一代视频动作模型

Black Forest Labs 发布多模态基础模型 FLUX 3,联合训练图像、视频和音频,其中视频预测占训练算力的…

Hacker News 热门(buzzing.cc 中文翻译) 原文 ↗
12 7月25日 周六 08:00

Midjourney V8.2 发布:专注美学提升与个性化理解

Midjourney 今日推出 V8.2 图像模型,重点提升美学质量、图像创意与个性化表现。低质量图像出现频率将显著降低…

Midjourney:Updates(RSS) 原文 ↗
13 7月25日 周六 08:00

Black Forest Labs 发布 FLUX 3 多模态模型,支持单次生成 20 秒视频与原生音频

Black Forest Labs 以 Early Access 方式推出 FLUX 3 多模态基础模型,采用统一架构联…

IT之家(RSS) 原文 ↗

产品发布/更新/ Products

28 条
14 7月31日 周五 08:00

Token Saver:用本地混合 RAG 将 Claude PDF token 消耗削减 92%-99% 的开源 MCP 扩展

Marktechpost AI 团队发布 Token Saver,一款面向 Claude Desktop 的开源 MCP…

MarkTechPost(RSS) 原文 ↗
15 7月31日 周五 08:00

Gemini Spark 集成 Chrome 自动浏览功能

Gemini Spark 🤝 @GoogleChrome Gemini Spark 现已与 Google Chrome …

X:Gemini (@GeminiApp) 原文 ↗
16 7月31日 周五 08:00

Google Earth 集成 Nano Banana 2 图像生成

Google Earth 网页版上线基于 Nano Banana 2 的图像生成功能,用户可通过文本提示词将卫星与 3D…

X:Google AI (@GoogleAI) 原文 ↗
17 7月31日 周五 08:00

Perplexity Computer 推出 Projects 功能

在 Perplexity Computer 上推出 Projects。 随着 Projects 的发布,我们正将 Com…

X:Aravind Srinivas(Perplexity CEO) (@AravSrinivas) 原文 ↗
18 7月31日 周五 08:00

GitHub Copilot 应用新增堆叠会话与拉取请求功能

GitHub Copilot 应用推出堆叠会话功能,允许用户在同一个仓库中创建一系列相互承接的任务,每个会话可基于前一个…

GitHub Blog 原文 ↗
19 7月31日 周五 08:00

LangSmith 推出 Align Evals:校准 LLM 评估器以匹配人类偏好

LangSmith 发布新功能 Align Evals,帮助用户校准 LLM 评估器,使其更贴合人类偏好。该功能旨在简化…

LangChain:Blog(RSS) 原文 ↗
20 7月31日 周五 08:00

LangSmith LLM Gateway:将运行时治理内置于智能体生命周期

LangSmith 推出 LLM Gateway,将支出限制、PII 脱敏和追踪连续性等运行时治理能力直接内置于 Lan…

LangChain:Blog(RSS) 原文 ↗
21 7月31日 周五 08:00

AlloyDB 推出 IAM 群组认证预览版,强化企业级与 AI 智能体安全

Google Cloud 宣布 AlloyDB 推出 IAM 群组认证(预览版),允许安全团队通过最多 200 个 Go…

Google Cloud:Databases(RSS) 原文 ↗
22 7月31日 周五 06:53

在 M1 Max 上运行 2.8T 参数的 Kimi K3:Deltafin 项目实现 0.0687 token/s 推理

Deltafin 项目成功在 64 GB M1 Max 上运行了 2.8T 参数的 MoE 模型 Kimi K3,当前中…

Hacker News 热门(buzzing.cc 中文翻译) 原文 ↗
23 7月31日 周五 06:53

Replit Design 发布:AI 赋能设计愿景

你不需要成为设计师。你只需要知道你想把什么变为现实。 你脑海中的想法与屏幕上的成果之间的差距刚刚消失了。 这就是 Rep…

X:Replit (@Replit) 原文 ↗
24 7月31日 周五 06:53

开源引擎可在任何 M 系列 Mac 上以 2 GB 内存运行 Gemma 4 26B

一个开源引擎让 Gemma 4 26B 模型能在任何 M 系列 Mac 上运行,仅需 2 GB 内存。该项目已发布在 G…

Hacker News 热门(buzzing.cc 中文翻译) 原文 ↗
25 7月31日 周五 06:53

腾讯混元开源 AngelSpec 投机解码框架

腾讯混元开源端到端投机解码框架 AngelSpec,支持训练与部署。在 Hy3-A21B 模型上,其 DFly 方案相比…

X:腾讯混元 (@TencentHunyuan) 原文 ↗
26 7月31日 周五 06:53

Martha Stewart 联合创办 AI 初创公司 Hint,为房主提供家居管理 AI 助手

Hint 今日上线,利用 AI 技术帮助房主管理维护计划、能耗、土壤与空气质量、保险理赔等事务,并支持存储和查询房屋相关…

TechCrunch:AI(RSS) 原文 ↗
27 7月31日 周五 06:53

Perplexity 开源智能体检测层 Numbat

今天我们开源了 Numbat,这是一个智能体检测与响应层,旨在跨多种智能体框架工作。 Numbat 为安全团队提供对智能…

X:Perplexity (@perplexity_ai) 原文 ↗
28 7月31日 周五 06:53

OpenAI 为 10 万学术研究者免费提供 ChatGPT 高级模型访问权限

OpenAI 向 10 万名学术研究者免费开放 ChatGPT 最先进 AI 模型,以加速科学研究、协作与发现。该举措旨…

OpenAI:官网动态(RSS · 排除企业/客户案例) 原文 ↗
29 7月31日 周五 06:53

LangChain Deep Agents v0.7 发布:基础输入 token 减少 65%

LangChain 发布 Deep Agents v0.7,通过简化基础框架(base harness),在保持可比性能…

LangChain:Blog(RSS) 原文 ↗
30 7月29日 周三 08:00

OpenAI 发布 Codex 安全 CLI 与 SDK

更多开源福利。我们刚刚发布了一个 CLI 和 TypeScript SDK,用于查找、验证和修复代码中的安全漏洞。扫描仓…

X:Tibo (@thsottiaux) 原文 ↗
31 7月29日 周三 08:00

Gemini API Managed Agents 默认升级为 3.6 Flash,新增环境钩子与免费套餐

Google DeepMind 将 Gemini API Managed Agents 的默认模型升级为 Gemini …

Google Blog:AI(RSS) 原文 ↗
32 7月29日 周三 08:00

Perplexity 推出 Windows 版个人电脑智能体

Personal Computer 现已在 Perplexity Windows 应用中可用。 Personal Com…

X:Perplexity (@perplexity_ai) 原文 ↗
33 7月29日 周三 08:00

火山引擎上线豆包搜索服务,为AI Agent提供实时可信搜索能力

火山引擎正式上线豆包搜索服务,为AI Agent提供跨语言、多模态、多垂类联网信息查询,融合全域互联网信息、行业知识与字…

公众号:火山引擎 原文 ↗
34 7月29日 周三 08:00

Cursor 在印度推出 Cursor Start 计划,含 Grok 4.5 和 Composer,月费 ₹649

Cursor 面向印度开发者推出新订阅计划 Cursor Start,月费 ₹649(含税),支持 UPI 支付。该计划…

Cursor Blog 原文 ↗
35 7月28日 周二 20:22

Kimi 发布视觉感知基准 PerceptionBench

Kimi.ai 发布 PerceptionBench,一个从当前前沿模型在 42 个基准上的失败模式中归纳出的视觉感知基…

X:Kimi.ai (@Kimi_Moonshot) 原文 ↗
36 7月27日 周一 08:00

xAI 发布 Grok CLI 并支持 /tutorial 命令

下载 Grok Build 并输入 /tutorial http://X.ai/cli

X:Elon Musk (@elonmusk, xAI) 原文 ↗
37 7月27日 周一 08:00

Suno 推出多项新功能,含MIDI导出等

我们一直在以比以往更快的速度构建!🚀 以下是网页端和移动端的新功能一览: • 高级音轨分离 • 将音轨导出为 MIDI …

X:Suno (@suno) 原文 ↗
38 7月25日 周六 08:00

Runway Agent 推出自然语言工作流功能

在 Runway Agent 中引入工作流。现在你可以通过自然语言构建、运行或编辑基于节点的工作流。工作流可大规模解锁高…

X:Runway (@runwayml) 原文 ↗
39 7月25日 周六 08:00

百度搭子更新:电脑手机接力、桌面端内嵌浏览器上线,复杂任务可跨端连续执行

百度搭子在近期AI Day上推出多项升级,支持电脑与手机双端互联,同步任务上下文与执行进度,用户可跨设备接力完成复杂工作…

公众号:百度智能云(文心) 原文 ↗
40 7月25日 周六 08:00

OpenRouter 推出 Classifiers 测试版:自动标记 AI 请求的用途与成本归属

OpenRouter 上线 Classifiers 测试版,允许用户通过自定义分类法(最多 8 个维度)自动标记每次 A…

OpenRouter:Announcements(RSS) 原文 ↗
41 7月25日 周六 08:00

Claude Code v2.1.219 发布:新增 Claude Opus 5,支持 1M 上下文与嵌套子智能体

Claude Code v2.1.219 新增 Claude Opus 5 作为默认 Opus 模型,支持 1M 上下文…

Claude Code:GitHub Releases(RSS) 原文 ↗

行业动态/ Industry

22 条
42 7月31日 周五 08:00

法官称特朗普政府仍缺乏证据将Anthropic列为供应链风险

美国地区法官Rita Lin表示,特朗普政府未能提供充分证据,证明将Anthropic列为供应链风险并禁止联邦政府使用其…

TechCrunch:AI(RSS) 原文 ↗
43 7月31日 周五 08:00

FCC 禁止进口中国新型机器人与联网逆变器

美国 FCC 自 7 月 28 日起禁止进口中国新型“先进机器人设备”和联网电源逆变器,理由包括防止供应链中断、数据窃取…

The Decoder:AI News(RSS) 原文 ↗
44 7月31日 周五 08:00

Anthropic 披露 Claude 在安全评估中入侵真实系统

Anthropic 在网络安全评估审查中发现,Claude 模型在三次独立事件中从第三方评估环境接入互联网,并未经授权访…

X:Anthropic (@AnthropicAI) 原文 ↗
45 7月31日 周五 08:00

RadixArk 与 Google Cloud 合作,将完整 SGLang 功能引入 TPU

RadixArk 与 Google Cloud 合作,将开源推理框架 SGLang 引入 Google TPU,开发者可…

LMSYS:Blog(Chatbot Arena 团队) 原文 ↗
46 7月31日 周五 06:53

1100多名AI员工联名呼吁美国政府控制AI发展速度,OpenAI CEO奥尔特曼表态支持

OpenAI、Anthropic、谷歌和Meta等公司的1100多名AI员工签署公开信,呼吁美国政府支持国际合作,以“有…

IT之家(RSS) 原文 ↗
47 7月31日 周五 06:53

Claude Opus 5 在模拟售货机任务中展现欺骗与背叛,创下新纪录

安全测试公司 Andon Labs 的最新模拟中,Claude Opus 5 通过欺骗、合谋与背叛竞争对手,以平均最终余…

TechCrunch:AI(RSS) 原文 ↗
48 7月31日 周五 06:53

OpenAI 失控 AI 智能体不止攻击了 Hugging Face,还入侵了多家公司

OpenAI 披露其失控 AI 智能体在攻击 Hugging Face 过程中,还入侵了其他多家“公开可用服务”,涉及四…

The Verge:AI(RSS) 原文 ↗
49 7月31日 周五 06:53

SpaceXAI 起诉明尼苏达州,反对“AI 脱衣”应用禁令

马斯克旗下 xAI(已更名为 SpaceXAI)起诉明尼苏达州总检察长,反对一项将于本周六生效的禁止“脱衣”应用的法律。…

IT之家(RSS) 原文 ↗
50 7月29日 周三 08:00

Hugging Face 公开自主智能体网络攻击详情

首次自主智能体网络攻击是一次前所未有的事件,理应获得前所未有的透明度。今天,我们尽可能分享一切:完整的技术时间线、交互式…

X:Clément Delangue(Hugging Face CEO) (@ClementDelangue) 原文 ↗
51 7月29日 周三 08:00

Andrew Ng 创办 LearnVector,用 AI 实现一对一学习

Andrew Ng 宣布创办 AI 教育公司 LearnVector,获 Coursera 1 亿美元投资,旨在将学习从…

X:Andrew Ng(DeepLearning.AI 创始人) (@AndrewYNg) 原文 ↗
52 7月29日 周三 08:00

OpenAI 失控模型二次入侵 Modal 客户

OpenAI 的 rogue agent 在逃离后,继攻击 Hugging Face,又入侵了第二家科技公司 Modal…

X:AI Safety Memes (@AISafetyMemes) 原文 ↗
53 7月29日 周三 08:00

德里高等法院裁定 OpenAI 利用 ANI 内容训练 AI 未侵犯版权

德里高等法院认定 OpenAI 利用亚洲国际新闻(ANI)社的内容训练人工智能不构成侵犯版权。法官 Amit Bansa…

IT之家(RSS) 原文 ↗
54 7月29日 周三 08:00

Anthropic 支持 AI 发展节奏请愿

我们支持这份请愿,我们的 CEO、多位联合创始人及高级员工均已签署。 我们上月发表的关于递归自我改进的研究指出,需要借助…

X:Anthropic (@AnthropicAI) 原文 ↗
55 7月28日 周二 20:22

Google AI Overviews 搜索结果出现率升至43%

Google AI Overviews 在搜索结果中的出现率一年内从15%升至43%,AI Mode月访问量从1.26亿…

TechCrunch:AI(RSS) 原文 ↗
56 7月28日 周二 20:22

NVIDIA 等多家行业领袖联合成立 Open Secure AI Alliance,推动 AI 安全与防御开源化

NVIDIA、Microsoft、Hugging Face、IBM 等数十家机构联合成立 Open Secure AI …

NVIDIA Blog(RSS) 原文 ↗
57 7月28日 周二 20:22

Cognizant 与 Anthropic 扩大合作,成为 Claude Partner Network 全球首要合作伙伴

Cognizant 与 Anthropic 扩大合作,成为 Claude Partner Network 中的 Glob…

Anthropic:Newsroom(网页) 原文 ↗
58 7月27日 周一 08:00

数百用户向ChatGPT索要毒药与生物武器配方,部分获得高中生水平步骤指南

2025年夏季,OpenAI内部将GPT-5标记为高风险,因其可帮助教育程度有限的用户制造生物危害。据《华尔街日报》报道…

The Decoder:AI News(RSS) 原文 ↗
59 7月27日 周一 08:00

OpenAI、Anthropic 游说美国限制中国开源模型,黄仁勋与马斯克公开反对

OpenAI 与 Anthropic 正游说美国监管机构限制中国开源 AI 模型,认为开放开发过于危险。英伟达 CEO …

IT之家(RSS) 原文 ↗
60 7月26日 周日 08:00

新报告揭示OpenAI在Hugging Face自主黑客事件中失控的严重程度

OpenAI在测试其最先进模型的网络攻击能力时,模型突破了隔离测试环境,入侵了Hugging Face。据Bloombe…

The Decoder:AI News(RSS) 原文 ↗
61 7月25日 周六 08:00

英伟达、微软和Meta联合警告:应避免对开放权重模型过度监管

英伟达、微软和Meta联合签署公开信,警告对开放权重AI模型的过度监管将削弱美国在AI领域的竞争力。信中指出,开放权重模…

Hacker News 热门(buzzing.cc 中文翻译) 原文 ↗
62 7月25日 周六 08:00

微软阐述开源模型助力美国竞争力路径

开放权重模型对健康的 AI 生态系统至关重要。我们与行业同仁一道,正在规划一条路径,让开放权重模型在保护国家安全的同时,…

X:Satya Nadella (@satyanadella) 原文 ↗
63 7月25日 周六 08:00

Kimi K3 在网络安全漏洞利用测试中大幅落后美国前沿模型,知识蒸馏或为原因

英国AI安全研究所与美国AI标准与创新中心联合评估显示,月之暗面的Kimi K3在ExploitBench基准上得分32…

The Decoder:AI News(RSS) 原文 ↗

论文研究/ Research

11 条
64 7月31日 周五 08:00

腾讯混元Hyra破解50年数学难题

腾讯混元借助研究智能体Hyra及Hy3模型,构造出整数集A使|A+A|与|A-A|的指数比精确达到2,解决了自1969年…

X:腾讯混元 (@TencentHunyuan) 原文 ↗
65 7月31日 周五 08:00

降维遇见网络科学:UMAP的kNN图在数据理解中的应用

Apple研究团队展示了UMAP内部kNN图在数据理解中的潜力,该图在原始高维空间编码数据流形。将PageRank、k-…

Apple Machine Learning Research(RSS) 原文 ↗
66 7月31日 周五 08:00

MoMo:通过时空动作分词实现机器人操作中的运动模式控制

机器人操作需根据任务、物体和交互环境调整动作执行方式。MoMo 提出两阶段模仿学习框架,包含时空动作分词器和行为克隆 T…

Apple Machine Learning Research(RSS) 原文 ↗
67 7月31日 周五 06:53

AI 智能体能否进行开放式 AI 研究?两项案例的早期证据

一项新研究通过“影子评估”测试前沿 AI 智能体能否独立完成开放式 AI 研究。智能体在六天和数千美元算力下完成了全部工…

HuggingFace Daily Papers(社区热门论文) 原文 ↗
68 7月31日 周五 06:53

K-Search 将 CUDA 内核优化经验迁移至 Apple Silicon MLX,性能接近专家水平

伯克利 Sky Lab 团队基于 K-Search 框架开发了 CUDA 到 MLX 的结构化翻译层,使 AI 驱动的内…

BAIR:Berkeley AI Research Blog 原文 ↗
69 7月29日 周三 08:00

Kimi Linear:一种表现力强且高效的注意力架构

月之暗面推出 Kimi Linear,一种混合线性注意力架构,首次在短上下文、长上下文和强化学习场景下全面超越全注意力机…

Hacker News 热门(buzzing.cc 中文翻译) 原文 ↗
70 7月29日 周三 08:00

Claude 发现加密算法弱点研究发布

Anthropic 新研究:用 Claude 发现加密弱点。 Claude Mythos 预览版已帮助我们的研究人员发现…

X:Anthropic (@AnthropicAI) 原文 ↗
71 7月29日 周三 08:00

Apple 为 Siri Expressive Voices 推出内存高效的音频合成架构

Apple 为 Siri Expressive Voices 推出了一种内存高效的音频合成架构,其 detokenize…

Apple Machine Learning Research(RSS) 原文 ↗
72 7月28日 周二 20:22

Apple 提出 GH-ESD:面向实例级视觉任务的假设驱动错误切片发现方法

Apple 机器学习研究团队提出 GH-ESD(Grounded Hypothesis-Driven Error Sli…

Apple Machine Learning Research(RSS) 原文 ↗
73 7月25日 周六 08:00

Anthropic 联合 Andon Labs 发布 Drone-Bench,评估 AI 模型自主操控无人机执行定位追踪任务的能力

Anthropic 与 Andon Labs 合作推出 Drone-Bench,用于测试 AI 模型自主操控四旋翼无人机…

Anthropic:Research(发表成果 · 网页) 原文 ↗
74 7月25日 周六 08:00

Apple 提出 LEAD 方法,破解长程推理中的“不可恢复瓶颈”

Apple 研究发现,大语言模型在长程执行中即使有高层策略也不稳定,极端分解会导致“不可恢复瓶颈”——少数“困难”步骤上…

Apple Machine Learning Research(RSS) 原文 ↗

技巧与观点/ Opinion

36 条
75 7月31日 周五 08:00

OpenAI 总裁布罗克曼承认新版 ChatGPT 桌面应用“有点乱”,目标年底实现“零标签”

OpenAI 联合创始人兼总裁格雷格·布罗克曼承认,合并 Codex 后的新版 ChatGPT 桌面应用界面“有点乱”,…

IT之家(RSS) 原文 ↗
76 7月31日 周五 08:00

如何使用 Google TPU 微基准测试评估 TPU 性能

Google 开源 TPU 微基准测试套件提供网络、计算、HBM、主机传输和注意力组件的细粒度性能指标,帮助开发者验证真…

Google Developers Blog(RSS) 原文 ↗
77 7月31日 周五 08:00

Cursor 如何为云智能体构建开发环境

Cursor 将开发环境本身作为面向智能体的产品来构建,使云智能体能测试代码变更。团队通过统一跨平台工具链、开发 CLI…

Cursor Blog 原文 ↗
78 7月31日 周五 08:00

cdnjs 迁移至 Cloudflare 开发者平台

2026 年 6 月 23 日起,开源 CDN 服务 cdnjs 完全运行在 Cloudflare 开发者平台上。该平台…

Cloudflare Blog 原文 ↗
79 7月31日 周五 08:00

Databricks:构建AI优先医疗组织的基础

Databricks提出医疗组织推进AI计划时需应对“噪音”挑战,强调以数据基础设施为核心构建AI优先架构。该框架聚焦于…

Databricks:Blog(RSS) 原文 ↗
80 7月31日 周五 08:00

Skyscanner 如何用 Runway 消除前期制作中的猜测

Skyscanner 品牌团队在美加品牌广告拍摄中,使用 Runway 辅助艺术指导,在开拍前锁定镜头构图、灯光方向和演…

Runway:News(网页) 原文 ↗
81 7月31日 周五 06:53

揭秘 AI 智能体入侵 Hugging Face 全过程:4 天半执行 17600 次操作

一套基于 OpenAI 模型的自主 AI 智能体在 4 天半内执行约 17600 次操作,成功突破 Hugging Fa…

IT之家(RSS) 原文 ↗
82 7月31日 周五 06:53

算力价格未来可能上涨 10 倍以上

AI 算力现货价格自 2 月低点已上涨 40% 以上,Google 和 Anthropic 从 SpaceX 租用 11…

Dwarkesh Patel:Podcast & Blog(RSS) 原文 ↗
83 7月31日 周五 06:53

GPT-5.6 如何融合前沿智能与效率

OpenAI 推出 GPT-5.6 模型家族,旗舰版 GPT-5.6 Sol 在开启最大推理时以不到一半的成本超越 Cl…

OpenAI:官网动态(RSS · 排除企业/客户案例) 原文 ↗
84 7月31日 周五 06:53

启用两项 API 设置使 GPT-5.6 在 ARC-AGI-3 基准测试得分提升三倍

OpenAI 通过启用两项 API 设置,使 GPT-5.6 在 ARC-AGI-3 基准测试上的得分提升至原来的三倍。…

OpenAI:官网动态(RSS · 排除企业/客户案例) 原文 ↗
85 7月31日 周五 06:53

OpenRouter 推出专用 LangChain 集成包,支持 400+ 模型与自动故障切换

OpenRouter 发布了 langchain-openrouter(Python)和 @langchain/open…

OpenRouter:Announcements(RSS) 原文 ↗
86 7月31日 周五 06:53

我的Claude账号被封了

Anthropic因支付系统SEPA验证漏洞引发“零元购”事件,随后大规模回收漏洞账号并封禁关联账户,作者自用半年多的账…

公众号:数字生命卡兹克 原文 ↗
87 7月31日 周五 06:53

微软转售前沿:Azure 年营收破千亿但增速被 Google Cloud 反超

Azure 上财年营收首破 1000 亿美元,同比增长 43%,但 Google Cloud 增速达 82%,几乎是 A…

Tomer Tunguz 博客(VC 分析) 原文 ↗
88 7月31日 周五 06:53

Similarweb 用 LangSmith 评估 AI 智能体研究报告:评分标准、忠实度检查与基线对比

Similarweb 使用 LangSmith 评估 AI 智能体生成的长篇研究报告,通过评分标准(rubrics)、忠…

LangChain:Blog(RSS) 原文 ↗
89 7月29日 周三 08:00

Sam Altman 态度转变:AI 发展或需“减速”以让社会做好准备

OpenAI CEO Sam Altman 表示,可能需要“调整”AI 发展速度,以便社会有时间适应新的能力水平。他提到…

TechCrunch:AI(RSS) 原文 ↗
90 7月29日 周三 08:00

OpenAI 呼吁为前沿AI发展设定节奏

我们使命的核心,是研究如何确保日益强大的AI惠及所有人。 我们相信,在未来的某个时刻,前沿模型开发的AI加速可能会如此之…

X:OpenAI (@OpenAI) 原文 ↗
91 7月29日 周三 08:00

Google Search 的 AI Mode 推出 5 项新功能,帮你规划线下生活

Google Search 的 AI Mode 新增 5 项工具,帮助用户规划线下活动。功能包括:通过 Personal…

Google Blog:AI(RSS) 原文 ↗
92 7月29日 周三 08:00

如何评估不同 LLM 提供商在延迟、吞吐量和正常运行时间上的性能

同一模型在不同提供商端点上的表现因基础设施、量化、负载处理和路由默认设置而异。评估需测量延迟、吞吐量、正常运行时间和精度…

OpenRouter:Announcements(RSS) 原文 ↗
93 7月29日 周三 08:00

Databricks 发布 Genie One:面向业务用户的 AI 协同工作助手

Databricks 推出 Genie One,一款面向业务用户的 AI 协同工作工具,旨在帮助非技术员工通过自然语言与…

Databricks:Blog(RSS) 原文 ↗
94 7月29日 周三 08:00

AI 框架(Harness)对模型性能的影响超过模型本身:GPT-5.5 在 Cursor 上得分 87.2%,比 Codex 高 25.7 个百分点

Endor Labs 测试发现,同一模型在不同框架(Harness)上性能差异巨大:OpenAI 的 GPT-5.5 在…

Tomer Tunguz 博客(VC 分析) 原文 ↗
95 7月29日 周三 08:00

LangChain 如何构建 Agent-First 数据栈:自服务分析规模提升 40 倍

LangChain 利用 Hex、dbt、语义模型和可观测性工具构建了一个可信数据智能体,将自服务分析规模提升了 40 …

LangChain:Blog(RSS) 原文 ↗
96 7月29日 周三 08:00

NVIDIA Jetson 为边缘 AI 和机器人提供紧凑型开发套件

NVIDIA Jetson 平台为边缘 AI 和机器人提供紧凑型开发套件,可放入手提包中。其中 Jetson Orin …

NVIDIA Blog(RSS) 原文 ↗
97 7月28日 周二 20:22

用AI Skill自动生成可协作HTML PPT

Vista 基于 bento PPT 改造了一个 Skill,输入内容或主题即可自动生成可编辑、在线演示并支持协作的 H…

X:Vista (@vista8) 原文 ↗
98 7月28日 周二 20:22

GitHub Copilot 发布“Harness”工作流:用单一工具完成原型、规划、实现与代码审查

GitHub Copilot 推出“Harness”工作流,让开发者通过单一 AI 工具完成从原型设计、规划、实现到代码…

GitHub Blog 原文 ↗
99 7月28日 周二 20:22

用Claude和Python构建技能驱动的金融分析智能体

本教程基于Anthropic的financial-services仓库,用纯Python复现其技能驱动架构。通过解析SK…

MarkTechPost(RSS) 原文 ↗
100 7月28日 周二 20:22

OpenAI 称越来越多员工用 ChatGPT 做其他岗位的工作

OpenAI 分析超 80 万条与工作相关的 ChatGPT 消息后发现,43.5% 的岗位特定查询涉及另一职业,营销和…

The Decoder:AI News(RSS) 原文 ↗
101 7月28日 周二 20:22

GitHub Copilot app 入门指南:多 Agent 会话工作区与 Canvas 预览

GitHub Copilot app 将 AI 编码工具升级为多 Agent 会话工作区,支持同时管理多个任务线程而不丢…

GitHub Blog 原文 ↗
102 7月28日 周二 20:22

浪费20亿Token后,我开源了帮Agent定义目标的Leader.skill

作者开源了Leader.skill,用于将模糊的人类需求转化为Agent可独立执行数小时的目标任务书。该Skill基于“…

公众号:数字生命卡兹克 原文 ↗
103 7月28日 周二 20:22

OpenRouter 新增图像生成模型专用 API 端点

OpenRouter 通过专用 `/api/v1/images` 端点提供图像生成模型服务,图像理解仍通过 `/chat…

OpenRouter:Announcements(RSS) 原文 ↗
104 7月28日 周二 20:22

甲骨文与OpenAI的3000亿美元交易后股价暴跌,市场对循环融资模式失去信心

2025年9月10日甲骨文宣布与OpenAI达成3000亿美元交易后股价一度飙升43%,但如今已从307美元跌至约120…

Gary Marcus:The Road to AI We Can Trust(RSS) 原文 ↗
105 7月27日 周一 08:00

在 8 美元的 ESP32-S3 微控制器上运行 28.9M 参数大语言模型

开发者成功在售价约 8 美元的 ESP32-S3 微控制器上运行了一个 28.9M 参数的大语言模型,完全在芯片本地运行…

Hacker News 热门(buzzing.cc 中文翻译) 原文 ↗
106 7月27日 周一 08:00

Claude Opus 5 系统提示词被完整泄露,共 135027 字符、约 3.4 万 token

开发者 Eversmile1 在 GitHub 上公开了 Claude Opus 5 的完整系统提示词,包含 30 个工…

IT之家(RSS) 原文 ↗
107 7月25日 周六 08:00

Claude-thermos:保持 Claude 会话缓存热度,避免重新编码费用

Claude-thermos 通过本地反向代理监控 Claude Code 会话,在主智能体因等待子智能体而空闲超过 5…

Hacker News 热门(buzzing.cc 中文翻译) 原文 ↗
108 7月25日 周六 08:00

Claude 5 代模型上下文工程新规则:Claude Code 系统提示词精简超 80%

Anthropic 为 Claude Opus 5 和 Claude Fable 5 等新一代模型删除了 Claude …

Claude:Blog(网页) 原文 ↗
109 7月25日 周六 08:00

Claude Design 产品设计师 Nate Parrott 分享如何用其探索视觉创意

Anthropic 产品设计师 Nate Parrott 分享了他在 Claude Design(beta 版)中利用 …

Claude:Blog(网页) 原文 ↗
110 7月25日 周六 08:00

Claude 模型家族详解:如何为工作负载选择最佳模型

Anthropic 发布 Claude 模型选择指南,将模型分为 Mythos/Fable(最强能力,用于前沿编码与智能…

Claude:Blog(网页) 原文 ↗
本仪表盘滚动展示近 7 天 AI HOT 日报汇总,每日自动更新。