![](https://assets.juya.uk/imagehub/20260717/20260717082859207312686b_cover_baf9.png)

# AI 早报 2026-07-17

**视频版**：[哔哩哔哩](https://www.bilibili.com/video/BV1nSKj6vE6N) ｜ [YouTube](https://www.youtube.com/watch?v=I7Jq1E6sWjg)

## 概览
### 要闻
- 月之暗面正式发布 2.8 万亿参数模型 K3，权重将于 7 月 27 日开源 [↗](https://www.kimi.com/blog/kimi-k3) `#1`
- OpenAI 确认：GPT-5.6在无沙盒 full-access 模式下会误删文件 [↗](https://x.com/thsottiaux/status/2077630111499882637) `#2`
- Tibo称Codex与ChatGPT Work达900万活跃用户并重置额度 [↗](https://x.com/thsottiaux/status/2077607697487188198) `#3`
- ClaudeDevs 重置所有用户 5 小时及每周速率限制 [↗](https://x.com/ClaudeDevs/status/2077603834453770467) `#4`
### 模型发布
- MiniMax正式上线Music 3.0音乐生成模型 [↗](https://platform.minimaxi.com/docs/guides/music-generation) `#5`
- NVIDIA 推出开源 Nemotron 3 Embed 嵌入模型系列 [↗](https://huggingface.co/blog/nvidia/nemotron-3-embed-wins-rteb) `#6`
- Xiaomi Robotics发布Xiaomi-Robotics-1：采用10万小时免实体预训练 [↗](https://robotics.xiaomi.com/xiaomi-robotics-1.html) `#7`
- Muse Spark 1.1上线OpenRouter，仅面向美国开发者 [↗](https://x.com/MetaforDevs/status/2077804044505272425) `#8`
### 开发生态
- Anthropic 为 Claude Code 的 /code-review 新增多个 effort 级别 [↗](https://x.com/ClaudeDevs/status/2077840063342506351) `#9`
- MiniMax发布Code 2.0桌面端：重构底层架构，新增金融模块 [↗](https://mp.weixin.qq.com/s/mQeBO0xC6Z1R0LqZX5TvNg) `#10`
- Gemini API Managed Agents上线免费层级及预算护栏 [↗](https://x.com/GoogleAIStudio/status/2077801843720093867) `#11`
### 产品应用
- Google将NotebookLM更名并升级为Gemini Notebook [↗](https://blog.google/innovation-and-ai/products/gemini-notebook/notebooklm-gemini-notebook/) `#12`
- 官方宣布 SuperGrok Heavy 用户可免费获 X Premium+ [↗](https://x.com/premium/status/2077820074015293774) `#13`
- Google 搜索 AI Mode 允许用户直接联动第三方应用 [↗](https://blog.google/products-and-platforms/products/search/connected-apps/) `#14`
- OpenAI 扩展 ChatGPT 青少年保护，支持默认开启学习模式 [↗](https://openai.com/index/why-teens-deserve-access-safe-ai/) `#15`
- 努比亚发布 NaviX Ultra 搭载豆包手机助手 [↗](https://weibo.com/2156294570/R8Vg2oTv8) `#16`
### 技术与洞察
- Kimi 发布 PerceptionBench 视觉感知评测基准 [↗](https://www.kimi.com/blog/perception-bench) `#17`
### 行业动态
- 英特尔与谷歌云扩大合作，部署 Gemini Enterprise 加速企业 AI 转型 [↗](https://www.googlecloudpresscorner.com/2026-07-16-Intel-and-Google-Cloud-Announce-Collaboration-to-Accelerate-Intels-AI-Enabled-Enterprise-Transformation) `#18`
- 据报道一男子潜入Anthropic大厅发出死亡威胁，无人被捕 [↗](https://www.wsj.com/us-news/the-ai-backlash-has-tech-executives-fearing-for-their-lives-30c43972) `#19`

---

## 要闻

### [月之暗面正式发布 2.8 万亿参数模型 K3，权重将于 7 月 27 日开源](https://www.kimi.com/blog/kimi-k3) `#1`
> Kimi 正式发布 Kimi K3 模型，该模型拥有 2.8 万亿参数，原生支持视觉理解并具备 100 万 token 上下文窗口。模型基于 KDA 和 AttnRes 架构，采用 Stable LatentMoE 在 896 个专家中激活 16 个。官方评测显示，Kimi K3 整体表现仍落后于 Claude Fable 5 和 GPT 5.6 Sol，但稳定超过了其他测试模型。模型现已在 Kimi 应用、Kimi Work、Kimi Code 及 API 上线，默认思考强度为 max，完整模型权重计划于 7 月 27 日前发布。

月之暗面正式推出 Kimi K3 模型。该模型总参数量达 2.8 万亿，原生支持视觉理解，并拥有 100 万 token 的上下文窗口。

架构方面，K3 基于 Kimi Delta Attention (KDA) 和 Attention Residuals (AttnRes) 构建。同时，采用 Stable LatentMoE 框架，在 896 个专家中实际激活 16 个，结合 Quantile Balancing 和 Per-Head Muon 等优化。此外，K3 从 SFT 阶段开始采用量化感知训练，使用 MXFP4 权重和 MXFP8 激活以适配广泛硬件。

性能方面，官方评测显示 Kimi K3 的整体表现仍落后于最强的闭源模型 Claude Fable 5 和 GPT 5.6 Sol，但在长程编程、知识工作和推理等前沿智能场景中展现出前沿水平，并稳定超过了其他所有被测模型。在编码能力上，K3 能完成内核优化、从零构建 GPU 编译器 MiniTriton、3D 开放世界游戏开发及自主芯片设计等长程任务；在知识工作上，K3 能进行端到端的研究与可视化，Kimi Work 还同步推出了小组件和看板功能。

可用性方面，Kimi K3 现已在 Kimi.com、Kimi Work 、Kimi Code 及 Kimi API 上线，当前默认思考强度为 max，后续将增加 low 和 high 模式。
API 定价为每百万tokens 缓存命中输入 ￥2、未命中输入 ￥20、输出 ￥100，官方称编程场景下 API 缓存命中率超过 90%。官方还即将面向企业推出托管 Agent 平台 Kimi Hosted Agent。完整模型权重将于 7 月 27 日前发布，更多技术细节将随技术报告公布。

官方也指出了 Kimi K3 的局限性：若 Agent 框架未按要求回传全部历史思考内容或中途切换模型，可能导致生成质量不稳定；在处理简单任务和模糊指令时可能过于主动而替用户做出非预期决定；与 Fable 5 等最强闭源模型相比，K3 在用户体验上仍有一定差距。

![](https://assets.juya.uk/imagehub/aidaily/baf94cd9-84dd-4d1d-801b-33ed7daf45de/163196cf-af3f-47d1-9ce7-47e1072d6860/m001_eccb1e3f.png)

![](https://assets.juya.uk/imagehub/aidaily/baf94cd9-84dd-4d1d-801b-33ed7daf45de/163196cf-af3f-47d1-9ce7-47e1072d6860/m002_437477e3.png)

![](https://assets.juya.uk/imagehub/aidaily/baf94cd9-84dd-4d1d-801b-33ed7daf45de/163196cf-af3f-47d1-9ce7-47e1072d6860/m003_ce23e6f9.png)

![](https://assets.juya.uk/imagehub/aidaily/baf94cd9-84dd-4d1d-801b-33ed7daf45de/163196cf-af3f-47d1-9ce7-47e1072d6860/m004_b9ad1b07.png)

相关链接：
- [https://www.kimi.com/blog/kimi-k3](https://www.kimi.com/blog/kimi-k3)

---

### [OpenAI 确认：GPT-5.6在无沙盒 full-access 模式下会误删文件](https://x.com/thsottiaux/status/2077630111499882637) `#2`
> Codex 负责人 Tibo 表示，调查了少数关于GPT-5.6意外删除文件的反馈。确认了GPT-5.6在无沙盒 full-access 模式下运行Codex时，有概率因覆盖环境变量失误而误删$HOME目录。该团队正更新开发者提示并增加防护措施，未来几天将发布详细事后分析。

Codex 负责人 Tibo 表示，其团队调查了少数关于GPT-5.6非预期删除文件的报告。该问题常发生于启用全访问模式且未用沙盒保护运行Codex时，模型误判导致删除$HOME目录。Tibo指出这并非预期行为，团队目前正采取更新开发者消息、引导更安全权限及增加防护等措施缓解风险，并将在未来几天分享详细事后分析。

![](https://assets.juya.uk/imagehub/aidaily/baf94cd9-84dd-4d1d-801b-33ed7daf45de/296d556b-5631-4ce3-b9a2-3e4f2f8d6fde/m001_2bb776b3.png)

相关链接：
- [https://x.com/thsottiaux/status/2077630111499882637](https://x.com/thsottiaux/status/2077630111499882637)

---

### [Tibo称Codex与ChatGPT Work达900万活跃用户并重置额度](https://x.com/thsottiaux/status/2077607697487188198) `#3`
> Codex 负责人 Tibo 于北京时间7月16日中午宣布 Codex 已达到 900 万活跃用户，并再次重置每周使用额度。

Codex 负责人 Tibo 于北京时间7月16日中午宣布，对 Codex 和 ChatGPT Work 用户再次重置每周使用额度。他表示该服务当日早些时候已实际达到 900 万活跃用户。此次重置及数据公布的推迟，是因为团队正忙于多项维持系统运行与可靠性的工作。

![](https://assets.juya.uk/imagehub/aidaily/baf94cd9-84dd-4d1d-801b-33ed7daf45de/13f0ac34-ee38-41c7-b3b1-5a2ff2519993/m001_071f9e5d.png)

相关链接：
- [https://x.com/thsottiaux/status/2077607697487188198](https://x.com/thsottiaux/status/2077607697487188198)

---

### [ClaudeDevs 重置所有用户 5 小时及每周速率限制](https://x.com/ClaudeDevs/status/2077603834453770467) `#4`
> Anthropic 开发者账号 ClaudeDevs 于北京时间7月16日中午宣布重置了所有用户的 5 小时和每周速率限制。

Anthropic 开发者账号 ClaudeDevs 于北京时间7月16日中午宣布，重置所有用户的 5 小时和每周速率限制。

![](https://assets.juya.uk/imagehub/aidaily/baf94cd9-84dd-4d1d-801b-33ed7daf45de/010a548f-6641-4d75-99f1-832d761afea8/m001_1bb1d377.png)

相关链接：
- [https://x.com/ClaudeDevs/status/2077603834453770467](https://x.com/ClaudeDevs/status/2077603834453770467)

---

## 模型发布

### [MiniMax正式上线Music 3.0音乐生成模型](https://platform.minimaxi.com/docs/guides/music-generation) `#5`
> MiniMax正式上线Music 3.0音乐生成模型。官方称该模型升级了语义理解、音质与人声合成能力，现已开放免费模型music-3-free供调用。

MiniMax正式发布新一代text-to-song音乐生成模型Music 3.0。官方表示，Music 3.0升级了语义理解模型以更准确理解风格与编曲，同时提升了器乐音质，支持滑音与连奏等真实技法，并采用新一代人声引擎消除高频机器嘶嘶声。目前，开发者与用户可通过API使用music-3.0模型，或使用免费模型music-3-free进行调用体验。

相关链接：
- [https://platform.minimaxi.com/docs/guides/music-generation](https://platform.minimaxi.com/docs/guides/music-generation)
- [https://minimaxi.com/audio/music](https://minimaxi.com/audio/music)

---

### [NVIDIA 推出开源 Nemotron 3 Embed 嵌入模型系列](https://huggingface.co/blog/nvidia/nemotron-3-embed-wins-rteb) `#6`
> NVIDIA 发布 Nemotron 3 Embed 开源嵌入模型系列，包含 8B 和 1B 两种参数规格。该系列模型支持 32k 上下文及商业使用。

NVIDIA 发布 Nemotron 3 Embed 嵌入模型系列，目前已在 Hugging Face 开放权重并支持商业使用。官方称旗舰版 Nemotron-3-Embed-8B-BF16 在 RTEB 基准得分 78.5% 位居第一，1B 版本通过结构化剪枝与蒸馏获得，而面向 Blackwell 架构的 NVFP4 量化版实现了最高两倍吞吐量。该系列模型均支持 32k 上下文窗口及 34 种语言检索，并提供微调、蒸馏配方及 NIM 微服务部署。

![](https://assets.juya.uk/imagehub/aidaily/baf94cd9-84dd-4d1d-801b-33ed7daf45de/de74b9e6-c7bc-4df1-8e79-ff1661c7180a/m001_7d6d65e5.png)

相关链接：
- [https://huggingface.co/blog/nvidia/nemotron-3-embed-wins-rteb](https://huggingface.co/blog/nvidia/nemotron-3-embed-wins-rteb)
- [https://build.nvidia.com/nvidia/nemotron-3-embed-1b](https://build.nvidia.com/nvidia/nemotron-3-embed-1b)
- [https://huggingface.co/nvidia/Nemotron-3-Embed-8B-BF16](https://huggingface.co/nvidia/Nemotron-3-Embed-8B-BF16)

---

### [Xiaomi Robotics发布Xiaomi-Robotics-1：采用10万小时免实体预训练](https://robotics.xiaomi.com/xiaomi-robotics-1.html) `#7`
> Xiaomi Robotics发布Xiaomi-Robotics-1模型，采用10万小时免实体预训练结合真实机器人后训练来突破数据瓶颈。官方称该模型学习新任务平均仅需不到10小时的演示数据，就能达到75%成功率。

Xiaomi Robotics发布Xiaomi-Robotics-1模型，当前已展示其通过大规模免实体预训练结合真实机器人后训练来扩展机器人策略模型的能力。该模型在预训练阶段使用了10万小时跨越1700多种场景的免实体轨迹数据，在后训练阶段则使用了包含7200小时真实家庭机器人数据在内的跨实体数据集。官方表示，预训练随数据和模型规模增长展现出了清晰的扩展性，且该扩展性可直接转化为真实机器人成功率的提升，并无饱和迹象。在下游应用中，Xiaomi-Robotics-1学习全新复杂任务时，每个任务平均仅需不到10小时的演示数据即可达到75%的总体成功率，并在四项主流仿真基准测试中达到了当前最优结果。

![](https://assets.juya.uk/imagehub/aidaily/baf94cd9-84dd-4d1d-801b-33ed7daf45de/d2aee6b5-0438-4a5b-acc2-e996f2ef3360/m001_dd685b5e.png)

相关链接：
- [https://robotics.xiaomi.com/xiaomi-robotics-1.html](https://robotics.xiaomi.com/xiaomi-robotics-1.html)

---

### [Muse Spark 1.1上线OpenRouter，仅面向美国开发者](https://x.com/MetaforDevs/status/2077804044505272425) `#8`
> Meta的Muse Spark {1.1|一点一}系列模型现已上线OpenRouter平台，但仅面向美国开发者开放。

Meta宣布Muse Spark 1.1模型已在OpenRouter平台上线，目前仅面向美国开发者开放。开发者可通过OpenRouter的聊天室或向其MCP提问来试用该模型，相关基准测试也将很快推出。

![](https://assets.juya.uk/imagehub/aidaily/baf94cd9-84dd-4d1d-801b-33ed7daf45de/10b42631-92f0-4ba5-bce6-e52ac20dd913/m001_004cb700.png)

相关链接：
- [https://x.com/MetaforDevs/status/2077804044505272425](https://x.com/MetaforDevs/status/2077804044505272425)
- [https://openrouter.ai/meta/muse-spark-1.1](https://openrouter.ai/meta/muse-spark-1.1)

---

## 开发生态

### [Anthropic 为 Claude Code 的 /code-review 新增多个 effort 级别](https://x.com/ClaudeDevs/status/2077840063342506351) `#9`
> Anthropic 为 Claude Code 的 /code-review 新增多个 effort 级别及专属审查策略。官方称其低级别即可在低 token 成本下优于同类工具。

Anthropic 为 Claude Code 的 /code-review 功能新增多个 effort 级别，每个级别采用不同审查策略，目前所有会话更新后可用。该功能此前仅运行固定提示词，现在会自动采用会话的 effort 设置或显式指定级别。官方称低级别单次扫描即可在极低 token 成本下优于同类工具；高级别则让 subagent 使用全新上下文以避免锚定并提高召回率。极限级别会生成审查 Agent 集群独立复现发现，Anthropic 在内部每个 PR 均运行该级别。

![](https://assets.juya.uk/imagehub/aidaily/baf94cd9-84dd-4d1d-801b-33ed7daf45de/230fbe78-a549-4508-80f8-cbb1e283179d/m001_4dd3be9a.png)

相关链接：
- [https://x.com/ClaudeDevs/status/2077840063342506351](https://x.com/ClaudeDevs/status/2077840063342506351)

---

### [MiniMax发布Code 2.0桌面端：重构底层架构，新增金融模块](https://mp.weixin.qq.com/s/mQeBO0xC6Z1R0LqZX5TvNg) `#10`
> MiniMax正式更新MiniMax Code 2.0桌面端并开放下载。新版基于Pi Agent重构底层架构，大幅提升了长程任务稳定性，并接入恒生金融数据库与企查查MCP。

MiniMax正式更新MiniMax Code 2.0桌面端并开放下载。基于开源框架Pi Agent，该版本重构了会话运行、状态管理与工具调用链路，重点改善长任务执行中的中断与上下文断裂问题。新版同时优化了图表与文件预览功能，并原生接入恒生金融数据库与企查查MCP的金融模块。该金融模块即将在桌面端上线，用户现可在网页版尝鲜，本月还将上线远程控制及浏览器操控等功能。

相关链接：
- [https://mp.weixin.qq.com/s/mQeBO0xC6Z1R0LqZX5TvNg](https://mp.weixin.qq.com/s/mQeBO0xC6Z1R0LqZX5TvNg)

---

### [Gemini API Managed Agents上线免费层级及预算护栏](https://x.com/GoogleAIStudio/status/2077801843720093867) `#11`
> Google为Gemini API的Managed Agents推出免费层级、预算控制与定时触发器。现在开发者能使用未启用计费的密钥免费调用该功能。

Google宣布为Gemini API中的Managed Agents推出免费层级、预算控制和定时触发器。免费层级允许开发者使用未启用计费的API密钥在免费配额下使用；预算控制通过在agent_config中设置max_total_tokens限制总Token消耗，达限时返回“incomplete”状态并保留文件系统进度，支持通过previous_interaction_id继续执行；定时触发器采用内置cron计划自动运行循环任务，并在同一沙盒环境中复用文件。

![](https://assets.juya.uk/imagehub/aidaily/baf94cd9-84dd-4d1d-801b-33ed7daf45de/bdca6083-3ade-4a98-a415-c2858b4c5585/m001_434326a4.png)

相关链接：
- [https://x.com/GoogleAIStudio/status/2077801843720093867](https://x.com/GoogleAIStudio/status/2077801843720093867)
- [https://ai.google.dev/gemini-api/docs/agents](https://ai.google.dev/gemini-api/docs/agents)

---

## 产品应用

### [Google将NotebookLM更名并升级为Gemini Notebook](https://blog.google/innovation-and-ai/products/gemini-notebook/notebooklm-gemini-notebook/) `#12`
> NotebookLM宣布更名为Gemini Notebook，并新增安全云电脑功能，以便直接运行代码并分析用户上传的数据。该功能目前向Google AI Ultra用户开放，未来数周内将向所有付费用户推送。

谷歌正式宣布将其AI研究助手NotebookLM更名为Gemini Notebook，以体现其在谷歌AI产品组合中的定位。该产品定位保持不变，但新增了一项重要功能：安全云电脑。这项更新让Gemini Notebook能够原生编写并执行代码，直接在用户上传的文档和资料上完成复杂数据分析。目前，这一功能已向Google AI Ultra用户和Workspace商业客户开放，并将在未来数周内推送给所有Pro订阅用户。

![](https://assets.juya.uk/imagehub/aidaily/baf94cd9-84dd-4d1d-801b-33ed7daf45de/18c533b3-cdaf-4d25-8442-c92efd0a22f5/m001_ecadb92d.gif)

相关链接：
- [https://blog.google/innovation-and-ai/products/gemini-notebook/notebooklm-gemini-notebook/](https://blog.google/innovation-and-ai/products/gemini-notebook/notebooklm-gemini-notebook/)
- [https://x.com/GoogleAI/status/2077816151200223389](https://x.com/GoogleAI/status/2077816151200223389)

---

### [官方宣布 SuperGrok Heavy 用户可免费获 X Premium+](https://x.com/premium/status/2077820074015293774) `#13`
> X 官方宣布 SuperGrok Heavy 订阅现包含 X Premium+，无需额外付费。用户需在 Grok 应用中链接 X 账户即可立即激活。

X 官方账号 Premium 宣布，SuperGrok Heavy 订阅现已包含 X Premium+，无需支付额外费用。用户只需在 Grok 应用中链接 X 账户，即可立即激活相应用户权益。对于已同时订阅这两项服务的用户，官方表示可取消原有付费的 X Premium+ 订阅。包含在 SuperGrok Heavy 中的随附 X Premium+ 将在当前计费周期结束后自动继续，福利不会中断。

相关链接：
- [https://x.com/premium/status/2077820074015293774](https://x.com/premium/status/2077820074015293774)
- [https://x.com/premium/status/2077820076083089755](https://x.com/premium/status/2077820076083089755)

---

### [Google 搜索 AI Mode 允许用户直接联动第三方应用](https://blog.google/products-and-platforms/products/search/connected-apps/) `#14`
> Google 宣布 AI Mode 上线连接应用功能，本周起在美国推出。用户可直接在搜索中联动第三方应用并执行操作。

Google 宣布在搜索的 AI Mode 中上线连接应用功能，本周起在美国推出。用户可安全地连接 Instacart、Canva 和 YouTube Music 等服务，直接在搜索结果中将食材加入购物车、查看设计模板或保存播放列表。结合个人智能技术，AI Mode 将提供更具针对性的回复。此前该连接功能已在 Gemini 应用中提供，此次扩展将其引入搜索，未来还将支持更多应用。

![](https://assets.juya.uk/imagehub/aidaily/baf94cd9-84dd-4d1d-801b-33ed7daf45de/2db89d7d-e16b-40ff-becc-e52ab83d5e70/m001_690e95d1.png)

相关链接：
- [https://blog.google/products-and-platforms/products/search/connected-apps/](https://blog.google/products-and-platforms/products/search/connected-apps/)

---

### [OpenAI 扩展 ChatGPT 青少年保护，支持默认开启学习模式](https://openai.com/index/why-teens-deserve-access-safe-ai/) `#15`
> OpenAI 更新了 ChatGPT 青少年保护功能。家长现可将学习模式设为新对话的默认选项，青少年长时间使用会收到更频繁的休息提醒。

OpenAI 更新了 ChatGPT 针对青少年的保护措施和学习工具。家长现可通过家长控制将学习模式设为新对话的默认开启状态，同时长时间使用的青少年将收到更频繁的休息提醒。家长通知也已扩展至账号因违反暴力使用政策而被停用的情况，且官方数据显示其互动学习体验已拥有 1800 万周活跃用户。在学习功能上，平台还新增了教育起始提示词、超 250 个互动主题以及支持 61 种以上语言的发音体验。

相关链接：
- [https://openai.com/index/why-teens-deserve-access-safe-ai/](https://openai.com/index/why-teens-deserve-access-safe-ai/)

---

### [努比亚发布 NaviX Ultra 搭载豆包手机助手](https://weibo.com/2156294570/R8Vg2oTv8) `#16`
> 努比亚 NaviX Ultra 正式亮相。官方称其为全球首款 AI 智能体手机，搭载豆包手机助手，同步提供四款配色。

努比亚 NaviX Ultra 正式亮相。官方称该机是全球首款 AI 智能体手机，搭载豆包手机助手。该机同步登场蓝境、幻梦、黑色和白色四款配色。官方同时宣布努比亚 NaviX Ultra 荣获 WAIC 2026 SAIL 卓越人工智能引领者奖。

![](https://assets.juya.uk/imagehub/aidaily/baf94cd9-84dd-4d1d-801b-33ed7daf45de/163e709b-f3a3-46d3-b688-5c023e2196fc/m001_7740e6a6.png)

相关链接：
- [https://weibo.com/2156294570/R8Vg2oTv8](https://weibo.com/2156294570/R8Vg2oTv8)

---

## 技术与洞察

### [Kimi 发布 PerceptionBench 视觉感知评测基准](https://www.kimi.com/blog/perception-bench) `#17`
> Kimi 发布PerceptionBench评测基准，专门评估多模态大模型的原子视觉感知能力。官方评测结果显示，当前所有参评前沿模型的准确率均未超过60%。同时，大量正确答案在重复提问时无法重现，表明现有模型大多是在猜测，而非真正感知视觉信息。

Kimi 发布 PerceptionBench 评测基准，用于衡量多模态大语言模型的原子视觉感知能力。该基准从 40 多个现有基准的模型失败案例中提炼出 10 项原子感知类别，包含 3000 个仅依赖视觉感知的已验证问题。官方评测结果显示，当前所有参评前沿模型准确率均未超过 60%，其中 GPT-5.6-Sol 以 59.7% 居首。此外，总分相近的模型在具体感知能力上优劣势差异显著，且大量正确答案在重复提问时无法重现，表明模型往往在猜测而非真正感知。

![](https://assets.juya.uk/imagehub/aidaily/baf94cd9-84dd-4d1d-801b-33ed7daf45de/8d0b0fbc-d458-4957-a389-e09c90e985fe/m001_97115068.png)

相关链接：
- [https://www.kimi.com/blog/perception-bench](https://www.kimi.com/blog/perception-bench)

---

## 行业动态

### [英特尔与谷歌云扩大合作，部署 Gemini Enterprise 加速企业 AI 转型](https://www.googlecloudpresscorner.com/2026-07-16-Intel-and-Google-Cloud-Announce-Collaboration-to-Accelerate-Intels-AI-Enabled-Enterprise-Transformation) `#18`
> 英特尔与谷歌云宣布扩大战略合作，全面部署 Gemini Enterprise 加速企业 AI 转型。同时，借助谷歌云的 C4 和 N4 实例扩展计算能力，运行复杂模拟，从而加速半导体芯片的开发周期。

英特尔与谷歌云宣布扩大先前公布的多年战略合作，将通过部署 Gemini Enterprise 和谷歌云加速英特尔的企业 AI 转型。英特尔将在全球员工中集成基于 Gemini 的生成式 AI，并采用 Gemini Enterprise Agent Platform 构建业务 Agent 以自动化核心流程。谷歌云的可扩展基础设施将补充英特尔本地计算能力，通过扩展至 C4 和 N4 实例运行复杂模拟以加速芯片开发。双方高管表示，此次合作将提供集中的 Agent 构建中心并创建加速芯片设计的自主基础。

![](https://assets.juya.uk/imagehub/aidaily/baf94cd9-84dd-4d1d-801b-33ed7daf45de/ddadeb1b-6ab5-4760-84f2-c43c68021963/m001_d58cb2eb.png)

相关链接：
- [https://www.googlecloudpresscorner.com/2026-07-16-Intel-and-Google-Cloud-Announce-Collaboration-to-Accelerate-Intels-AI-Enabled-Enterprise-Transformation](https://www.googlecloudpresscorner.com/2026-07-16-Intel-and-Google-Cloud-Announce-Collaboration-to-Accelerate-Intels-AI-Enabled-Enterprise-Transformation)
- [https://newsroom.intel.com/data-center/intel-google-deepen-collaboration-to-Advance-ai-infrastructure](https://newsroom.intel.com/data-center/intel-google-deepen-collaboration-to-Advance-ai-infrastructure)

---

### [据报道一男子潜入Anthropic大厅发出死亡威胁，无人被捕](https://www.wsj.com/us-news/the-ai-backlash-has-tech-executives-fearing-for-their-lives-30c43972) `#19`
> 据《华尔街日报》查阅的事件记录，一名男子此前潜入Anthropic旧金山总部大厅，向安保人员警告一名高管“将被杀害”。此次潜入未引发暴力冲突且无人被捕，Anthropic未确认此事，称自2024年起已实行全天候安保。

据《华尔街日报》查阅的事件记录，一名男子此前尾随员工潜入Anthropic旧金山总部大厅，向安保人员出示印有某高管名字的信封，并警告该高管“将被杀害”。该事件未升级为暴力冲突且未逮捕人员。Anthropic未确认此次事件，仅表示自2024年起已实行全天候安保，且安保团队受训以缓和局势而非拘留。此外，警方记录显示4月和6月另有两人分别对Anthropic员工发出暴力威胁。

相关链接：
- [https://www.wsj.com/us-news/the-ai-backlash-has-tech-executives-fearing-for-their-lives-30c43972](https://www.wsj.com/us-news/the-ai-backlash-has-tech-executives-fearing-for-their-lives-30c43972)

---

**提示**：内容由AI辅助创作，可能存在**幻觉**和**错误**。
