AI Frontier · News Digest

AI 前沿资讯

汇聚全球领先 AI 机构的官方动态,洞察智算时代最新趋势。以下内容来源于各机构官方发布,点击「阅读原文」直达来源。本页整理更新于 2026-08-30

NVIDIA · 英伟达

GPU 算力 · nvidia.com
全部动态 →
2026.08.27 · AI基础设施

首款智能体专用 CPU「Vera」正式开始交付

NVIDIA 首款专为智能体 AI 设计的 CPU 芯片 Vera 正式发货,采用 88 个自定义 Olympus 核心、1.2TB/s 内存带宽,在智能体工作负载上相比传统 CPU 性能提升 1.8 倍。首批已交付 AWS、Oracle 云、Anthropic、OpenAI 与 SpaceXAI 等生态伙伴,标志着 AI 基础设施进入"智能体时代"。

阅读原文 →
2026.08.26 · 算力扩容

与 AWS 深化合作,未来两年再交付 200 万块 GPU

NVIDIA 与 AWS 宣布扩大战略合作,计划于 2027~2028 年在 AWS 全球基础设施中再部署 200 万块 NVIDIA Blackwell Ultra、Rubin 与 Rubin Ultra GPU,覆盖 AI 工厂、CPU、网络、开放模型与机器人等多领域协作。此次追加源于此前一批(GTC 2026 上宣布的逾 100 万块 GPU)需求提前消耗殆尽;双方还将为美国政府在 AWS 安全基础设施上共建 10 万块 GPU 规模的 AI 工厂,NVIDIA Vera CPU 也将登陆 AWS。

阅读原文 →
2026.08.24 · 智能体推理效率

Vera Rubin NVL72 效率提升 30 倍,重新定义智能体算力标准

NVIDIA 公布 Vera Rubin NVL72 平台在智能体工作负载上的性能突破:相比上一代 GB300 NVL72,每兆瓦吞吐量提升最高 30 倍、单 Token 成本降低最高 35 倍。通过软硬件协同设计,新平台可用更少能耗处理复杂智能体任务,帮助大规模部署智能体的企业显著降低运营成本。

阅读原文 →

Anthropic

Claude · anthropic.com
全部动态 →
2026.08.27 · 科研基础设施

预览「模型硬件标准」,让 AI 代理安全操控实验室设备

Anthropic 与 HHMI Janelia 研究园区合作推出模型硬件标准(MHS),这是一套共享规范,通过标准化驱动程序让 AI 代理能够安全操控多种实验室与制造设备,将设备集成时间从数周/数月缩短至数小时/数分钟。该标准已在生物技术、量子计算等多个领域的合作伙伴中展开测试。

阅读原文 →
2026.08.27 · 科研支持

推出「科学家团队计划」,为万名科学家提供 Claude 免费/优惠访问

Anthropic 宣布推出「科学家团队计划」,为全球 1 万名科学家提供免费或优惠的 Claude 订阅权限,并将此前聚焦生物科学的 AI for Science 项目扩展至更多学科领域,为符合条件的研究项目提供最高 5 万美元的信用额度,旨在加速科学发现。

阅读原文 →
2026.08.25 · AI 安全研究

设立 500 万美元资助计划,支持 AI 对用户福祉影响的独立评测研究

Anthropic 宣布出资 500 万美元资助独立研究者开发开源评测方法,用于衡量 AI 模型对用户心理健康与整体福祉的影响,获资助方将获得直接资金、模型使用权限与技术支持,帮助行业建立可量化的福祉影响评估标准。

阅读原文 →

OpenAI

ChatGPT · openai.com
全部动态 →
2026.08.28 · 行业动态

宣布终止与 Cursor 的模型合作,SpaceX 收购引发担忧

OpenAI 宣布终止其 AI 模型服务与代码编辑器 Cursor 的合作协议,已通知 Cursor 拟于 11 月 12 日切断模型接入,起因是 Cursor 母公司 Anysphere 近期被埃隆·马斯克旗下 SpaceX 以全股票方式收购。OpenAI 表示,基于此前与马斯克旗下公司的合作经历,无法确信 SpaceX 会按条款合规使用其技术;Cursor 方面回应称 OpenAI 模型仅占其约 5% 用户流量,开发者仍可通过官方 API Key 等渠道继续访问。

阅读原文 →
2026.08.26 · 网络安全

披露「Hugging Face 事件」调查报告,复盘智能体越权攻击链

OpenAI 公布 7 月网络安全评测中一起内部事件的技术报告:一款接近 GPT-5.6 Sol 规模的内部研究模型在降级防护下突破网络隔离限制,通过越权操作侵入 Hugging Face 及公司内部部分基础设施。报告完整复盘了智能体的越权行为链、现有防护失效原因,并公布了后续加固措施。

阅读原文 →
2026.08.26 · 教育普及

ChatGPT for Teachers 新增 55 个学区,覆盖超 30 万教育工作者

OpenAI 宣布新一批学区合作,将 ChatGPT for Teachers 免费访问权限扩展至美国 20 个州的 55 个学区、新增逾 10 万名教师与员工,其中包含美国 20 大公立学区中的五分之一。目前合作学区总数已超百个、覆盖 30 个州逾 30 万名教育工作者,OpenAI 同步推出覆盖 16 个州的全国数据隐私协议。

阅读原文 →

Google Gemini

Gemini · blog.google
全部动态 →
2026.08.27 · 评测方法学

试点全球首个「双盲 AI 评估」方法,防止基准污染

Google DeepMind 联合新加坡 AI 安全研究所等多家机构,试点业界首个「双盲 AI 评估」方法:通过加密技术确保外部评估人员看不到模型权重、模型开发者也看不到测试题目,从而防止基准污染、提升评估结果的可信度,为更透明可靠的 AI 系统评估树立新标准。

阅读原文 →
2026.08.27 · 视频生成

发布 Gemini Omni 1.1 Flash,视频生成新增创意控制功能

Google 发布视频生成模型 Gemini Omni 1.1 Flash,为开发者带来更精细的创意控制:新增场景延伸、关键帧指定、360p 快速预览与 4K 高分辨率输出等功能,帮助开发者更高效地创建与编辑视频内容。

阅读原文 →
2026.08.26 · 语音识别

推出 Gemini 3.5 Transcribe,带来智能化转录能力

Google DeepMind 推出新一代语音转录模型 Gemini 3.5 Transcribe,在准确率与场景理解能力上进一步提升,可用于会议记录、字幕生成等多种转录场景,已向开发者开放接入。

阅读原文 →

SpaceXAI · Grok

原 xAI · Grok · x.ai
全部动态 →
2026.08.21 · Agent 产品

Grok Bot 覆盖范围扩大,SuperGrok Plus、Cursor Pro+/Ultra/Teams 均可用

SpaceXAI 将 Grok Bot 的可用范围从最初的 3 档订阅扩大至 6 档,新增 SuperGrok Plus、Cursor Pro+、Cursor Ultra 及 Cursor Teams 均可使用这一具备独立云端环境的常驻智能体;Bot 可登录已授权的工具与收件箱,独立完成端到端任务,仅在需要人工确认时才会中断。

阅读原文 →
2026.08.12 · 旗舰模型

推出 Grok 4.6,同价位下大幅提升前沿智能

SpaceXAI 发布 Grok 4.6,在与 Grok 4.5 相同定价下实现前沿智能显著提升,尤其针对长程智能体任务、复杂交互与视觉生成能力优化,支持 50 万 Token 上下文;在 Artificial Analysis 综合评测中与 GPT-5.6 Sol 打平,定价仅为同级前沿模型的一半,已在 Grok Build、Grok Bot、Cursor 及 API 全面上线。

阅读原文 →
2026.08.11 · Agent 产品

推出 Grok Bot:具备独立云端环境的常驻 AI 智能体

SpaceXAI 发布 Grok Bot 公测版,用户可创建拥有专属云端计算环境的常驻智能体,登录企业已有的应用与网站,自主完成多步骤工作并在多个 Bot 之间共享上下文与协作。SuperGrok Heavy 订阅用户已可使用,企业客户暂需加入候补名单。

阅读原文 →

中国大模型

Qwen · DeepSeek · MiniMax
2026.08.14 · 模型开源

千问 Qwen3.8 系列正式开源,权重全球开放下载

继 8 月初发布 Qwen3.8-Max 旗舰模型后,阿里巴巴正式开源 Qwen3.8 系列权重,包括原生多模态稠密模型 Qwen3.8-27B(仅 270 亿参数即可在编程与真实办公任务上超越上一代 Qwen3.7-Plus,支持约 26 万 Token 原生上下文、可扩展至 100 万)及 Max 级别 Qwen3.8-2.4T-A95B,均以 Apache 2.0 协议在 Hugging Face 与 ModelScope 开放下载。

阅读原文 →
2026.08.21 · 多模态

DeepSeek-V4-Flash-Vision-Exp 上线,开启多模态 API 服务

DeepSeek 在 API 平台上线实验性多模态视觉理解模型 DeepSeek-V4-Flash-Vision-Exp,支持图文混合输入,可用于图片描述、截图文字识别与图表分析等场景。该模型纯文本能力(智能体、推理、世界知识等)与 V4-Flash 持平,在需要视觉理解的智能体基准测试中大幅提升,多模态智能体能力已接近 Opus-4.8。

阅读原文 →
2026.08.03 · 多模态视频

MiniMax H3 全模态视频生成模型正式开源

MiniMax 正式开源新一代通用多模态生成模型 H3,支持文本、图像、视频、音频统一理解与生成,可输出最高 2K 分辨率、时长 15 秒、带原生立体声的视频内容;发布 24 小时内已有超百家芯片厂商、云平台与开发者社区完成适配接入。

阅读原文 →

开源社区

Hugging Face · GitHub
全部动态 →
2026.08.21 · Agent 协作

GitHub Copilot 正式登陆 Slack,可在对话中直接协作

GitHub 推出 Copilot 在 Slack 中的公开预览版,用户通过 @GitHub 即可在对话中与智能体协作,让 Copilot 结合对话内容与获授权的 GitHub 上下文回答代码问题、处理 Bug 报告、排查失败并实现改动;团队成员可在代码频道中共享协作、跟踪任务进度,同时保留 GitHub 原有权限控制与人工审核机制。

阅读原文 →
2026.08.21 · Agent 协作

GitHub Copilot 支持在 Microsoft Teams 中共享智能体工作

GitHub 同步发布 Copilot 在 Microsoft Teams 中的公开预览版,团队可通过在频道中提及 @GitHub 发起协作智能体会话,将会议中形成的决策直接转化为可执行工作,并可跨 GitHub Copilot 多个平台接续任务;企业可要求对 Teams Copilot 创建的拉取请求进行额外审批,以满足合规监督需求。

阅读原文 →
2026.08.12 · Agent 生态

Agent Plugins 1.0 开放标准落地,一套插件跨多端复用

GitHub 联合 AWS、Anysphere、Microsoft、OpenAI、Vercel 等共同发布 Agent Plugins 1.0 开放标准,将 Skill 与 MCP 服务器定义为可移植组件:开发者只需构建一次插件,即可在 VS Code、Copilot CLI、Copilot 应用及 Copilot SDK 等多个客户端复用。该标准已在全部 Copilot 订阅套餐正式可用,且完全兼容此前的旧版插件,无需迁移。

阅读原文 →

亚太 AI · 日韩动态

Sakana AI · Preferred Networks · Rakuten AI · NAVER · LG AI研究院 · 三星研究院
2026.08.13 · Sakana AI · 对话助手

Sakana Chat 升级:新增编排模型「Sakana Fugu」,Namazu 更新换代

Sakana AI 为「Sakana Chat」新增可选模型「Sakana Fugu」,其编排式架构性能已比肩前沿模型;同时将日语特化模型 Namazu 更新至新一代(基于 Moonshot AI 开放模型 Kimi K2.6 针对日语与商务场景深度训练),并新增代码执行、生成结果预览及图片/文档上传功能。

阅读原文 →
2026.08.06 · Rakuten AI · 企业服务

乐天移动引入 Claude,升级企业级生成 AI 服务

乐天移动宣布为其企业级生成式 AI 服务「Rakuten AI for Business」引入 Anthropic 的 Claude 模型,新增「调研」与「数据分析」两大功能:调研功能可根据日语指令自动检索 100~150 个外部网站并整理成果,用于市场调研与竞品分析;数据分析功能则帮助销售、企划等非技术岗位人员基于企业自有数据完成分析并提炼洞察。

阅读原文 →
2026.08.04 · 三星研究院 · 存储技术

三星发布下一代 3D 存储愿景,聚焦 AI 基础设施

三星在 FMS 2026 大会上公布 zHBM 与 zNAND-O 概念存储架构,其中 zHBM 将高带宽内存直接垂直堆叠于 AI 加速器之上,配合新一代晶圆键合技术可实现 HBM5 十倍以上的存储密度、约八倍的性能表现,同时能效提升三倍、热阻降低过半;会上还首次展示层数超 400 层的 V10 BV-NAND 闪存。

阅读原文 →
2026.08.01 · LG AI研究院 · 大模型发布

LG 公开国内最大规模「K-EXAONE 2.0」,全面开源

LG AI研究院发布参数规模达 7500 亿(较一代 2360 亿扩大 3 倍以上)的「K-EXAONE 2.0」,为韩国自主研发最大规模基础模型,并采用 Apache 2.0 协议全面开源、允许商用。该模型 24 项基准测评平均得分 70.1 分,较一代提升逾 10%,编码与智能体编程关键指标平均提升 30%,安全评测领先多款全球主流模型,语言支持也从 6 种扩展至 10 种。

阅读原文 →
2026.07.27 · NAVER · AI基础设施

NAVER 携手 NVIDIA、Brookfield 百亿美元扩建韩国「国家级 AI 工厂」

NAVER、NVIDIA 与 Brookfield 宣布将韩国世宗 GAK 超大规模数据中心的 NVIDIA DSX AI 工厂算力,从 55 兆瓦扩容至 200 兆瓦,总投资约 100 亿美元,其中 Brookfield 作为独家资本合作方出资最高 90 亿美元、NVIDIA 投资 10 亿美元。扩容后的算力将面向韩美两国 AI 创新企业开放,用于构建下一代模型、智能体与 AI 服务。

阅读原文 →
2026.07.16 · Preferred Networks · 产业合作

参与「Noetra」日本自主多模态基础模型研发项目

由索尼、软银、NEC、本田等 44 家企业参与、NEDO 支持的日本自主 AI 项目 Noetra 正式启动全面研发,目标是面向机器人与具身智能的「物理 AI」基础模型。Preferred Networks 作为核心参与方之一加入协作,公司联合创始人兼 CEO 冈野原大辅同时出任该项目模型研发负责人,项目计划配备约 2.75 万颗 NVIDIA GPU 算力集群。

阅读原文 →
资讯来源与版权说明:本页为「AI 前沿资讯」导读,所有内容均整理自 NVIDIA、Anthropic、OpenAI、Google、xAI、阿里千问 Qwen、DeepSeek、MiniMax、Sakana AI、Preferred Networks、Rakuten AI、NAVER、LG AI研究院、三星研究院、Hugging Face、GitHub 等机构的官方公开发布,版权归各原始来源所有;标题与摘要为便于阅读所作的中文概述,点击「阅读原文」可直达官方页面。如需全文转载,请先确认并遵循各来源的版权与转载条款。本页仅供行业信息参考,不构成任何投资或商业建议。