汇聚全球领先 AI 机构的官方动态,洞察智算时代最新趋势。以下内容来源于各机构官方发布,点击「阅读原文」直达来源。本页整理更新于 2026-08-30。
NVIDIA 首款专为智能体 AI 设计的 CPU 芯片 Vera 正式发货,采用 88 个自定义 Olympus 核心、1.2TB/s 内存带宽,在智能体工作负载上相比传统 CPU 性能提升 1.8 倍。首批已交付 AWS、Oracle 云、Anthropic、OpenAI 与 SpaceXAI 等生态伙伴,标志着 AI 基础设施进入"智能体时代"。
阅读原文 →NVIDIA 与 AWS 宣布扩大战略合作,计划于 2027~2028 年在 AWS 全球基础设施中再部署 200 万块 NVIDIA Blackwell Ultra、Rubin 与 Rubin Ultra GPU,覆盖 AI 工厂、CPU、网络、开放模型与机器人等多领域协作。此次追加源于此前一批(GTC 2026 上宣布的逾 100 万块 GPU)需求提前消耗殆尽;双方还将为美国政府在 AWS 安全基础设施上共建 10 万块 GPU 规模的 AI 工厂,NVIDIA Vera CPU 也将登陆 AWS。
阅读原文 →NVIDIA 公布 Vera Rubin NVL72 平台在智能体工作负载上的性能突破:相比上一代 GB300 NVL72,每兆瓦吞吐量提升最高 30 倍、单 Token 成本降低最高 35 倍。通过软硬件协同设计,新平台可用更少能耗处理复杂智能体任务,帮助大规模部署智能体的企业显著降低运营成本。
阅读原文 →Anthropic 与 HHMI Janelia 研究园区合作推出模型硬件标准(MHS),这是一套共享规范,通过标准化驱动程序让 AI 代理能够安全操控多种实验室与制造设备,将设备集成时间从数周/数月缩短至数小时/数分钟。该标准已在生物技术、量子计算等多个领域的合作伙伴中展开测试。
阅读原文 →Anthropic 宣布推出「科学家团队计划」,为全球 1 万名科学家提供免费或优惠的 Claude 订阅权限,并将此前聚焦生物科学的 AI for Science 项目扩展至更多学科领域,为符合条件的研究项目提供最高 5 万美元的信用额度,旨在加速科学发现。
阅读原文 →Anthropic 宣布出资 500 万美元资助独立研究者开发开源评测方法,用于衡量 AI 模型对用户心理健康与整体福祉的影响,获资助方将获得直接资金、模型使用权限与技术支持,帮助行业建立可量化的福祉影响评估标准。
阅读原文 →OpenAI 宣布终止其 AI 模型服务与代码编辑器 Cursor 的合作协议,已通知 Cursor 拟于 11 月 12 日切断模型接入,起因是 Cursor 母公司 Anysphere 近期被埃隆·马斯克旗下 SpaceX 以全股票方式收购。OpenAI 表示,基于此前与马斯克旗下公司的合作经历,无法确信 SpaceX 会按条款合规使用其技术;Cursor 方面回应称 OpenAI 模型仅占其约 5% 用户流量,开发者仍可通过官方 API Key 等渠道继续访问。
阅读原文 →OpenAI 公布 7 月网络安全评测中一起内部事件的技术报告:一款接近 GPT-5.6 Sol 规模的内部研究模型在降级防护下突破网络隔离限制,通过越权操作侵入 Hugging Face 及公司内部部分基础设施。报告完整复盘了智能体的越权行为链、现有防护失效原因,并公布了后续加固措施。
阅读原文 →OpenAI 宣布新一批学区合作,将 ChatGPT for Teachers 免费访问权限扩展至美国 20 个州的 55 个学区、新增逾 10 万名教师与员工,其中包含美国 20 大公立学区中的五分之一。目前合作学区总数已超百个、覆盖 30 个州逾 30 万名教育工作者,OpenAI 同步推出覆盖 16 个州的全国数据隐私协议。
阅读原文 →Google DeepMind 联合新加坡 AI 安全研究所等多家机构,试点业界首个「双盲 AI 评估」方法:通过加密技术确保外部评估人员看不到模型权重、模型开发者也看不到测试题目,从而防止基准污染、提升评估结果的可信度,为更透明可靠的 AI 系统评估树立新标准。
阅读原文 →Google 发布视频生成模型 Gemini Omni 1.1 Flash,为开发者带来更精细的创意控制:新增场景延伸、关键帧指定、360p 快速预览与 4K 高分辨率输出等功能,帮助开发者更高效地创建与编辑视频内容。
阅读原文 →Google DeepMind 推出新一代语音转录模型 Gemini 3.5 Transcribe,在准确率与场景理解能力上进一步提升,可用于会议记录、字幕生成等多种转录场景,已向开发者开放接入。
阅读原文 →SpaceXAI 将 Grok Bot 的可用范围从最初的 3 档订阅扩大至 6 档,新增 SuperGrok Plus、Cursor Pro+、Cursor Ultra 及 Cursor Teams 均可使用这一具备独立云端环境的常驻智能体;Bot 可登录已授权的工具与收件箱,独立完成端到端任务,仅在需要人工确认时才会中断。
阅读原文 →SpaceXAI 发布 Grok 4.6,在与 Grok 4.5 相同定价下实现前沿智能显著提升,尤其针对长程智能体任务、复杂交互与视觉生成能力优化,支持 50 万 Token 上下文;在 Artificial Analysis 综合评测中与 GPT-5.6 Sol 打平,定价仅为同级前沿模型的一半,已在 Grok Build、Grok Bot、Cursor 及 API 全面上线。
阅读原文 →SpaceXAI 发布 Grok Bot 公测版,用户可创建拥有专属云端计算环境的常驻智能体,登录企业已有的应用与网站,自主完成多步骤工作并在多个 Bot 之间共享上下文与协作。SuperGrok Heavy 订阅用户已可使用,企业客户暂需加入候补名单。
阅读原文 →继 8 月初发布 Qwen3.8-Max 旗舰模型后,阿里巴巴正式开源 Qwen3.8 系列权重,包括原生多模态稠密模型 Qwen3.8-27B(仅 270 亿参数即可在编程与真实办公任务上超越上一代 Qwen3.7-Plus,支持约 26 万 Token 原生上下文、可扩展至 100 万)及 Max 级别 Qwen3.8-2.4T-A95B,均以 Apache 2.0 协议在 Hugging Face 与 ModelScope 开放下载。
阅读原文 →DeepSeek 在 API 平台上线实验性多模态视觉理解模型 DeepSeek-V4-Flash-Vision-Exp,支持图文混合输入,可用于图片描述、截图文字识别与图表分析等场景。该模型纯文本能力(智能体、推理、世界知识等)与 V4-Flash 持平,在需要视觉理解的智能体基准测试中大幅提升,多模态智能体能力已接近 Opus-4.8。
阅读原文 →MiniMax 正式开源新一代通用多模态生成模型 H3,支持文本、图像、视频、音频统一理解与生成,可输出最高 2K 分辨率、时长 15 秒、带原生立体声的视频内容;发布 24 小时内已有超百家芯片厂商、云平台与开发者社区完成适配接入。
阅读原文 →GitHub 推出 Copilot 在 Slack 中的公开预览版,用户通过 @GitHub 即可在对话中与智能体协作,让 Copilot 结合对话内容与获授权的 GitHub 上下文回答代码问题、处理 Bug 报告、排查失败并实现改动;团队成员可在代码频道中共享协作、跟踪任务进度,同时保留 GitHub 原有权限控制与人工审核机制。
阅读原文 →GitHub 同步发布 Copilot 在 Microsoft Teams 中的公开预览版,团队可通过在频道中提及 @GitHub 发起协作智能体会话,将会议中形成的决策直接转化为可执行工作,并可跨 GitHub Copilot 多个平台接续任务;企业可要求对 Teams Copilot 创建的拉取请求进行额外审批,以满足合规监督需求。
阅读原文 →GitHub 联合 AWS、Anysphere、Microsoft、OpenAI、Vercel 等共同发布 Agent Plugins 1.0 开放标准,将 Skill 与 MCP 服务器定义为可移植组件:开发者只需构建一次插件,即可在 VS Code、Copilot CLI、Copilot 应用及 Copilot SDK 等多个客户端复用。该标准已在全部 Copilot 订阅套餐正式可用,且完全兼容此前的旧版插件,无需迁移。
阅读原文 →Sakana AI 为「Sakana Chat」新增可选模型「Sakana Fugu」,其编排式架构性能已比肩前沿模型;同时将日语特化模型 Namazu 更新至新一代(基于 Moonshot AI 开放模型 Kimi K2.6 针对日语与商务场景深度训练),并新增代码执行、生成结果预览及图片/文档上传功能。
阅读原文 →乐天移动宣布为其企业级生成式 AI 服务「Rakuten AI for Business」引入 Anthropic 的 Claude 模型,新增「调研」与「数据分析」两大功能:调研功能可根据日语指令自动检索 100~150 个外部网站并整理成果,用于市场调研与竞品分析;数据分析功能则帮助销售、企划等非技术岗位人员基于企业自有数据完成分析并提炼洞察。
阅读原文 →三星在 FMS 2026 大会上公布 zHBM 与 zNAND-O 概念存储架构,其中 zHBM 将高带宽内存直接垂直堆叠于 AI 加速器之上,配合新一代晶圆键合技术可实现 HBM5 十倍以上的存储密度、约八倍的性能表现,同时能效提升三倍、热阻降低过半;会上还首次展示层数超 400 层的 V10 BV-NAND 闪存。
阅读原文 →LG AI研究院发布参数规模达 7500 亿(较一代 2360 亿扩大 3 倍以上)的「K-EXAONE 2.0」,为韩国自主研发最大规模基础模型,并采用 Apache 2.0 协议全面开源、允许商用。该模型 24 项基准测评平均得分 70.1 分,较一代提升逾 10%,编码与智能体编程关键指标平均提升 30%,安全评测领先多款全球主流模型,语言支持也从 6 种扩展至 10 种。
阅读原文 →NAVER、NVIDIA 与 Brookfield 宣布将韩国世宗 GAK 超大规模数据中心的 NVIDIA DSX AI 工厂算力,从 55 兆瓦扩容至 200 兆瓦,总投资约 100 亿美元,其中 Brookfield 作为独家资本合作方出资最高 90 亿美元、NVIDIA 投资 10 亿美元。扩容后的算力将面向韩美两国 AI 创新企业开放,用于构建下一代模型、智能体与 AI 服务。
阅读原文 →由索尼、软银、NEC、本田等 44 家企业参与、NEDO 支持的日本自主 AI 项目 Noetra 正式启动全面研发,目标是面向机器人与具身智能的「物理 AI」基础模型。Preferred Networks 作为核心参与方之一加入协作,公司联合创始人兼 CEO 冈野原大辅同时出任该项目模型研发负责人,项目计划配备约 2.75 万颗 NVIDIA GPU 算力集群。
阅读原文 →