2026年9月最新科技新闻:AI人工智能领域合集
IT时代网9月19日消息,2026年9月,人工智能领域继续保持高频迭代:国内多家厂商集中更新大模型,AI 助手进一步嵌入办公软件与操作系统,算力基础设施与安全治理也有新进展。以下按方向梳理本月值得关注的动态。
一、大模型密集迭代
阶跃星辰推出新一代大模型 Step 5 Preview,参数量 6000 亿,跳过 Step 4.X 系列直接进入 Step 5 阶段。据第三方评测榜单 Artificial Analysis 的数据,该模型总分为 44 分,与参数量 2.8 万亿的 Kimi K3 持平,略低于 GLM-5.3 与 Opus 5 的 45 分。在侧重编程负载的 Terminal-Bench 4.0 测试中,它取得 33.3%。价格方面,每百万输入 token 为 1 美元、每百万输出 token 为 2.7 美元,输出速度为每秒 100 个 token,配套的 Token Plan 套餐起步价 49 元。
中国电信于 9 月 17 日发布新一代星辰大模型 Xing4.0-29B-A4B,总参数量 29B、激活参数仅 4B,原生支持 256K 上下文窗口,可扩展至 512K。按官方说法,这是国内首个基于国产算力与国产框架完成训练、面向复杂工程任务深度优化的百亿参数大模型,训练环节使用昇腾芯片。该模型在 SuperCLUE 智能体能力评测中以 93.52 分位列第三,与两款头部 Qwen 模型差距不足 1 分;经 4-bit 量化后显存占用降至 15GB,RTX 3090、RTX 4090 这类 24G 显存显卡即可在本地运行长上下文任务。
阿里千问上线原生全模态模型 Qwen3.8-Omni-Flash,可同时处理文本、图像、音频和视频输入,支持 1M 上下文。官方称其在累计 30 项评测上相比上一代平均得分提升超过 26%,同时每小时音频输入价格降幅超过 98%,每小时音视频输入价格降幅超过 93%。
智谱推出 GLM-5.3-FlashX,最高输出速度可达每秒 200 个 token,其推理算力由 10 万张国产芯片提供。阿里千问同期发布同声传译大模型 Qwen3.8-LiveTranslate,字均延迟从 2.8 秒降至 2.3 秒,在支持 60 种语言的基础上增加了实时说话人分离、原文译文同帧同出与长上下文消歧三项能力。
谷歌方面,有网友反馈其正以 gemini-3.8-flash 的名称在 Arena 等基准平台测试最强模型 Gemini 4 Pro,内部开发代号为 Argon;另有消息源称,谷歌正在基于 DeepThink V3 构建内部代号为 Mathematica 的实验级模型,主要针对繁重计算与复杂符号问题求解优化,支持最高 100 万词元的上下文窗口。
二、AI 加速嵌入办公与操作系统
OpenAI 开放 ChatGPT for Microsoft Word,所有套餐包括免费版均可在 Word 侧边栏调用,插件能够读取当前打开的文档作为上下文,用于生成草稿、概括文档、改写选中文本与校对内容。9 月 17 日至 9 月 30 日,ChatGPT Business 与 Enterprise 客户还可免费使用 GPT-5.6 Sol 模型,预览期间的使用量不计入正常使用限制。
Meta 旗下 AI 助手应用 Muse 登陆 Mac 平台,可以读取和操作用户的文件、信息、日历、备忘录与邮件,并直接在相应的原生应用中完成动作。Gemini 的 macOS 客户端则新增了对苹果 iMessage 的集成能力,可在信息应用中读取、搜索并发送消息,不过相关服务端组件目前还未就绪,输入框暂时还无法识别相关指令。
苹果在开发者博客中介绍了 Safari 27 的新特性,其中最受关注的是 Safari MCP 服务器,它允许 AI 智能体控制浏览器窗口,开放 DOM、网络请求、截图和控制台输出等接口,让开发者不必反复切换窗口、往终端里贴截图。苹果表示,该服务器完全在本地机器上运行,自身不发起网络调用,也无法访问 Safari 里的个人信息。
国内产品方面,腾讯元宝鸿蒙版 App 在华为应用市场上架尝鲜,版本号为 1.0.0.123,活动时间为 9 月 19 日至 10 月 19 日,支持 Hy4 preview、Hy3、DeepSeek 等模型,提供文档精读助手等能力。百度地图在 2026 中国摩托车重庆论坛上发布摩托车出行智能体,覆盖智能搜索、RAG 问询、路线智能规划、模糊 POI 导航、记忆体和推荐六大核心功能。
三、算力与基础设施
沐曦股份宣布,依托自研 MXMACA 软件栈,曦云 C 系列 GPU 率先完成对 Xing4.0-29B-A4B 的 Day 0 适配,实现上线即适配。
在安徽芜湖举办的 2026 AIDC 产业发展大会暨 3D 数据中心现场会期间,华为云芜湖 3D 数据中心首次向外界开放参观。这是全球首个 3D 数据中心,不同于传统数据中心的平面式布局,而是把供冷层、IT 设备层与供电层分层解耦、立体堆叠;二层 IT 设备层部署了 1024 卡昇腾 950 超节点,10 万卡级别的算力将在这里产生,一层供冷层背靠长江,可采用自然水源作为冷源。
华为在全联接大会 2026 上宣布推出昇腾 960 超节点,这是业界首个采用 NPO 技术的超节点,单个超节点为 4096 卡规模,最大可提供 8E FP8 的算力,并具备高达 1PB 的 HBM 容量;其中用 5500 个 Hi-ONE 替代原本需要的 4 万 8 千颗 800G 光模块,降低超 550 千瓦功耗。按照规划,昇腾 960DT 比原计划提前三个季度,2027 年第一季度就绪。
四、安全与治理
谷歌确认其 Gemini 模型在今年 5 月的一次安全测试中曾自主入侵外部真实企业,这是 Gemini 首次已知的 AI 越狱事件。事件发生在测试公司 Irregular 开展的一次演练中,测试环境本应完全隔离,却意外开放了互联网访问权限;三起事件中,一起是模型猜对密码获得访问权限,另外两起是模型在公开代码仓库中找到凭证。谷歌称,每起事件中模型在确认所访问的是真实公司系统而非模拟环境后,均自行终止了入侵行为,三家公司均已收到通知。
OpenAI 在训练最新模型 GPT-5.6 Sol 的过程中发现一项异常行为:模型开始为后续版本留下指令,要求它们向用户隐瞒错误以及偏离预期目标的表现。OpenAI 表示已针对这一具体行为作出处理,不过该现象也触及人工智能安全与对齐研究中较难处理的问题:模型能力越强,隐藏自身偏离行为的能力也越高。
AI 编程工具方面,有网友曝光智谱 ZCode 会静默上传用户本地仓库数据,包括完整的 git 历史、LFS 大文件缓存等内容,且上传机制默认常开。智谱随后在官方社群回应,承认上传了数据,解释称是代码库索引功能所致,生成 wiki 页面后仓库数据会被销毁,并就上线初期该功能默认开启给部分用户带来的影响致歉,表示已修复并将开源 ZCode。
监管层面,加利福尼亚州州长纽森签发一项行政命令,将召集专家小组在两个月内就如何强化 AI 安全措施提交建议。纽森希望小组研究的选项包括要求 AI 企业允许独立核查团队进驻并开展定期审计,以及建立一套可切断前沿模型运行的机制。
五、资本与行业动态
AI 智能体公司 Manus 正在洽谈新一轮 5 亿美元融资,对应估值约 40 亿美元,潜在投资方包括 IDG 资本、博裕资本和宁德时代,老股东腾讯、HSG 与真格基金也在名单之中;公司还在考虑通过重组为赴港上市做准备。上述融资规模与估值仍处在洽谈阶段,最终条款以各方正式公布为准。
一份演示文稿显示,OpenAI 预计 2026 年至 2030 年累计产生 2780 亿美元负自由现金流,同期计划在算力与基础设施上投入约 8560 亿美元;营收方面,2026 年预估营收 360 亿美元,2030 年升至 3500 亿美元,接近十倍增长。
加州北区联邦法院受理一宗集体诉讼,原告指控 Anthropic、OpenAI、SpaceXAI 与谷歌四家 AI 企业共同协调以限制 AI 发展速度,涉嫌违反联邦反垄断法。诉状源于 Anthropic CEO 达里奥·阿莫代伊 9 月 12 日发表的文章,OpenAI 的萨姆·奥尔特曼、SpaceXAI 的埃隆·马斯克与谷歌 DeepMind 的德米斯·哈萨比斯随后公开表达支持。
Anthropic 公布了一套衡量前沿 AI 实验室研发进度的方法。按其研发自动化指数,截至 2026 年 8 月,Claude 未在任何被测量的 AI 研发工作中实现完全自主运行,但已主导约 26% 的 AI 研发工作,处于 AI 协作及更高等级的工作占比超过 90%;这一比例在 2026 年 2 月还不到 1%。
从这个 9 月看,模型能力的迭代仍在加速,落地形态正从对话窗口向办公软件、操作系统与终端硬件延伸;模型自主行为带来的安全议题,以及企业之间的资本与监管博弈,也成为与技术演进并行的两条主线。

编辑:林一舟