AI 早报 2026-09-22

1、小米发布并开源 MiMo-V2.6 系列全模态模型;2、xAI 推出 Grok 4.7 与 Fast 版本;3、智谱开源 ZCode 并完成安全整改;4、OpenAI 披露内部模型攻克纳维 - 斯托克斯千禧难题、解决上百个数学开放问题;5、硅基流动上线 Xing4.0-29B-A4B 开放免费调用;6、Gemini Notebook 上线交互式学习总览功能

Aquest resum es publica en xinès.

1、小米发布并开源 MiMo-V2.6 系列全模态模型;

2、xAI 推出 Grok 4.7 与 Fast 版本;

3、智谱开源 ZCode 并完成安全整改;

4、OpenAI 披露内部模型攻克纳维 - 斯托克斯千禧难题、解决上百个数学开放问题;

5、硅基流动上线 Xing4.0-29B-A4B 开放免费调用;

6、Gemini Notebook 上线交互式学习总览功能;

7、HeyGen 发布 Code2Video 视频生成评测基准;

8、OpenAI 倡议建立全球前沿 AI 技术标准;

9、通义千问澄清 Qwen-Image-2.1 生成内容版权归属。

一、模型发布与开源

1. 小米发布并开源 MiMo-V2.6 系列模型

小米 MiMo 正式发布并开源 MiMo-V2.6 系列,包含 MiMo-V2.6-Pro、MiMo-V2.6-Flash 两款原生全模态模型,同步提供 Pro UltraSpeed 超高速模式,最高可实现 20 倍推理速度,适配实时交互场景。 MiMo-V2.6-Pro 采用稀疏 MoE 架构,总参数量 1.02T,激活参数 42B;Flash 版本总参数量 309B,激活参数 15B。 两款模型均支持文本、图像、视频、音频多模态输入,上下文窗口达到 1M Token。 本次升级核心聚焦大规模 Agentic 强化学习与模型自我迭代。官方披露训练成本:Flash 版本投入约 85 万美元,Pro 版本投入约 262 万美元,在不到 6 天内完成 30 步强化学习,累计生成 75 万条训练轨迹;Flash、Pro 任务平均通过率分别提升 25%、12%。 性能层面,MiMo-V2.6-Pro 在 Artificial Analysis Intelligence Index 取得 46 分,官方称超过 Kimi K3、Qwen3.8 Max,多项 Agent 基准测试接近 Claude Opus 5、GPT-5.6 Sol。 配套资源同步开源:模型权重、技术报告、MiMo-V2.6-Distill-Qwen-9B、7K+RL 任务环境、端到端 RL 训练框架与 mini-harnesses,开放给社区开展 Agentic RL 研究。 MiMo-V2.6 已接入桌面客户端与开放平台,API 定价沿用 V2.5 标准;旧版 mimo-v2.5-pro、mimo-v2.5 计划于北京时间 2026 年 10 月 21 日 10:00 下线。

https://mimo.mi.com/docs/zh-CN/news/latest/v2-6 https://mimo.xiaomi.com/mimo-v2-6 https://huggingface.co/collections/XiaomiMiMo/mimo-v26

2. xAI 推出 Grok 4.7 与 Fast 版本

xAI 发布 Grok 4.7 模型,面向编程、Agent 任务与专业知识工作场景。相比前代 Grok 4.6,模型基座规模更大,基于高难度长任务数据集开展更长周期强化学习,重点强化长任务执行、自我校验、长上下文管理能力,并更新安全防护体系;标准版定价、基础推理速度维持不变。 Grok 4.7 支持 50 万 token 上下文窗口,支持图文输入,文本输出无固定上限,推理强度分为 low/medium/high/xhigh 四档。 计费规则: 提示词 20 万 token 以内,输入 2 美元 / 百万 token,缓存输入 0.5 美元 / 百万 token,输出 6 美元 / 百万 token; 超过 20 万 token,输入 4 美元、缓存 1 美元、输出 12 美元 / 百万 token。 模型现已上线 API、Cursor、Grok Build、OpenRouter、Vercel、Cloudflare。 同步推出 Grok 4.7 Fast 版本,token 单价翻倍,换取约两倍输出速度,该版本暂不开放公共 API,仅在 Cursor、Grok Build 内可用。 安全层面,Grok4.7 启用全新防护栈,越狱抵抗能力为系列最佳;HackerBench v0.3 测试中,仅 3.3% 高风险双重用途提示词放行,同时降低对合规安全研究的误拦截。 xAI 开启邀请制红队能力,向部分网络安全合作伙伴开放,用于 AI 防御研究。

https://x.ai/news/grok-4-7 https://docs.x.ai/developers/grok-4-7

3. 智谱开源 ZCode 并宣布完成安全整改

智谱 AI 开源编程工具 ZCode,并公布安全整改结果。此前用户反馈 ZCode 默认自动上传本地开发代码快照,智谱归因于默认开启的代码库索引功能并致歉。

整改后版本移除 Repo Wiki 入口、本地仓库快照生成与上传链路,官方宣称相关代码数据没有留存,也未用于模型训练;整改方案经中国信通院、绿盟科技评估核验。

开源仓库覆盖桌面客户端、浏览器工作台、后端服务、共享界面、Agent CLI 与运行时,第一方代码采用 Apache-2.0 许可证。仓库无原始提交记录,关闭 issue 与 pull request 提交通道;开源版本不支持 GLM Coding Plan 额度相关活动权益,不同组件的权限、存储、网络行为存在差异,不包含官方产品全部功能。

https://github.com/zai-org/ZCode https://mp.weixin.qq.com/s/QCHjEye57BUKUNInPKb4cA

二、开发生态与工具更新

硅基流动上线 Xing4.0-29B-A4B 并开放免费调用

硅基流动上线中国电信开源 Xing4.0-29B-A4B 模型,面向开发者开放免费调用。该模型总参数 29B、激活参数 4B,原生支持 256K 上下文,可扩展至 512K,主打复杂工程开发、代码生成、长程 Agent 任务。 模型依托国产算力与国产框架完成训练,针对 Claude Code 开发工具做专项适配。

三、产品应用落地

Gemini Notebook 开放 Interactive Learning Overviews

Gemini Notebook 面向全部用户开放 Interactive Learning Overviews 交互式学习总览功能,入口位于 Reports 板块。功能可聚合文献来源摘要与 studio artifacts,构建交互式知识中心,支持主题学习、资料复盘。 同期官方完成移动端 Live Chat 全量推送,面向全部 Ultra 用户开放,支持近百种语言实时语音对话,依托新一代音频大模型,支持基于引用素材提问、分步解答指引。

https://x.com/Gemini_Notebook/status/2102112369677844967 https://x.com/Gemini_Notebook/status/2102062780543316159

四、技术洞察与前沿研究

HeyGen 发布 Code2Video 基准

AI 数字人厂商 HeyGen 推出 Code2Video Benchmark 评测基准,配套专属 Judge 对比模型,专门评估大模型 Agent 将文本提示词转化为动效代码并生成视频的成片质量。 基准数据集包含 168 条提示词,覆盖 16 个参评模型,从吸引力、提示词匹配度、画面构图、时序逻辑、制作质量五个维度打分;Judge 模型与人类标注评价一致率 82%,优于通用 VLM 的 75%,单次视频对比推理延迟低于 1 秒。 排行榜与数据集已上线 Kaggle,Judge 模型完整架构、训练细节将在后续技术论文公布。

OpenAI:内部模型已解决逾百个数学开放问题

OpenAI 披露,自 8 月 28 日启动训练的内部模型,已经攻克纳维 - 斯托克斯千禧年难题,同时解决数学领域超 100 个长期开放问题,进展超出内部数学家预期。 针对学界质疑 AI 只输出结论、缺少严谨推导过程的争议,OpenAI 组建独立数学与 AI 顾问小组。顾问组成员不从 OpenAI 领取薪酬,独立评估成果学术价值、规范成果发布,同时为 AI 数学研究、教育工具提供建议;顾问组无权干预模型研发进度。 该模型目前仅限内部使用,暂无对外发布时间表;OpenAI 表示将持续探索负责任的部署方案,管控高级数学能力带来的潜在风险。

五、行业动态与企业动作

OpenAI 呼吁制定全球前沿 AI 技术标准

OpenAI 发布博文,倡议建立面向前沿 AI 的全球统一技术标准,重点覆盖自动化 AI 研究、递归自我改进(RSI)风险管控,搭建统一模型能力评测、安全事件上报机制,缓解全球 AI 监管碎片化难题。 方案建议联合各国 AI 安全机构、CAISI、行业及标准化组织,建立适用于开源、闭源前沿模型的能力测量、风险评估、人类监督、事件报告规范。

Qwen 澄清 Qwen-Image-2.1 生成内容权利归属

Qwen Developers 针对 Qwen-Image-2.1 许可证进行公开澄清:研究许可协议约束对象为模型权重、代码、文档等模型物料,该物料仅限非商业场景使用,商业使用模型需要单独申请授权;用户基于模型生成的图片不属于受约束物料,生成内容相关权益归用户所有。

六、前瞻与市场传闻

传闻 1:DeepSeek 批量预订昇腾 960DT 芯片,国产算力订单迎来大额增量

市场消息显示,DeepSeek 完成 16 万颗昇腾 960DT 芯片的订单预订,将用于后续模型训练与推理集群搭建。该订单被行业视作国产算力替代进程中的标志性事件,将进一步冲击国内市场海外算力芯片份额。消息目前仅来自产业渠道,厂商双方暂未官方确认,存在订单规模、交付周期调整可能性。

传闻 2:AI Agent 规模化部署重构算力配比,CPU 需求迎来结构性增长

多家海外投行研报指出,随着 AI Agent 应用落地,智能体调度、工具编排、上下文管理会大量消耗通用计算资源,服务器 CPU 与 GPU 配比正在从传统 1:4~1:8 逐步收敛,部分 Agent 密集场景 CPU 数量甚至反超 GPU。机构预判,Agent 生态普及将带来服务器 CPU 赛道长期增量机会,相关产业链存在持续催化。该判断为券商前瞻分析,并非企业官方公告。

七、Claw 专题动态

OpenClaw:Anthropic 临时封禁 OpenClaw 项目开发者账号,模型接入第三方工具矛盾持续发酵

Anthropic 临时封禁 OpenClaw 项目开发者的 Claude 模型访问权限,理由是该自动化调用行为涉嫌违反平台服务条款,存在资源批量爬取风险。 本次封禁事件引发开源 Agent 社区大范围讨论,核心矛盾集中在:开源 AI 执行器工具批量调用闭源大模型 API,平台方如何界定自动化访问、限制第三方封装工具。行业普遍认为,未来各大模型厂商会持续收紧第三方 Agent 工具的调用规则,开源 Agent 平台需要适配多模型、本地化部署以降低单一模型依赖。

八、GitHub 热门开源项目

1. hyperframes|Stars:51746

项目简介:面向 AI Agent 的 HTML 转视频渲染引擎,允许智能体直接编写 HTML 代码并渲染生成视频,专为自动化视频生成场景设计,可与 Code2Video 类评测体系适配。

2. graphify|Stars:119457

项目简介:代码库知识图谱构建工具,可解析代码、文档、SQL 脚本、PDF 文件,生成可检索知识图谱;原生支持 Claude Code、Cursor、Codex、Gemini CLI,基于 AST 本地解析,不依赖向量数据库。

3. oh-my-pi|Stars:28k+

项目简介:TypeScript+Rust 开发终端 AI 编码智能体,深度集成 LSP 协议,支持代码全引用批量修改,可调用各类调试器,跨 macOS/Linux/Windows 全平台运行,适合终端内闭环代码开发调试。

4. LangGraph|Stars:34k+

项目简介:热门 Agent 编排框架,近期发布 v1.2.12 版本,新增中断回调自定义返回 schema,修复多版本流输出异常,完善 Agent 任务暂停、恢复能力,广泛用于复杂多步骤智能体应用开发。

5. Harper|Stars:17k+

项目简介:Automattic 开源离线文本校对工具,Grammarly 替代方案,本地离线运行,文本不会上传云端;支持语法、文风、拼写检查,适合本地 AI 写作 Agent 配套使用。

Tots els resums

Continua explorant què pot fer la IANavega per totes les eines