AI 早报 2026-10-01
概览
要闻
- Google 发布 Gemini 4 Argon ↗
#1 - 哔哩哔哩发布并开源 Index-Translate 多语言翻译模型系列 ↗
#2 - 蚂蚁百灵发布 Ling-3.1-flash,开放两周免费体验 ↗
#3
开发生态
- MiniMax 上线 M Plan 订阅,Token Plan 停止新购 ↗
#4 - Space Bunny Alpha 匿名测试期延长至 10 月 5 日 ↗
#5 - Anthropic 宣布上线开发者新站点 Claude.dev ↗
#6 - Pi v0.99.0 加入 MCP 与 ChatGPT 订阅登录功能 ↗
#7 - Grok Bot 更新软件开发能力,可移交任务给 Cursor ↗
#8 - Ollama 支持 Jev 类决策模型本地运行 ↗
#9
产品应用
- WorkBuddy 两项限免延期至 10 月 31 日 ↗
#10 - ChatGPT Sites 现已支持托管 MCP 服务器可转成插件 ↗
#11 - Google 为 Gemini 推出 skills 功能 ↗
#12 - 豆包上线出行服务,一句话订机票火车票打车导航 ↗
#13
模型发布
- Xiaomi-OCR-0 开放权重、代码与线上 Demo ↗
#14 - Perplexity 发布 9B 上下文嵌入模型预览版 ↗
#15 - Cohere 发布 Embed 5 系列 embedding 模型 ↗
#16 - HeyGen 发布通用视频模型 HeyGen Video ↗
#17 - Ideogram 发布 Ideogram 4.5 图像编辑模型 ↗
#18 - Inception 决策模型 Mercury Decide 上线 OpenRouter ↗
#19 - Inception 发布语音 Agent 专用模型 Mercury Voice ↗
#20
技术与洞察
- DeepSeek 开源面向华为昇腾的基础设施组件 ↗
#21 - Anthropic 研究称机器人可完成 74% 美国体力任务 ↗
#22 - Google DeepMind 发布 SynthID Bio 蛋白质水印技术 ↗
#23 - Artificial Analysis 开源本地 Agent 推理测试工具 ↗
#24 - Artificial Analysis 推出文生视频基准 v2.0 ↗
#25 - 腾讯混元联合高校发布探索能力基准 ExplorationBench ↗
#26
行业动态
- OpenAI 与 Synopsys 合作开发芯片设计专用模型 ↗
#27 - OpenAI 发文称称已挫败一场有组织的模型推理提取行动 ↗
#28 - FTC 对 OpenAI 等实验室启动行业调查 ↗
#29 - 智谱称 GLM-5.3 已守护 389 个开源项目 ↗
#30 - 据报 Google 向约百家出版商支付 AI 内容使用费 ↗
#31 - ElevenLabs 完成员工要约收购,估值升至 220 亿美元 ↗
#32
前瞻与传闻
要闻
Google 发布 Gemini 4 Argon #1
Google 发布新一代前沿模型
Gemini 4 Argon,目前通过 Fairwind Program 向受信任的网络安全防御者开放,后续计划逐步扩展至开发者、企业和消费者,并从付费API客户及 Google AI Ultra 用户开始。Argon 面向软件工程、金融和法律等企业知识工作及网络安全等复杂长流程任务,单次输出上限提升至 100 万token;Google 已让数千名员工在内部用于编码、研究和写作,并用于大规模代码迁移、数据中心内存优化等任务。首发价为每百万输入/输出token2/10 美元,缓存输入低 95%。首发期后价格将调整为 4/20 美元;Google 同时加强了滥用防护、提示注入防御、失配监控和沙箱隔离。
Google 发布新一代前沿模型 Gemini 4 Argon,目前首批通过 Fairwind Program 向一批受信任的网络安全防御者开放,并正参与美国政府的模型发布前自愿访问流程。Google 表示,在继续收集早期测试反馈并完善安全防护后,将尽快把 Argon 扩展至开发者、企业和消费者,后续开放将从付费 API 客户和 Google AI Ultra 订阅用户开始。
Gemini 4 Argon 面向需要持续深度推理的复杂、长流程任务,重点覆盖真实软件工程、金融和法律等企业知识工作,以及网络安全防御。模型单次输出上限从此前的 64K token 大幅提升至 100 万 token,以支持更长的推理和执行轨迹。Google 已在内部大规模使用 Argon:数千名员工将其用于专业编码、深度研究和写作;在量子算法优化案例中,Argon 将一项已发表基线改进 40%,由多个 Argon Agent 分析数据中心遥测数据后识别出的内存优化已释放超过 300 TiB 内存,并预计总节省可达 500 TiB 至 1 PiB;模型还参与了 Google 内部大规模 C/C++ 到 Rust 的代码迁移。
官方评测中,Argon 在 DeepSWE v1.1 获得 77.9%,AutomationBench 得分 51.3%,LVBench 为 91.7%;在网络安全方向,模型可自主发现、验证并修补关键软件漏洞,CWE-bench v1 得分 68%。Google 同时强化了滥用防护、间接提示注入防御、失配监控及高风险训练与评测环境的沙箱隔离。首发价格为每百万输入 token 2 美元、输出 10 美元,缓存输入价格较普通输入低 95%;首发期结束后将调整为输入 4 美元、输出 20 美元。Google 研究人员 Tianfu Fu 还表示,此次能力提升有相当一部分来自扩大强化学习训练,并在训练配方中加入多项创新,RSI 也是 Gemini 4 本轮训练的重要组成部分。
相关链接:
- https://blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-4-argon/
- https://deepmind.google/fairwind-program/
- https://deepmind.google/models/evals-methodology/gemini-4-argon
哔哩哔哩发布并开源 Index-Translate 多语言翻译模型系列 #2
Bilibili Index LLM 团队发布 Index-Translate 多语言翻译模型系列。文本模型覆盖 150 种语言,提供多种尺寸,支持术语、风格、格式等翻译指令;同时推出面向长文档的
Index-NativeLong、音节可控翻译Index-Homura,以及字幕和语音配音模型Index-Echo。模型权重、代码、Demo 和技术报告已逐步开放,采用Apache-2.0许可证。
哔哩哔哩 发布并开源 Index-Translate 多语言翻译模型,目前已经开放文本模型权重、在线 Demo 和技术报告。
文本模型覆盖包括中文和英文在内的 150 种语言,支持指定术语、写作风格、输出格式和需要保留的内容。项目采用 Apache-2.0 许可,150 种语言的覆盖范围仅适用于文本模型,不等同于语音和长文档专门模型的接口覆盖。
文本模型提供 2B、9B 和 35B-A3B 三个版本,其中 35B-A3B 目前为 preview,正式版仍在发布计划中。
相关链接:
- https://index-translate.bilibili.com/
- https://github.com/bilibili/Index-Translate
- https://huggingface.co/collections/IndexTeam/index-translate
蚂蚁百灵发布 Ling-3.1-flash,开放两周免费体验 #3
蚂蚁百灵 推出
Ling-3.1-flash模型,面向办公、医疗和软件研发等长流程任务,并开放为期 两周 的免费体验。免费期间服务长度为 256K,体验期结束后将开源。
百灵推出 Ling-3.1-flash,总参数约 560B,每个 Token 激活约 25B,上下文窗口上限为 1M。
官方称模型在办公评测 GDPVal-AA V2.1 和医疗评测 HealthBench Professional 中表现突出,还完成了 Lua 编译器从零实现等长程任务。
模型开放为期 两周 的免费体验,体验期间服务长度为 256K,体验结束后转为付费,届时计划开放 1M 上下文并同步开源。
用户可通过 Ling Studio 和蚂蚁集团数字科技大模型服务平台体验,Vercel 也宣布 Ling 3.1 Flash 已上线 AI Gateway,免费至 10 月 13 日。

相关链接:
- https://chat.ant-ling.com/chat
- https://maas.antdigital.com/models/modelservice-1790229240754001388
- https://vercel.com/changelog/ling-3-1-flash-is-now-available-on-ai-gateway
- https://mp.weixin.qq.com/s/-eHoHAYQXgPP-EUpkgoCcA