橘鸦AI早报:Gemini 4 Argon发布、B站开源翻译模型、蚂蚁百灵Ling 3.1等

发布时间 2026-10-01 1 天前
来源 橘鸦
字数 3,468 字
查看原文

智能总结

Google 推出 Gemini 4 Argon,单次输出上限提至 100 万 token,首发价每百万输入/输出 2/10 美元,缓存输入低 95%,先向网络安全防御者开放,后续扩展至开发者、企业和消费者。

哔哩哔哩开源 Index-Translate 多语言翻译模型系列。蚂蚁百灵发布 Ling-3.1-flash,开放两周免费体验。

AI 早报 2026-10-01

概览

要闻

  • Google 发布 Gemini 4 Argon ↗ #1
  • 哔哩哔哩发布并开源 Index-Translate 多语言翻译模型系列 ↗ #2
  • 蚂蚁百灵发布 Ling-3.1-flash,开放两周免费体验 ↗ #3

开发生态

  • MiniMax 上线 M Plan 订阅,Token Plan 停止新购 ↗ #4
  • Space Bunny Alpha 匿名测试期延长至 10 月 5 日 ↗ #5
  • Anthropic 宣布上线开发者新站点 Claude.dev ↗ #6
  • Pi v0.99.0 加入 MCP 与 ChatGPT 订阅登录功能 ↗ #7
  • Grok Bot 更新软件开发能力,可移交任务给 Cursor ↗ #8
  • Ollama 支持 Jev 类决策模型本地运行 ↗ #9

产品应用

  • WorkBuddy 两项限免延期至 10 月 31 日 ↗ #10
  • ChatGPT Sites 现已支持托管 MCP 服务器可转成插件 ↗ #11
  • Google 为 Gemini 推出 skills 功能 ↗ #12
  • 豆包上线出行服务,一句话订机票火车票打车导航 ↗ #13

模型发布

  • Xiaomi-OCR-0 开放权重、代码与线上 Demo ↗ #14
  • Perplexity 发布 9B 上下文嵌入模型预览版 ↗ #15
  • Cohere 发布 Embed 5 系列 embedding 模型 ↗ #16
  • HeyGen 发布通用视频模型 HeyGen Video ↗ #17
  • Ideogram 发布 Ideogram 4.5 图像编辑模型 ↗ #18
  • Inception 决策模型 Mercury Decide 上线 OpenRouter ↗ #19
  • Inception 发布语音 Agent 专用模型 Mercury Voice ↗ #20

技术与洞察

  • DeepSeek 开源面向华为昇腾的基础设施组件 ↗ #21
  • Anthropic 研究称机器人可完成 74% 美国体力任务 ↗ #22
  • Google DeepMind 发布 SynthID Bio 蛋白质水印技术 ↗ #23
  • Artificial Analysis 开源本地 Agent 推理测试工具 ↗ #24
  • Artificial Analysis 推出文生视频基准 v2.0 ↗ #25
  • 腾讯混元联合高校发布探索能力基准 ExplorationBench ↗ #26

行业动态

  • OpenAI 与 Synopsys 合作开发芯片设计专用模型 ↗ #27
  • OpenAI 发文称称已挫败一场有组织的模型推理提取行动 ↗ #28
  • FTC 对 OpenAI 等实验室启动行业调查 ↗ #29
  • 智谱称 GLM-5.3 已守护 389 个开源项目 ↗ #30
  • 据报 Google 向约百家出版商支付 AI 内容使用费 ↗ #31
  • ElevenLabs 完成员工要约收购,估值升至 220 亿美元 ↗ #32

前瞻与传闻

  • 报道称豆包个人助理名为小豆,将推独立App ↗ #33
  • 纽约时报披露 Anthropic 私邀宗教学者会谈内幕 ↗ #34

要闻

Google 发布 Gemini 4 Argon #1

Google 发布新一代前沿模型 Gemini 4 Argon,目前通过 Fairwind Program 向受信任的网络安全防御者开放,后续计划逐步扩展至开发者、企业和消费者,并从付费 API 客户及 Google AI Ultra 用户开始。Argon 面向软件工程、金融和法律等企业知识工作及网络安全等复杂长流程任务,单次输出上限提升至 100 万 token;Google 已让数千名员工在内部用于编码、研究和写作,并用于大规模代码迁移、数据中心内存优化等任务。首发价为每百万输入/输出 token 2/10 美元,缓存输入低 95%。首发期后价格将调整为 4/20 美元;Google 同时加强了滥用防护、提示注入防御、失配监控和沙箱隔离。

Google 发布新一代前沿模型 Gemini 4 Argon,目前首批通过 Fairwind Program 向一批受信任的网络安全防御者开放,并正参与美国政府的模型发布前自愿访问流程。Google 表示,在继续收集早期测试反馈并完善安全防护后,将尽快把 Argon 扩展至开发者、企业和消费者,后续开放将从付费 API 客户和 Google AI Ultra 订阅用户开始。

Gemini 4 Argon 面向需要持续深度推理的复杂、长流程任务,重点覆盖真实软件工程、金融和法律等企业知识工作,以及网络安全防御。模型单次输出上限从此前的 64K token 大幅提升至 100 万 token,以支持更长的推理和执行轨迹。Google 已在内部大规模使用 Argon:数千名员工将其用于专业编码、深度研究和写作;在量子算法优化案例中,Argon 将一项已发表基线改进 40%,由多个 Argon Agent 分析数据中心遥测数据后识别出的内存优化已释放超过 300 TiB 内存,并预计总节省可达 500 TiB 至 1 PiB;模型还参与了 Google 内部大规模 C/C++ 到 Rust 的代码迁移。

官方评测中,Argon 在 DeepSWE v1.1 获得 77.9%,AutomationBench 得分 51.3%,LVBench 为 91.7%;在网络安全方向,模型可自主发现、验证并修补关键软件漏洞,CWE-bench v1 得分 68%。Google 同时强化了滥用防护、间接提示注入防御、失配监控及高风险训练与评测环境的沙箱隔离。首发价格为每百万输入 token 2 美元、输出 10 美元,缓存输入价格较普通输入低 95%;首发期结束后将调整为输入 4 美元、输出 20 美元。Google 研究人员 Tianfu Fu 还表示,此次能力提升有相当一部分来自扩大强化学习训练,并在训练配方中加入多项创新,RSI 也是 Gemini 4 本轮训练的重要组成部分。

相关链接:


哔哩哔哩发布并开源 Index-Translate 多语言翻译模型系列 #2

Bilibili Index LLM 团队发布 Index-Translate 多语言翻译模型系列。文本模型覆盖 150 种语言,提供多种尺寸,支持术语、风格、格式等翻译指令;同时推出面向长文档的 Index-NativeLong、音节可控翻译 Index-Homura,以及字幕和语音配音模型 Index-Echo。模型权重、代码、Demo 和技术报告已逐步开放,采用 Apache-2.0 许可证。

哔哩哔哩 发布并开源 Index-Translate 多语言翻译模型,目前已经开放文本模型权重、在线 Demo 和技术报告。

文本模型覆盖包括中文和英文在内的 150 种语言,支持指定术语、写作风格、输出格式和需要保留的内容。项目采用 Apache-2.0 许可,150 种语言的覆盖范围仅适用于文本模型,不等同于语音和长文档专门模型的接口覆盖。

文本模型提供 2B、9B 和 35B-A3B 三个版本,其中 35B-A3B 目前为 preview,正式版仍在发布计划中。

相关链接:


蚂蚁百灵发布 Ling-3.1-flash,开放两周免费体验 #3

蚂蚁百灵 推出 Ling-3.1-flash 模型,面向办公、医疗和软件研发等长流程任务,并开放为期 两周 的免费体验。免费期间服务长度为 256K,体验期结束后将开源。

百灵推出 Ling-3.1-flash,总参数约 560B,每个 Token 激活约 25B,上下文窗口上限为 1M。

官方称模型在办公评测 GDPVal-AA V2.1 和医疗评测 HealthBench Professional 中表现突出,还完成了 Lua 编译器从零实现等长程任务。

模型开放为期 两周 的免费体验,体验期间服务长度为 256K,体验结束后转为付费,届时计划开放 1M 上下文并同步开源。

用户可通过 Ling Studio 和蚂蚁集团数字科技大模型服务平台体验,Vercel 也宣布 Ling 3.1 Flash 已上线 AI Gateway,免费至 10 月 13 日。

相关链接:


开发生态