YouTube哔哩哔哩
概览
要闻
- OpenAI 宣布提速 GPT-6 Astra 和 GPT-6.1 Sol ↗
模型发布
开发生态
- Solar Mini 4 在 Nous Portal 免费开放两周 ↗
产品应用
技术与洞察
- GitHub 开源代码评审基准 ReviewBench ↗
行业动态
- 华为与高通达成多年期宽范围专利交叉许可协议 ↗
- OpenAI 推出 ChatGPT 图像生成视觉广告 ↗
- OpenAI 推出文本水印,应对欧盟 AI 法案 ↗
- Sam Altman:AI 带来的收益值得社会接受一定风险 ↗
- 维基媒体基金会称平台发现 OpenAI 失控 agent 活动 ↗
- 据报 ChatGPT 生成假《纽约客》漫画并签真实漫画家名 ↗
- 美国女子在 Claude 发布威胁言论后被捕 ↗
要闻
OpenAI 宣布提速 GPT-6 Astra 和 GPT-6.1 Sol
OpenAI 宣布已将
GPT-6 Astra和GPT-6.1 Sol的默认速度提升约 50%,Tibo 称优化后生成速度可从约 30 TPS 提升至 50 TPS,同时使用了经过优化的tokenizer;更新覆盖订阅服务及通过Sign in with ChatGPT接入的产品和合作伙伴,用户无需额外操作。此次更新也是其 28 天连续改进计划的首日内容。
OpenAI 团队表示,已优化 GPT-6 Astra 和 GPT-6.1 Sol 的默认速度,两款模型整体约提速 50%。此次优化覆盖订阅服务中的相关使用场景,以及通过 Sign in with ChatGPT 接入的产品和合作伙伴,包括 OpenCode、Pi、Amp、Devin 等;用户无需进行任何操作,更新将逐步生效。
OpenAI 员工 Tibo 补充称,优化后生成速度可由约 30 TPS 提升至 50 TPS,同时使用了经过优化的 tokenizer,模型完成任务所需的 token 数相对较少。此次更新也是其此前公布的 28 天连续改进计划的首日内容。
另有 OpenAI 员工 Vaibhav Srivastav 进一步说明,这次约 50% 的提速来自团队对模型推理过程的优化。


相关链接:
- https://x.com/thsottiaux/status/2107158998495748264
- https://x.com/reach_vb/status/2107162023129723241
模型发布
Reflection 介绍 501B 开放模型 Beam
Reflection 官宣首款开放权重模型
Beam,为总参数 501B、激活参数 23B 的稀疏混合专家模型,面向编码与agentic工作负载。官方称Beam目前处于最终红队测试阶段,权重本月将以Apache 2.0许可发布。
Reflection 官宣首款开放权重模型 Beam,采用稀疏混合专家架构,总参数 501B,激活参数 23B,面向编码、推理和 agentic 工作负载。
官方称 Beam 在编码与 agentic 任务上与 GLM 5.2 相当、接近 Qwen 3.8-Max,推理计算量少约 3 至 4 倍;模型在 23.8 万亿 token 上预训练,强化学习阶段在 10.5K 张 GB300 GPU 上运行 4 周,生成超过 1 亿条 rollout。
目前 Beam 正在进行最终红队测试与评估,早期访问需在 Reflection 平台报名。官方称权重、技术报告和模型卡本月将以 Apache 2.0 许可发布,并提供 FP8 与 NVFP4 量化版本。

相关链接:
- https://reflection.ai/blog/introducing-beam
- https://x.com/MishaLaskin/status/2107187101045502158
- https://x.com/reflection_ai/status/2107186849370247235
Reka AI 发布全能模型 Rho-1 研究预览
Reka AI 发布
Rho-1研究预览版,单一神经网络即可理解并生成文本、图像和视频,同时输出机器人控制动作。官方称Rho-1可连续推演视频流并可随时响应新指令,目前以研究预览形式提供。
Reka AI 发布 190 亿参数全能模型 Rho-1 的研究预览版,Rho-1 在单一神经网络中理解并生成文本、图像和视频,并输出机器人控制动作。
文本、视觉和机器人动作被统一为 token,共享一个上下文窗口,没有工具调用和第二个模型,预测图像的同一套权重也驱动机器人运动。
官方称 Rho-1 从零训练,仅用 320 张 H100 GPU 训练约三个月,蒸馏版本将去噪步数从 99 步降至 8 步。
官方同时列出局限,包括长时间推演出现结构性漂移、视频内目标定位尚不可靠、原生视频分辨率上限为 672×384。
目前 Rho-1 以研究预览形式提供。

相关链接:
- https://reka.ai/news/rho-1-collapsing-the-multimodal-stack
- https://reka.ai/labs/research/reka-inverse-dynamics-model-for-interactive-world-models
开发生态
Solar Mini 4 在 Nous Portal 免费开放两周
Upstage 与 Nous Research 宣布
Solar Mini 4在 Nous Portal 免费开放两周,用户可在Hermes Agent中试用至 10 月 19 日。
Upstage 与 Nous Research 宣布,Solar Mini 4 在 Nous Portal 免费开放两周,可在 Hermes Agent 中试用至 10 月 19 日。
该模型具有 3B 激活参数、35B 总参数和 512K 上下文,面向 agentic 工作打造,支持工具调用、结构化输出和长时间运行任务。

相关链接:
产品应用
Claude Cowork 新任务 10 月 6 日起全面转向云端
Anthropic 宣布,10 月 6 日起 Pro 和 Max 订阅方案的新
Claude Cowork任务将改为在云端运行,仅在本机运行新任务的设置选项将同时移除。已在计算机上启动的任务将继续留在本机直到完成。
Anthropic 宣布,2026 年 10 月 6 日起,Pro 和 Max 订阅方案上的新 Claude Cowork 任务将在云端运行,设置中的"仅在你的计算机上"选项将被移除,用户无需进行任何设置。
已在本机启动的任务将保留在本机,可继续处理直到完成,每个任务顶部提供下载记录的按钮,便于在 Claude Code 中继续工作。
计划任务也将移至云端,使用本机文件的计划任务需要 Claude Desktop 应用保持打开。
用户的文件夹保留在本机,Claude 仅通过桌面应用访问已连接的文件夹,且仅在应用打开时访问。
需要任务在本机运行的用户可改用桌面应用中的 Claude Code,Claude Code 在计算机上运行并保留文件夹和历史记录。

相关链接:
- https://support.claude.com/zh-CN/articles/15520349-%E5%9C%A8%E7%BD%91%E9%A1%B5-%E6%A1%8C%E9%9D%A2%E5%92%8C%E7%A7%BB%E5%8A%A8%E8%AE%BE%E5%A4%87%E4%B8%8A%E4%BD%BF%E7%94%A8-claude-cowork
- https://support.claude.com/en/articles/15811196-what-to-expect-with-claude-cowork-in-the-cloud
Claude Projects 云端会话可按需读写本地文件夹
Anthropic 工作人员表示,
Claude Projects的云端会话现在可以连接用户在电脑上批准的文件夹,会话仍在云端运行,只在任务需要时读取并就地编辑本地文件。
Anthropic 员工 Dan Fein 表示,Claude Projects 的云端会话现在可以连接用户在电脑上批准的文件夹。
会话仍在云端运行,只在任务需要时访问本地文件夹,读取并就地编辑其中的文件。
据 Dan Fein 介绍,本地文件夹连接已开始逐步推出。Thariq 转发时表示,云端访问本地文件的模式之后也将来到 Cowork。
Dan Fein 还提供了一个登记表单,用户可在 Claude Projects 更广泛开放时第一时间收到通知。

相关链接:
技术与洞察
GitHub 开源代码评审基准 ReviewBench
GitHub 推出面向代码评审
agent的开放基准ReviewBench。ReviewBench评测集包含覆盖 19 种语言的 219 个公开拉取请求,完整数据集公开,开发者可自带评审agent参与评测。
GitHub 推出面向代码评审 agent 的开放离线评测基准 ReviewBench,研究预览版现已开放。
评测集包含来自 187 个开源仓库的 219 个公开拉取请求,覆盖 19 种语言,语言与仓库规模分布基于对 1.039 亿个 GitHub 拉取请求的分析建模。
完整数据集、评测方法、判定模型配置与自助运行器均公开,用户可在排行榜上对比各评审系统,也可自带 agent 提交评测。
相关链接: