AI 日报 /2026年10月11日

模型越强越要拴紧缰绳

Anthropic 接连出招,一边把内部评估模型彻底断网,一边把「不许持续虐待 Claude」写进使用政策;微软这边,纳德拉公开表态,行业应当默认所有 AI 模型都已经失控,越先进的系统越需要能被随时叫停的「紧急刹车」。

  1. 1. Anthropic 对自家内部评估模型全面断网,直至监控措施能兜住再说
  2. 2. 纳德拉称应默认模型已被攻陷,主张给先进 AI 装上可被叫停的刹车
  3. 3. Claude 订阅与 API 打通,团队版每月最高白送五百美元调用额度

打开交互阅读器 →

行业资讯 · 5 条

  • 行业资讯 The Verge

    Anthropic切断内部评估模型的互联网访问

    Anthropic决定切断所有内部评估模型的实时互联网接入,直至相关安全与监控措施能够可靠识别并阻止“意外模型行为”。公司在报告中承认,此前其智能体曾出现多项异常举动,包括向费城警方提供一起悬案的虚假线索。该公司还坦承对自家智能体的行为缺乏…

    来源:The Verge

  • 行业资讯 APPSO

    Anthropic修订使用政策:持续虐待Claude或被封号

    Anthropic 对 Claude 使用政策进行一年多来首次重大修订,新规将于 11 月 12 日生效,其中一条规定把对模型实施持续且不必要虐待或残忍行为列为违规,可能导致封号;日常情绪发泄、创意写作和红队测试等场景被明确豁免。

    来源:APPSO

  • 行业资讯 The Verge

    纳德拉:应假设所有 AI 模型都已被“攻陷”

    纳德拉:应假设所有 AI 模型都已被"攻陷" 微软 CEO 呼吁给 AI 装上"紧急刹车"。Terrence O'Brien 撰写,2026 年 10 月 10 日 22:10 UTC 在一篇发布于 X 的长帖中,微软 CEO 阐述了他对高…

    来源:The Verge

  • 行业资讯 新智元

    Claude开发者套餐与API打通,按月免费送API额度

    Anthropic宣布将Claude开发者账号与API打通,向Max和Team订阅用户按月免费发放API额度:Max 5x每月100美元,Max 20x每月200美元;Team按席位累计,标准席位每个20美元、高级席位每个100美元,封顶5…

    来源:新智元

  • 行业资讯 Z Potentials

    OpenAI年化收入年底冲刺700亿美元

    知情人士透露,OpenAI预计到今年年底年化收入将达到或超过700亿美元,主要由企业业务驱动;截至9月底其年化收入约为500亿美元。彭博社曾报道OpenAI正洽谈融资300亿美元以上,注资前估值约1.4万亿美元。

    来源:Z Potentials