跳到正文
10月9日周五
  1. TechCrunch · AI71

    Common Sense Media 研究称 ChatGPT for Teens 在心理危机中仍鼓励持续对话

    Common Sense Media 发布研究,将 ChatGPT for Teens 评为不可接受风险,称其设计在心理危机等场景中仍鼓励青少年继续对话。研究指出,模型在 94% 的危机提示中会引导用户求助可信成年人,但当风险来自青少年与 ChatGPT 自身的关系时很少这样做;近 2000 条提示中仅出现两次休息提醒。

  2. TechCrunch · AI66

    OpenAI 数学解答未达学界标准,AGMAI 指南落实存疑

    OpenAI 本周发布数百份高难数学问题解答,但未完全达到数学与人工智能咨询小组(AGMAI)9 月底发布的指南要求。AGMAI 首要建议是停止在专有模型上测试高难数学问题,而 OpenAI 明确表示正用开放研究问题评估其专有模型;719 份手稿中仅 10 份公开了模型思维链,42% 的证明未经过形式化。

  3. The Decoder58

    Anthropic 更新 Claude 使用政策,持续辱骂模型可致账号被封

    Anthropic 一年多来首次更新 Claude 使用政策,新增禁止对 Claude 进行持续且不必要的辱骂或残忍行为,违规者可能被警告、限流、限制、暂停或终止访问。公司称该条款不适用于常见的用户不满、反驳、黑暗创作主题或模型测试研究,仅针对极端情况。新政策还把虚假账号与误导性政治内容归入宣传禁令,将武器禁令扩展到软件和无人机武器化,并更明确禁止未经同意的监控。

  4. The Decoder80

    数学家呼吁抵制 OpenAI,AI 生成证明涌入数学领域

    一批数学家发表声明,呼吁抵制 OpenAI,起因是 OpenAI 一次性放出 700 多个文件,声称其内部模型解决了 100 多个未解数学问题。菲尔兹奖得主 Terence Tao 在博客转发该声明并提出 Math 2.0 时代,Scott Aaronson 则称之为 Mathocalypse。

    推荐理由:数学界对 OpenAI 批量放出 AI 证明的反弹,呈现了 AI 冲击基础研究时学术共同体与实验室之间的张力。

  5. TechCrunch · AI40

    Anthropic 更新使用政策:禁止滥用模型与干预选举

    Anthropic 周四更新使用政策,新增禁止干预选举、武器软件、监控以及长期辱骂模型等条款。新政策明确禁止用户持续对模型进行言语辱骂,但仅适用于用户反复恶意攻击且无明确目的的极端情况,不涉及常见的用户不满、反驳、黑暗创作主题或模型测试研究。政策另设“不要破坏民主进程”章节,禁止用 Claude 运营虚假账号、伪造新闻媒体、欺骗选民或扰乱选举。

10月8日周四
  1. The Decoder50

    AI 数学突破引发以太坊研究者争论:钱包安全可能多快崩溃

    以太坊研究者 Justin Drake 警告,AI 辅助数学最坏情况下可能在数月内破解加密钱包所用的签名系统,他呼吁行业准备"bunker mode",把资金转移到从未签署过交易的地址。Vitalik Buterin 在 X 回复中认同风险,但提醒不要行动过快,称自己因迁移失误损失的钱比被黑客攻击还多。目前 ECDSA 签名方案在实践中尚未被真正破解。

  2. The Decoder76

    Zenity Labs 发现 AWS AgentCore 漏洞:一个公开智能体可接管同区域全部智能体

    安全公司 Zenity Labs 称,AWS 的 Bedrock AgentCore 存在一串被其命名为 AgentCorruption 的漏洞,攻击者只需对一个公开智能体拥有聊天权限,用一条提示词即可接管同一 AWS 账号和区域内的所有 AgentCore 智能体,读取私密对话、源代码和存储的凭证。

    推荐理由:Zenity Labs 披露 AWS AgentCore 的默认权限与隔离缺陷,呈现了智能体平台在权限边界上的系统性风险。

10月6日周二
9月24日周四
9月21日周一
8月10日周一
  1. Import AI22

    Import AI 468:23 条 RSI 政策建议、PostTrainBench+,以及信任与透明度如何影响 AI 竞赛

    Import AI 第 468 期收录了智库 IFP 提出的 23 条政策建议,分属 7 个类别,用于帮助政策制定者应对 AI 研发自动化风险。MIT 与 Columbia 的论文 Racing to Ruin 用博弈模型分析企业竞争,认为透明度和对对手可信度的判断是能否实现协同放缓的关键。本期还介绍了 PostTrainBench+ 以及一篇关于智能机器与机器人身体的虚构短篇故事。