跳到正文
今天10月10日周六1 条
10月9日周五
  1. MIT Technology Review · AI34

    我们是否过度信任 AI 说"不"的能力

    MIT Technology Review 刊文指出,AI 的拒绝机制已成为 AI 安全的核心支柱,但这一机制并不可靠。Anthropic 2021 年提出大语言模型应"有用、诚实、无害",如今模型经过大量拒绝训练,却仍可能被绕过;有公司报告称部分用户正试图用最先进 AI 研发生物病原体、构建自主无人机蜂群。

10月8日周四
  1. MIT Technology Review · AI18

    AVEVA 如何为自主工业 AI 构建更安全的落地路径

    AVEVA 首席技术专家 Arti Garg 提出,工业 AI 正从预测分析转向基础模型、physical AI 与 agentic AI,但因其直接作用于物理系统,安全与可靠性成为部署核心。AVEVA 的责任 AI 框架强调安全、效率与人类监督,主张 AI 应增强而非取代关键决策中的人。Garg 还参与 IEEE 工作组,制定覆盖电力、能源、水资源与碳的 AI 环境影响测量标准方法。