Goodfire 推出模型内部监控器,拦截失控 AI 智能体成本更低
Goodfire 发布一种监控 AI 智能体的新方式,通过读取模型内部激活信号而非重新审查其输出,来发现失控行为,该监控器面向 Baseten 客户开放。
Goodfire 发布一种监控 AI 智能体的新方式,通过读取模型内部激活信号而非重新审查其输出,来发现失控行为,该监控器面向 Baseten 客户开放。
Google 在 Google Cloud 活动上宣布为 Gemini 推出统一智能体,可接受目标而非仅指令,自行规划任务、调用自定义技能与工具并连接企业内部系统。
Google DeepMind 的 Pushmeet Kohli 与 Biohub 的 Sal Candido 在 Latent Space 的对话中指出,AlphaFold 的突破只是开始,蛋白质折叠远未解决。
OpenAI 上周解雇了 Tomek Korbak、Mikita Balesni 和 Jasmine Wang 三名安全研究员,三人发表致领导层公开信称因优先考虑安全而被解雇,OpenAI 则表示他们不当处理了机密信息。
MIT Technology Review 与 Aventine 合作的文章指出,尽管马斯克称 Tesla Optimus 未来能以每台低至 2 万美元自动化几乎所有人类劳动、并预测 2027 年底前向公众发售,但许多机器人研究者对此持怀疑态度。Yann LeCun 在达沃斯表示,没有任何一家人形机器人公司知道如何让机器人聪明到真正有用。
OpenAI 以博客、GitHub 仓库和推文形式公开了内部前沿模型的数学成果,共 722 篇手稿、归入 372 个相关结果族,来自约 4000 道研究问题的评测,平均每个结果消耗约 3 小时 ChatGPT Pro 思考算力,模型本身尚未发布。
推荐理由:OpenAI 内部模型一次性产出 722 篇数学手稿,读者可据此了解这批结果的规模、算力成本与外界质疑。
Google DeepMind 发布 EmbeddingGemma 2,基于 Gemma 4 架构、Apache 2.0 许可,740M 参数,可把文本、图像、音频和视频映射到统一嵌入空间。
推荐理由:官方给出 740M 参数、模块化编码器与端侧内存占用,可据此判断本地多模态检索的落地成本。
MIT Technology Review 的 EmTech Future 2026 活动聚焦 AI 与生物学、基础设施、制造业和科学的交叉融合,Google Research 负责人 Yossi Matias 分享了 AI 如何开始重塑这些领域。活动为期三天,还探讨了量子计算、新能源系统、机器人技术等前沿议题的汇聚趋势。完整议程现已开放点播,订阅者可享 20% 折扣,以 $596 获取全部内容。
Google DeepMind 发布新前沿模型 Gemini 4 Argon,先通过 Fairwind Program 向受信任的网络安全防御者开放,随后逐步扩展至开发者、企业和消费者。
推荐理由:官方给出 Gemini 4 Argon 在编码、企业知识与网络安全防御上的能力与定价,可据此判断前沿模型的落地节奏。
Google DeepMind 推出 SynthID Bio,将水印技术引入合成生物学,把不可感知的签名直接嵌入生物代码,使水印不仅能在数字模型上验证,也能在合成出的实体蛋白质上验证,同时保持其生物功能。
推荐理由:SynthID 水印从图像扩展到合成生物学,读者可了解其在蛋白质序列与结构上的实现方式及对 DNA 合成筛查的意义。
Google DeepMind 发布 Gemini 3.8 Live with Live Avatar,在 Gemini 3.8 Live 的原生实时对话模型上加入近实时视频生成,实现听、看、说的动态视觉形象,具备精准唇形同步、自然表情和流畅轮次切换。
推荐理由:官方给出 Live Avatar 的实时视频对话能力、异步工具调用与 97 种语言支持,可据此判断企业级多模态交互的落地形态。
Google Private AI Compute 团队公布为 Private AI Compute 平台加入私有服务端记忆的技术方案,让 AI 助手在跨设备场景下保留长期上下文,同时维持端侧级隐私标准。
推荐理由:Google 公开了 Private AI Compute 的持久化服务端记忆方案,读者可了解云端 AI 如何在保留跨设备上下文的同时维持端侧级隐私。
Google DeepMind 发布 Gemini 3.8 Flash TTS 和 Gemini 3.8 Flash-Lite TTS 两款文本转语音模型,前者面向角色设计与逐行表演指导,后者面向高并发、低成本的配音与语音智能体场景。
推荐理由:官方给出两款 TTS 模型的语音定制能力、基准排名与开放渠道,可据此判断语音生成在配音和播客场景的可用程度。
Google DeepMind 发布 Gemini 3.8 Live 和 Gemini 3.8 Live Extended Thinking 两款实时对话模型。
推荐理由:两款语音对话模型分别面向规模成本与高复杂度任务,给出了多项语音基准成绩和开发者接入渠道。
Google DeepMind 发布 AlphaGenome Atlas,一个包含人类基因组 90 亿个单核苷酸变异效应预测的平台,规模达 1PB,是 AlphaFold Database 的 30 多倍,今日起通过网站门户、AlphaGenome API 和 Google Antigravity 中的 skill 向学术研究免费开放。
推荐理由:AlphaGenome Atlas 把 90 亿个单核苷酸变异的预测结果做成可检索资源,读者可了解其数据规模与在罕见病研究中的实际用法。