Goodfire 推出模型内部监控器,拦截失控 AI 智能体成本更低
Goodfire 发布一种监控 AI 智能体的新方式,通过读取模型内部激活信号而非重新审查其输出,来发现失控行为,该监控器面向 Baseten 客户开放。
Goodfire 发布一种监控 AI 智能体的新方式,通过读取模型内部激活信号而非重新审查其输出,来发现失控行为,该监控器面向 Baseten 客户开放。
AI 与硬件初创公司 Natura 发布 99 美元智能戒指 Interface,按下手指即可让 AI 智能体完成任务、记录想法,无需掏出手机。
Google 在 Google Cloud 活动上宣布为 Gemini 推出统一智能体,可接受目标而非仅指令,自行规划任务、调用自定义技能与工具并连接企业内部系统。
Extend 工程师 Bo Lau 搭建了一个模拟 Elizabeth Holmes 办公桌的网站,可打开她的 MacBook、滑动 iPhone,并运行 Theranos Edison 检测仪,其中的短信、邮件、幻灯片和文档均来自 United States v. Holmes 刑事庭审公开证据。
Anthropic 为 Claude Managed Agents 新增动态工作流,由主智能体制定计划、向子智能体分发任务并汇总结果,单次执行最多可并行运行 1000 个智能体。
Anthropic 启动长期项目 Cyber Mission,其中关键基础设施防御计划(CIDP)向电网、水务和交通网络运营方开放 Claude 模型、工程师与威胁分析,CrowdStrike、Palo Alto Networks、Deloitte 和 Rockwell Automation 为创始合作伙伴。
Amazon Bedrock 上线 OpenAI 的 GPT-6 Astra、Sol、Luna 系列模型,其中 GPT-6 Astra 支持最高 100 万输入 token,Ultrafast 档推理速度最高提升 6 倍、达 300 tokens/秒。
Instinct 以邀请制、无营销、无 App 的方式推出 AI 智能体,靠 iMessage、WhatsApp 和邮件完成预约、报名、退货等日常事务,9 月底公司估值达 100 亿美元。面对 OpenAI 的 Dots 和 Meta 的 Muse 等大厂同类产品,创始人 Noah Shinn 称 Instinct 专注个人生活助理,测试中其表现与两者相当,但仍受限于网页信息缺失等现实问题。
Asana 借助 Codex 中的 GPT-6 Astra,在浏览器测试中让浏览器智能体的模型成本降低 76 倍、速度提升 5 倍,从而为客户提供能力更强的模型。
Simon Willison 发布 ttok 1.0,将默认 tokenizer 从 GPT-4 切换为 GPT-5/GPT-6。
Simon Willison 的 token 计数 CLI 工具 ttok 发布 0.4 版,修复了 Click 警告、更新了 CI,并新增 --list-models 命令用于列出可用模型。该工具基于 OpenAI 开源的 tiktoken 库,可通过 uvx 直接运行,例如 `cat file.txt | uvx ttok`。
Anthropic 推出名为 OSS Scanner 的免费服务,为选择加入的开源项目提供由自家最强模型(包括 Claude Mythos)生成的定期安全扫描报告。
Anthropic 为 Claude 推出两项 beta 功能:Dashboards 可连接 BigQuery、Databricks、Snowflake、Salesforce 等数据源。
Incarna 借助 Amazon Bedrock AgentCore payments,让智能体通过 x402 按次向 BlockRun 支付模型推理费用,将接入 x402 支付支持的工作量从数月缩短到数天,并已把端到端按次付费推理流程投入生产。
Oracle 在招聘、工程和运营环节借助 ChatGPT Work 与 Codex,把专家知识转化为快速、可重复的工作流,将原本需要数天的工作缩短到几分钟。
Pollo AI 借助 GPT-5.6、GPT-6 Astra 和 GPT-Image-2.5,帮助创作者把创意转化为精细图像和电影级视频广告。
Nvidia 正大力押注物理 AI,推出面向物理 AI 的全栈安全解决方案,目标指向更安全的 Robotaxi 和人形机器人。该方案目前已被多家机器人公司采用。
Artcraft 从面向艺术家的可控 AI 工具转向开源应用套件,用 Claude Opus 5.5 以 Rust 重写并复刻 Photoshop、Illustrator、Premiere、Lightroom、After Effects、InDesign 和 Acrobat Pro 的界面与工具,部分提供 WebAssembly 浏览器版本。
AWS 宣布 Claude Haiku 5.5 在 Amazon Bedrock 和 Claude Platform on AWS 上可用。
推荐理由:AWS 官方给出 Haiku 5.5 在 Bedrock 上的可用区域、定价与调用方式,读者可据此判断它作为低成本子智能体的落地路径。
GitHub 发布与 Microsoft Applied Sciences 合作微调的 ModernBERT 分类器,用上下文判断非结构化密钥,可在 2 毫秒内评估一批候选密钥,据称能把可拦截的密钥数量提升一倍以上。
推荐理由:GitHub 用九个季度数据说明密钥泄露与代码量同步增长,并给出把检测成本压到毫秒级的工程取舍。
微软研究院开源 Agent Lightning v1.0,一个约 3500 行代码的轻量智能体强化学习框架,提出 Harnessed Agentic RL 范式,让部署时使用的同一套 agent harness 直接参与训练,无需在训练框架内重新实现 agent。
推荐理由:原文给出框架的代码规模、Kubernetes 支持与训练配方,读者可据此判断真实 harness 参与 RL 的落地成本。
Latent Space 采访了 Kubernetes 创始人 Craig McLuckie 和 Joe Beda,他们创办的 Stacklok 正把编码智能体从桌面搬到云端。
OpenAI 将 College Planner 引入 ChatGPT for Teens,帮助学生管理大学申请,同时上线闪卡、测验功能,并成立青少年 AI 委员会。
GitHub Security Lab 发布 Fuzzing Taskflow,一个面向 C/C++ 项目的自主模糊测试流水线,只需指向一个 GitHub 仓库,它就会识别入口点、分析构建系统、编写 harness、运行 AFL++、读取覆盖率报告并改进 harness,最后对每个崩溃做分诊并生成漏洞报告。
推荐理由:GitHub Security Lab 把模糊测试的 harness 编写、覆盖率追踪与崩溃分诊交给 LLM 智能体,读者可了解其任务流与工具分层设计。
Google DeepMind 发布 Gemini 3.8 Live with Live Avatar,在 Gemini 3.8 Live 的原生实时对话模型上加入近实时视频生成,实现听、看、说的动态视觉形象,具备精准唇形同步、自然表情和流畅轮次切换。
推荐理由:官方给出 Live Avatar 的实时视频对话能力、异步工具调用与 97 种语言支持,可据此判断企业级多模态交互的落地形态。
Google Private AI Compute 团队公布为 Private AI Compute 平台加入私有服务端记忆的技术方案,让 AI 助手在跨设备场景下保留长期上下文,同时维持端侧级隐私标准。
推荐理由:Google 公开了 Private AI Compute 的持久化服务端记忆方案,读者可了解云端 AI 如何在保留跨设备上下文的同时维持端侧级隐私。
Google DeepMind 发布 AlphaGenome Atlas,一个包含人类基因组 90 亿个单核苷酸变异效应预测的平台,规模达 1PB,是 AlphaFold Database 的 30 多倍,今日起通过网站门户、AlphaGenome API 和 Google Antigravity 中的 skill 向学术研究免费开放。
推荐理由:AlphaGenome Atlas 把 90 亿个单核苷酸变异的预测结果做成可检索资源,读者可了解其数据规模与在罕见病研究中的实际用法。