跳到正文
今天10月10日周六2 条
10月9日周五
10月8日周四
  1. GitHub Blog · AI & ML62

    GitHub 推出基于 ModernBERT 的通用密钥检测模型

    GitHub 发布与 Microsoft Applied Sciences 合作微调的 ModernBERT 分类器,用上下文判断非结构化密钥,可在 2 毫秒内评估一批候选密钥,据称能把可拦截的密钥数量提升一倍以上。

    推荐理由:GitHub 用九个季度数据说明密钥泄露与代码量同步增长,并给出把检测成本压到毫秒级的工程取舍。

  2. Microsoft Research71

    微软研究院开源 Agent Lightning v1.0:3500 行代码的轻量智能体 RL 框架

    微软研究院开源 Agent Lightning v1.0,一个约 3500 行代码的轻量智能体强化学习框架,提出 Harnessed Agentic RL 范式,让部署时使用的同一套 agent harness 直接参与训练,无需在训练框架内重新实现 agent。

    推荐理由:原文给出框架的代码规模、Kubernetes 支持与训练配方,读者可据此判断真实 harness 参与 RL 的落地成本。

10月7日周三
10月1日周四
9月25日周五
9月24日周四
  1. GitHub Blog · AI & ML22

    GitHub Copilot 应用如何渲染超大 pull request

    GitHub Copilot 应用重建了 pull request 视图,用一个含 2,200 个文件、超 100 万行改动、400 多条行内评论的开源 PR 做压力测试。其做法是把文档高度拆成确定性的代码几何与动态块几何两个独立域:代码行高提前精确算出,评论等动态块按稳定 key 锚定到文件、行和侧,惰性测量并只做小幅修正,从而避免滚动跳变。

  2. Microsoft Research60

    微软研究院:将物理 AI 推理卸载到边缘或云端可提升机器人性能与续航

    微软研究院对移动机器人操作负载做了首次系统性测量研究,发现把物理 AI 推理从机器人本体 GPU 卸载到边缘或云端 GPU,可提升任务成功率、支持更大模型并延长续航。

    推荐理由:微软研究院首次系统测量机器人本体推理与边缘云端卸载的差异,给出任务成功率、电池续航与工具链的量化对比。

  3. Google DeepMind62

    Google DeepMind 为 Private AI Compute 引入安全服务端持久记忆

    Google Private AI Compute 团队公布为 Private AI Compute 平台加入私有服务端记忆的技术方案,让 AI 助手在跨设备场景下保留长期上下文,同时维持端侧级隐私标准。

    推荐理由:Google 公开了 Private AI Compute 的持久化服务端记忆方案,读者可了解云端 AI 如何在保留跨设备上下文的同时维持端侧级隐私。

7月29日周三
  1. Berkeley AI Research60

    从 CUDA 到 MLX:K-Search 如何把内核优化经验带到 Apple Silicon

    Berkeley AI Research 与 IBM Research 将 K-Search 进化式内核搜索框架扩展到 MLX,新增结构化 CUDA-to-MLX 翻译层,让搜索以现有 CUDA 内核为知识库生成 Apple Silicon 内核。

    推荐理由:原文给出跨平台内核迁移的具体方法与实测数据,读者可据此判断 CUDA 经验向 Apple Silicon 迁移的可行路径。

7月7日周二
5月8日周五