微软研究院:将物理 AI 推理卸载到边缘或云端可提升机器人性能与续航
微软研究院对移动机器人操作负载做了首次系统性测量研究,发现把物理 AI 推理从机器人本体 GPU 卸载到边缘或云端 GPU,可提升任务成功率、支持更大模型并延长续航。
推荐理由:微软研究院首次系统测量机器人本体推理与边缘云端卸载的差异,给出任务成功率、电池续航与工具链的量化对比。
微软研究院对移动机器人操作负载做了首次系统性测量研究,发现把物理 AI 推理从机器人本体 GPU 卸载到边缘或云端 GPU,可提升任务成功率、支持更大模型并延长续航。
推荐理由:微软研究院首次系统测量机器人本体推理与边缘云端卸载的差异,给出任务成功率、电池续航与工具链的量化对比。
Berkeley AI Research 与 IBM Research 将 K-Search 进化式内核搜索框架扩展到 MLX,新增结构化 CUDA-to-MLX 翻译层,让搜索以现有 CUDA 内核为知识库生成 Apple Silicon 内核。
推荐理由:原文给出跨平台内核迁移的具体方法与实测数据,读者可据此判断 CUDA 经验向 Apple Silicon 迁移的可行路径。