跳到正文
今天10月10日周六1 条
10月9日周五
  1. Simon Willison36

    Simon Willison 用 Codex 语音模式为博客新增 Newsletters 页面

    Simon Willison 用 ChatGPT 桌面版 Codex 标签页的语音对话模式,在做饭的半小时里几乎全程靠说话为博客开发出 Newsletters 页面,模型为 GPT-6 Astra High。该功能包含 Django 新模型与迁移、四个可用的导入脚本、/newsletters/ 归档页及站内搜索集成,随后他又花半小时打字改用 API 导入并完成 PR 审查上线。

10月8日周四
10月6日周二
  1. Latent Space78

    Reflection 发布 Beam:501B 总参数 23B 激活的美国开源 MoE 模型

    Reflection 发布 Beam,一个面向编码、智能体和科研的纯文本 MoE 模型,总参数 501B、激活 23B,从零训练,Apache 2.0 全量权重预计本月放出。

    推荐理由:Reflection 从 stealth 状态发布 501B 总参数开源权重模型,并给出预训练与 RL 的算力规模,可对照同期中美开源模型的位置。

10月5日周一
10月2日周五
  1. GitHub Blog · AI & ML22

    AI 正在改变开发者工作方式,GitHub 给出三项需要强化的技能

    GitHub 博客指出,AI 正在改变开发者工作方式,写代码仍重要,但开发者更需要学会指挥 AI、评估其输出并做出技术决策。文章给出三项建议:学会指挥 AI 智能体而非只是使用它;不要轻信 AI 的第一个答案,可用第二个模型进行批判,例如 GitHub Copilot 内置的 Rubber Duck agent 会用第二个模型审查计划、代码和测试;用 AI 节省的时间去解决更大的问题。

10月1日周四
  1. Google DeepMind80

    Google DeepMind 发布 Gemini 4 Argon 前沿模型

    Google DeepMind 发布新前沿模型 Gemini 4 Argon,先通过 Fairwind Program 向受信任的网络安全防御者开放,随后逐步扩展至开发者、企业和消费者。

    推荐理由:官方给出 Gemini 4 Argon 在编码、企业知识与网络安全防御上的能力与定价,可据此判断前沿模型的落地节奏。

9月18日周五
  1. GitHub Blog · AI & ML22

    GitHub Podcast 拆解 AI 热门观点:该不该读 AI 生成的代码、RAG 是否已死、Skills 是否杀死了 MCP

    GitHub Podcast 最新一期拆解了五个 AI 热门观点:AI 生成的代码仍需阅读和负责,只是审查力度应按风险分级;Skills 与 MCP 解决不同问题,前者是打包的团队经验,后者是智能体连接工具与数据的标准;RAG 并未死亡,检索能让模型从更接近答案的位置起步,减少 token 消耗和回答不完整。节目还讨论了企业招聘中的 AI 使用判断力,以及微调需求往往暴露的是代码库可维护性问题。