AINews:TypeSafe/Jev 上线三周 ARR 超 1 亿美元、估值 75 亿美元
AINews 汇总 10 月 8 日至 9 日动态:TypeSafe 宣布 Series AI,Sequoia 透露其上线首周 ARR 突破 1 亿美元,Jev 成为多家厂商对标的决策模型参考点。
AINews 汇总 10 月 8 日至 9 日动态:TypeSafe 宣布 Series AI,Sequoia 透露其上线首周 ARR 突破 1 亿美元,Jev 成为多家厂商对标的决策模型参考点。
AI 模型众包排行榜 Arena 完成 2 亿美元 B 轮融资,估值达 31 亿美元,较 1 月 A 轮的 17 亿美元投后估值在约 10 个月内近乎翻倍。
Anthropic 发布 Claude Haiku 5.5,这是 Haiku 系列约一年来的首次更新,定价与 OpenAI 的 GPT-6 Luna 持平,官方称其平均运行成本比 Haiku 4.5 低约 75%。
推荐理由:汇总了 Haiku 5.5 的定价、独立评测与 token 消耗数据,可据此判断小模型在智能体工作流中的成本取舍。
OpenAI 以博客、GitHub 仓库和推文形式公开了内部前沿模型的数学成果,共 722 篇手稿、归入 372 个相关结果族,来自约 4000 道研究问题的评测,平均每个结果消耗约 3 小时 ChatGPT Pro 思考算力,模型本身尚未发布。
推荐理由:OpenAI 内部模型一次性产出 722 篇数学手稿,读者可据此了解这批结果的规模、算力成本与外界质疑。
Microsoft 的 Jennifer Neville 在 Microsoft Research Podcast 中讨论评测如何推动 AI 系统性能边界,以及模型在传统 benchmark 之外测试时出现的“意外失败”。她结合自身从数学、物理、认知科学转向计算机科学的经历,分享与当前 AI 系统协作的实用建议,并强调当结果偏离预期时应仔细审视数据。
GitHub 发布代码审查离线基准 ReviewBench,基于 1.039 亿个 GitHub pull request 的分布特征,构建了覆盖 19 种语言、187 个开源仓库的 219 个 pull request 评测集。
Latent Space 的 AINews 汇总了 10 月 1 日至 2 日的 AI 动态:OpenAI 发布 GPT-6.1 Sol,定价为每百万输入/输出 token 2 美元和 10 美元。