跳到正文
  1. Hugging Face Blog66

    Nemotron 微调后在 IOI 2026 与 IMO 2026 双双达到金牌水平

    英伟达团队从 Nemotron 3 出发,用 SFT、RL 和生成-验证-改进的推理流程,让 Nemotron-3-Ultra-CC 在 IOI 2026 取得 535.4/600,超过 361.12 的金牌线,也高于人类最高分 498.27;IMO 2026 系统则拿到 30/42,超过 29 分的官方金牌线。

    推荐理由:原文公开了从 Nemotron 3 微调到 IOI、IMO 金牌级成绩的完整配方与数据集,可据此复现领域专家模型。

  1. OpenAI News62

    OpenAI 公布内部前沿模型在数学开放问题上的新结果

    OpenAI 发布内部前沿模型在数学开放问题上取得的新结果,并公开了 Lean 证明形式化内容与相关研究细节。这些材料已发布在 GitHub 上,供研究者查看。

    推荐理由:OpenAI 公开内部前沿模型在数学开放问题上的结果,并同步放出 Lean 形式化证明,可供研究者直接复核。

  1. Microsoft Research62

    微软研究院:将物理 AI 推理卸载到边缘或云端可提升机器人性能与续航

    微软研究院对移动操作机器人工作负载做了首次系统性研究,发现把物理 AI 推理从机器人端侧 GPU 卸载到边缘或云端 GPU,可提升任务成功率、支持更大模型并延长续航。

    推荐理由:微软研究院系统测量了机器人端侧 GPU 推理的瓶颈,并给出可复用的 Kubernetes 卸载工具链,读者可据此判断物理 AI 的部署取舍。

  1. Berkeley AI Research62

    从 CUDA 到 MLX:K-Search 如何把数十年内核经验带到 Apple Silicon

    Berkeley AI Research 与 IBM Research 将演化式内核搜索框架 K-Search 扩展到 MLX 后端,并加入结构化 CUDA-to-MLX 翻译层,让已有 CUDA 内核作为知识库适配到 Apple Silicon。

    推荐理由:展示了把 CUDA 内核优化经验结构化迁移到 Apple Silicon 的方法,读者可据此判断跨硬件内核迁移的可行路径。

已经到底了