Paradigma开源10亿参数数学模型Violetto,官方称AIME 2026得分94.01%
意大利AI实验室Paradigma发布并开源数学模型Limite 1B - Violetto,官方评测称其AIME 2026得分94.01%,但横向成绩并...
快讯正文
1B参数干到AIME 94%,Paradigma开源数学专用模型
动察 Beating AI 快讯,意大利 AI 实验室 Paradigma 发布首个模型 Limite 1B - Violetto。它只有 10 亿参数,专门用来解数学题。模型从零训练,使用不到 3000 亿 tokens,随后再经过 SFT 和强化学习后训练。
官方公布的评测表中,Violetto 在 AIME 2026 得到 94.01%,超过多款 3B 到 120B 模型。不过部分对手成绩直接取自模型卡或 MathArena,并非 Paradigma 统一复测,评测配置可能不同。
Paradigma 把 Violetto 定位为高吞吐数学模型,重点是把模型做小、做专。它主要处理单轮数学问题,也计划作为多 Agent 系统里的高频数学求解器。
模型权重和 vLLM 推理代码已按 Apache 2.0 协议开放。
原文链接 https://m.theblockbeats.info/flash/368445
补充解读
意大利AI实验室Paradigma发布并开源数学模型Limite 1B - Violetto,官方评测称其AIME 2026得分94.01%,但横向成绩并非全部统一复测。
模型发布、开源协议及训练信息表述明确,来源为专业媒体转述;但94.01%的成绩来自项目方评测表,且部分竞品数据并非同一环境复测,因此性能领先幅度尚需独立验证。该事件对关注资产没有明确直接影响,主要意义在于展示小参数专用模型的效率潜力。
关注后续官方信息,不根据单一消息做决定。
Paradigma发布的完整模型卡、训练细节与评测配置
第三方在统一推理预算和评分规则下复测AIME 2026成绩
模型下载量、开发者采用情况及多Agent系统中的实际表现
同事件进展
正在加载事件时间线…