JetBrains 发布编程 AI 模型 Mellum2.1 高负载推理吞吐量接近 Qwen3.5-9B 两倍
The Block
Ai 注目
JetBrains 发布 Mellum2.1,重点增强智能体编程能力。该模型延续 12B 混合专家架构,采用 Apache 2.0 许可证,并通过强化学习、MTP 和内部沙盒环境提升代码探索、修复与验证能力。
役立つ
No.ヘルプ

IT之家 10 月 9 日消息,JetBrains 昨日(10 月 8 日)发布博文,宣布上线 Mellum2.1 模型,重点增强智能体编程能力。该模型延续 Mellum2 的 12B 混合专家架构,拥有 2.5B 活跃参数,并继续采用 Apache 2.0 许可证发布。

Mellum2.1 主要升级预训练后的强化学习阶段,从短期收尾环节扩展为训练主体,并在数学、算法竞赛、科学、工具使用和软件工程等任务中补充训练数据。

JetBrains 为该模型搭建了内部强化学习环境基础设施,在训练期间启动数百万个沙盒,覆盖数千个环境。此外在训练前,团队还筛选了开放数据集,剔除测试缺陷、不可验证答案及难度失当的任务。

升级后,Mellum2.1 可探索代码库、编辑文件并检查自身修改。JetBrains 称,其最大改进出现在智能体编程领域,模型可识别失败测试的根因,起草修复方案并验证结果。

在性能方面,Mellum2.1 与 Mellum2 架构一致,速度保持不变,多 Token 预测(MTP)进一步提升响应速度。单请求场景下,MTP 使其速度提高约 1.6 倍。

JetBrains 将 Mellum2.1 与 Mellum2、Qwen3.5-9B 及 Gemma 4 E4B 在相同评估设置下比较。结果显示,高负载时 Mellum2.1 的推理吞吐 Token 数量接近 Qwen3.5-9B 的两倍,并在编程、算法竞赛、数学、工具调用和通用知识等维度均有提升。IT之家附上相关截图如下:

Mellum2.1 现已登陆 Hugging Face,支持本地或自有基础设施部署,让企业可将代码和数据保留在自身环境中。官方后续还将会推出面向 llama.cpp、Ollama 和 LM Studio 的 GGUF 版本,以及 vLLM 的 MTP 推测解码组件。

チップ
$0
いいね
0
保存
0
閲覧数 7
CoinWorldは、読者の皆様にブロックチェーンを理性的に捉え、リスク意識を高め、各種仮想トークンの発行と投機に注意を払うようお願いします。サイト内のすべてのコンテンツは市場情報または関連する見解のみであり、いかなる形式の投資アドバイスも構成しません。機密情報を含むコンテンツを発見した場合は、“報告”,をクリックしてください。すぐに対処します。
送信
コメント 0
人気
最新
まだコメントがありません。最初のコメントを投稿しましょう!
関連
Chainlink推出CCIP Vault Adapters:跨链存入金库,难点不止“一键”
DeFi金库通常把资产和策略放在一条主链上,用户却可能分散在几十条链。过去,想从另一条链存入,用户要自己桥接、切换网络、授权代币,再完成存款,每一步都有费用和出错机会。Chainlink在10月8日宣布CCIP Vault Adapters上线,试图把这串动作收进同一笔跨链存款流程。官方称,单一网络上的金库可面向80多条受支持链吸收存款,而不必在每条链重新部署一套金库。这是跨链分发能力的更新,不是对所有金库收益或安全性的保证。
币界网
·2026-10-09 15:45:53
6
欧元区服务业7月小幅回升:0.4%背后,各行业并未一起转暖
在制造业与通胀消息之外,服务业产出更接近许多人的日常工作。欧盟统计局10月7日发布的初步数据表明,2026年7月欧元区服务业产出环比增长0.4%,欧盟整体增长0.3%;前一个月两者都下降0.3%。同比看,欧元区和欧盟均增长1.5%。这是一项回升信号,但单月从负转正不等于服务业已进入持续加速阶段,更不能直接推导下一次利率决定。
币百科
·2026-10-09 15:45:48
7
英国企业AI采用率升至30%:大公司跑得快,生产率还要另算
人工智能已经不是少数科技公司的试验。英国国家统计局10月8日公布的企业调查显示,2026年9月,约30%的受访企业报告正在使用至少一种AI技术;这个问题首次在2023年9月提出时,比例为9%。企业规模之间的距离更值得看:员工不少于250人的企业中,使用比例达到51%,而少于10人的企业约为29%。这份数据记录的是技术进入企业的速度,不是它已经让整个英国经济增产了多少。
币百科
·2026-10-09 15:45:46
5
LegalOn用三档模型压低开发成本:省钱的关键不是“全员换小模型”
企业把AI编程助手铺到研发团队后,账单通常比演示阶段复杂得多。同样一次开发任务,需求是否清楚、代码库有多大、是否需要架构判断,都会改变模型的使用量。OpenAI在10月8日发布的LegalOn Technologies案例中,描述了这家法律科技企业如何在保留开发速度的同时管理Codex费用:按任务复杂度选择模型,限制默认使用的快速模式,再给不同业务设置不同预算。案例称,相对原先的使用方式,估算日成本下降约65%。这个数字很醒目,但不能脱
CoinMeta
·2026-10-09 15:45:44
5
Anthropic免费开放OSS Scanner:开源维护者终于等到“先看报告再决定”
一个开源项目可能只有几名维护者,却被成千上万家企业当作基础设施使用。漏洞报告一旦涌入,这几个人首先要做的不是写补丁,而是判断报告是否真实、是否重复、能否被利用,以及公开前该通知谁。10月8日,Anthropic宣布向符合条件的开源项目开放OSS Scanner,提供定期、免费的模型安全扫描。它把一道长期由维护者独自承担的题摆到台前:发现漏洞的速度越来越快,验证与修复是否跟得上?
CoinMeta
·2026-10-09 15:45:41
5
もっと見る