myrtle.ai的VOLLO在梯度提升树推理上创下新的STAC-ML纪录
在今天于伦敦STAC Summit公布的经审计基准测试中,99分位延迟低于2微秒,吞吐量最高达每秒5000万次推理
英国剑桥,2026年10月6日 /PRNewswire/ -- myrtle.ai今天宣布,其VOLLO®推理加速器在STAC-ML Markets(Inference)基准的梯度提升树测试中创下新纪录,将99分位延迟降低了30%以上,并将吞吐量提高至少5倍。STAC®审计后的结果于今天在伦敦举行的STAC Summit上公布。
VOLLO运行在Blackcore 代币发行N 3132-SM+服务器中的AMD Alveo™ V80LL计算加速器上,在全部三种模型上都实现了低于2微秒的p99延迟。对于最小的模型,它在p99延迟仅1.77微秒的情况下,持续实现了每秒5000万次推理。
在电子交易中,市场数据到达与做出决策之间的时间会直接影响收益。低且可预测的延迟使机构能够运行更大、更准确的模型,而不会错过市场,因此模型质量不再需要为速度让步。
myrtle.ai首席执行官Peter Baldwin表示:“交易公司希望在不牺牲速度的情况下运行越来越强大的模型,而这些结果表明他们可以做到。开发者现在无需任何FPGA经验,就能在VOLLO上测试自己的模型,并亲自看到差异。”
继4月公布的STAC Tacana结果之后,VOLLO现在同时保持着决策树和神经网络确定性延迟的纪录。该产品已在生产环境中得到验证,数十万小时的实盘交易为全球许多领先交易公司创造了alpha。其模型灵活性也使其成为电信、网络安全和国防领域的首选平台。
STAC-ML Markets(Inference)是针对实时市场数据推理运行的技术基准标准。该基准由来自领先金融机构的量化和技术人员设计,用于报告任何能够运行所提供模型的技术栈的性能、资源效率和质量。完整结果见STAC报告(SUT ID MRTL2026905),网址为www.STACresearch.com/MRTL2026905。
ML开发者现在无需FPGA工具或相关经验,就能评估自己的模型在VOLLO上的表现。请访问myrtle.ai/vollo-trees或联系[email protected]。
关于myrtle.ai
myrtle.ai是一家AI/ML软件公司,在来自各大领先FPGA供应商的基于FPGA的平台上提供超低延迟推理加速器。其加速器应用于金融交易、无线电信、大语言模型、语音处理和推荐系统等场景。
VOLLO、VOLLO Accelerator和VOLLO标识是myrtle.ai的注册商标。“STAC”及所有STAC名称是Strategic Technology Analysis Center, LLC的商标或注册商标。AMD、AMD箭头标志、Alveo及其组合均为Advanced Micro Devices, Inc.的商标。










