myrtle.ai 表示,其 VOLLO ® 推理加速器在 STAC 至 ML Markets (Inference)的梯度提升树基准测试中創下了新紀錄,將99百分位延遲降低了超過30%,並將吞吐量提高了至少5倍。經過 STAC ® 審核的結果於今日在倫敦舉行的 STAC Summit 上公佈。
在一台搭载 AMD Alveo ™ V80LL Compute Accelerator 的 Blackcore 代幣發行N 3132- SM + 服務器上,VOLLO 在三種模型上的 p99 延遲均低於 2 微秒。對於最小的模型,它實現了每秒 5000 萬次推理,p99 延遲僅為 1.77 微秒。
myrtle.ai 指出,在電子交易中,市場數據到達與做出決策之間的時間會直接影響收益。低且可預測的延遲使機構能夠運行更大、更精確的模型,而不會錯過市場機會,因此模型質量不再需要為了速度而妥協。
myrtle.ai 首席執行官 Peter Baldwin 表示:「交易公司希望在不犧牲速度的情況下運行越來越強大的模型,而這些結果表明他們可以做到。開發者現在無需任何 FPGA 專業知識,就能在 VOLLO 上測試自己的模型,並親眼看到差異。」
繼4月公布的STAC Tacana結果之後,VOLLO現在同時保持着決策樹和神經網路的確定性延遲紀錄。公司表示,該產品已經在生產環境中得到驗證,數十萬小時的實盤交易為全球許多領先的交易公司創造了alpha。其模型靈活性也使其成爲電信、網絡安全和國防領域的優選平台。
STAC - ML Markets(Inference)是一項用於實時市場數據推理的技術基準標準。該基準由來自領先金融機構的量化及技術人員設計,用於報告能夠運行所提供模型之技術架構的性能、資源效率及品質。完整結果可於STAC報告(SUT ID MRTL2026905)中查閱,網址為www.STACresearch.com / MRTL2026905。
ML 开发者目前即可評估自己模型在 VOLLO 上的表現,無需 FPGA 工具或相關經驗。請訪問 myrtle.ai / vollo-trees 或聯絡 [ email protected ]。
關於 myrtle.ai
myrtle.ai 是一家 AI / ML 軟件公司,其在各大 FPGA 供應商的平台上提供超低延遲推理加速器。其加速器應用於金融交易、無線電信、LLM、語音處理和推薦等場景。
VOLLO、VOLLO Accelerator和VOLLO標識是myrtle.ai的註冊商標。「STAC」及所有STAC名稱是Strategic Technology Analysis Center、LLC的商標或註冊商標。AMD、AMD Arrow標識、Alveo及其組合均爲Advanced Micro Devices、Inc的商標。











