myrtle.ai 的 VOLLO 在梯度提升樹推理上創下了新的 STAC-ML 紀錄
在今天於倫敦 STAC Summit 公布的經審計基準測試中,99百分位延遲低於2微秒,吞吐量最高達每秒5000萬次推理。
英國劍橋,2026年10月6日 / PRNewswire / -- 今日宣佈,其 VOLLO ®推理加速器在 STAC 至 ML Markets ( Inference )的基準梯度提升樹測試中創下了新紀錄,將99百分位延遲降低了30%以上,並將吞吐量提高了至少5倍。經過 STAC ®審計的結果於今日在倫敦舉行的 STAC Summit 上公佈。
VOLLO 在 Blackcore 代幣發行N 3132- SM + 伺服器中的 AMD Alveo ™ V80LL 計算加速器上運行,在全部三種模型上均實現了低於2微秒的 p99 延遲。對於最小的模型,它在 p99 延遲僅1.77微秒的情況下,持續實現了每秒5000萬次推理。
在電子交易中,市場數據到達與做出決策之間的時間會直接影響收益。低且可預測的延遲使機構能夠運行更大、更精確的模型,而不會錯過市場,因此模型質量不再需要為速度讓步。
myrtle.ai 首席執行官 Peter Baldwin 表示:「交易公司希望在不犧牲速度的情況下運行越來越強大的模型,而這些結果表明他們可以做到。開發者現在無需任何 FPGA 經驗,就能在 VOLLO 上測試自己的模型,並親眼看到差異。」
繼4月公布的STAC Tacana結果之後,VOLLO現在同時保持着決策樹和神經網絡確定性延遲的紀錄。該產品已經在生產環境中得到驗證,數十萬小時的實盤交易為全球許多領先的交易公司創造了alpha。其模型靈活性也使其成爲電信、網絡安全和國防領域的首選平台。
STAC - ML Markets(Inference)是一項針對實時市場數據推理運行的技術基準標準。該基準由來自領先金融機構的量化及技術人員設計,用於報告任何能夠運行所提供模型之技術架構的性能、資源效率及品質。完整結果請見STAC報告(SUT ID MRTL2026905),網址為www.STACresearch.com / MRTL2026905。
ML 开發者現在無需 FPGA 工具或相關經驗,就能評估自己模型在 VOLLO 上的表現。請訪問 myrtle.ai / vollo-trees 或聯絡 [email protected]。
關於 myrtle.ai
myrtle.ai 是一家 AI / ML 軟件公司,其在來自各大領先 FPGA 供應商的基於 FPGA 的平台上提供超低延遲推理加速器。其加速器應用於金融交易、無線電信、大語言模型、語音處理和推薦系統等場景。
VOLLO、VOLLO Accelerator 和 VOLLO 标识是 myrtle.ai 的註冊商標。「STAC」及所有 STAC 名稱是 Strategic Technology Analysis Center、LLC 的商標或註冊商標。AMD、AMD 矢量標識、Alveo 及其組合均為 Advanced Micro Devices 的商標。










