激情五月播播久久久精品_国产激情偷乱视频一区二区三区_国产一区二区看久久_亚洲欧美成人网

當前位置: 首頁 >> 業界
AI大模型投資比賽落幕,阿里通義千問 Qwen 以 22.32% 收益率奪冠|新資訊
來源:IT之家     時間:2025-11-04 12:26:32

IT之家 11 月 4 日消息,美國研究機構 Nof1 最近發起了一項實盤測試:他們將六大頂級 AI 大語言模型(LLM)分別注入 1 萬美元作為起始資金,令其在真實市場中自主交易。

今日,第一屆 Alpha Arena 正式宣布結束,阿里旗下通義千問 Qwen3-Max 在最后關頭保持領先,以 22.32% 收益率奪得投資冠軍。


(相關資料圖)

Alpha Arena 目標是在一個動態、競爭的真實環境里檢驗這些模型在“量化交易”領域的能力。

雖然 AI 模型可以完成指定任務,但研究者指出:在風險管理、交易行為、持倉時長、方向偏好等方面,模型表現出顯著差異。

研究團隊強調,這并不是為了“選出最強模型”,而是為了推動 AI 研究從靜態、考試式的基準測試轉向對“真實世界”、“實時決策”的考察。

實驗設計

  • 每款模型均擁有 1 萬美元(IT之家注:現匯率約合 71218 元人民幣)起始資金,用于在 Hyperliquid 交易平臺上交易加密貨幣永續合約(包括 BTC、ETH、SOL、BNB、DOGE、XRP)。
  • 模型只能基于數值市場數據(價格、成交量、技術指標等)進行決策,不允許查閱新聞或時事信息。
  • 每個模型的目標為“最大化 PnL(盈虧)”,并給出了夏普比率(Sharpe Ratio)作為風險調整后的指標。
  • 交易動作被簡化為:買入(做多)、賣出(做空)、持有、平倉。所有模型使用相同提示詞(prompt)、相同數據接口、無特定微調。

初步結果

報告指出,雖然每個模型都在同樣結構下運作,但它們的交易風格、風險偏好、持倉時間、交易頻率存在明顯差異。例如:某些模型短倉(做空)次數較多,而另一些幾乎不做空。某些模型持倉時間長、交易頻率低,而另一些交易頻繁。

在數據格式敏感性方面,團隊觀察到:提示中若將“數據順序”由“新 → 舊”改為“舊 → 新”,即可修復部分模型因誤讀數據而產生的錯誤。

研究也指出,此次測試存在諸多局限:樣本有限、運行時間短、模型無往績歷史、無累積學習能力。團隊表示會在下一季引入更多控制、更多特性、更強統計實力。

意義與觀察

該項目試圖回答一個基本問題:“大型語言模型在無特定微調、僅憑數值數據輸入、在真實交易環境中,能否作為零樣本(zero-shot)系統交易模型?”

通過該實驗,Nof1 旨在促進 AI 研究轉向“舉辦真實、動態、風險驅動的基準”,而非僅僅靜態數據集。

雖然實驗尚未得出“哪款模型最強”的結論,但已揭示:即便是最先進的 LLM,在實際交易中仍面臨“動作執行”“風險控制”“市場狀態理解”“提示格式敏感性”等多方面挑戰。

推薦新聞 +
猜您喜歡 +
主站蜘蛛池模板: 日产精品高清视频免费| 国产超级av在线| 热久久99这里有精品| 日本一区视频在线观看| 久久精品日韩| 欧美在线欧美在线| 77777亚洲午夜久久多人| 久久精品视频在线播放| 丝袜亚洲欧美日韩综合| www亚洲精品| 国产精品美女在线| 国产欧美日韩中文字幕| 日韩精品一区在线视频| 一区二区三区日韩视频| 国产精品久久国产| 国产精品一区专区欧美日韩| 久久精品久久精品亚洲人| 欧美专区中文字幕| 日韩av一级大片| 欧美有码在线观看视频| 欧美成人精品在线| 美女视频久久| 久久精品国产欧美激情| 国产在线精品自拍| 国产免费一区| 国产噜噜噜噜噜久久久久久久久| 国产在线观看福利| 国产日本欧美一区二区三区在线| 久久9精品区-无套内射无码| 久久99精品久久久久久水蜜桃| 久久九九国产视频| 日韩精品久久久| 日本一区视频在线播放| 欧美高清视频一区| 久久综合五月天| 国产在线精品自拍| 国产精品福利观看| 777精品久无码人妻蜜桃| 亚洲午夜精品一区二区| 日韩一区二区三区在线播放| 日韩av在线一区二区三区|