比赛结束,国产大模型完胜:Qwen优于DeepSeek。

这两个模型之间的对比,跟我解决其它问题时候的发现类似。我用免费的模型,token有限,但Qwen明显财大气粗一些,免费的token更加慷慨;而且分析思路比较长的问题的时候优势的确明显。DeepSeek短时分析能力不弱,但毕竟财小气细可能影响免费token的长度。
在这里插入图片描述


以下是最初信息


有人说,DeepSeek本来就是从量化交易而产生的。
至少目前看DeepSeek的确效果最佳,不知道继续下去如何。
在这里插入图片描述
在这里插入图片描述

背景:

网站 https://nof1.ai/ 是一个专注于金融市场的 AI 研究实验室,其核心项目名为 Alpha Arena,旨在通过真实加密货币交易环境测试和比较不同 AI 模型的交易能力。

具体来说:

  • 每个参与的 AI 模型会获得 1 万美元的初始资金,在真实的加密市场中进行交易,目标是通过智能算法实现利润最大化
  • 该平台并非模拟回测,而是实盘交易,因此结果反映的是 AI 在真实市场波动中的表现。
  • 参与竞赛的包括如 Grok、ChatGPT、DeepSeek 等主流大模型,它们被放在同一竞技场中“厮杀”。
  • 该平台也被称作 SharpeBench,是一个用于实时评估 AI 模型交易表现的基准平台
  • 背后的团队并非典型加密创业者,而是一群学术背景的 AI 研究人员,创始人包括 Jay A Zhang。

简而言之,nof1.ai 是一个用真实加密交易来训练、测试和评比 AI 模型能力的实验性平台。

更多推荐