合约如何运作
概率
价格如何变动
分析
背景
影响概率的因素
Claude当前榜单位置
Anthropic的模型目前在LMArena总榜上处于领先或接近领先位置,这是市场给出高概率的直接基础。只要这一位置在9月30日检查时点前未被明显超越,结果倾向于“是”。
竞争对手旗舰发布时点
OpenAI、谷歌或xAI若在9月底前发布新旗舰模型并在盲测中胜出,会直接压低这一概率。目前没有公开确认的、已展示超越现有榜首表现的具体发布计划,这是概率维持较高水平的关键前提。
中国实验室的追赶速度
阿里巴巴通义千问和深度求索近年模型迭代速度较快,曾在部分类别榜单上取得亮眼名次,若其新版本在9月底前提交并在总榜盲测中胜出,可能改变结果。目前尚无证据显示已有此类模型进入总榜前列。
检查时点的瞬时性
结算依据是9月30日中午12点(美国东部时间)这一固定时刻的榜单快照,而非整月平均表现。这意味着临近检查日期前后的任何新模型发布,其影响会被放大,即便发布时间很短。
并列处理规则
若出现评分并列,先看底层Arena分数,再按公司名称字母顺序判定归属。这一规则只在结果非常接近时才起作用,目前的高概率意味着交易者预期出现如此接近并列的情况本身概率不高。
支持理由
- Anthropic的模型目前在LMArena文本竞技场总榜上处于领先或接近领先的位置。
- 截至目前没有公开确认的竞争对手旗舰模型计划在2026年9月30日前发布并已展示出明显超越现有榜首的基准表现。
- Anthropic此前曾在该榜单上维持领先位置较长时间,说明其模型在人类盲测偏好上具备持续竞争力。
反对理由
- OpenAI、谷歌或xAI有可能在9月底前发布新旗舰模型,并在盲测投票中反超Claude。
- 阿里巴巴通义千问或深度求索等中国实验室的模型迭代速度较快,存在在检查时点前提交更强版本并进入总榜前列的可能性。
- 该榜单历史上曾多次因新模型发布而在数周内更替第一名,说明榜首位置本身并非长期稳定。
后续关注
交易该结果合约
- 免 Gas 费
