v1

QUANTUMMIND

概念视觉
OUR FIRST MODEL

QuantumMind v1

以 QART 为方法基础,
探索推理的新可能。

QuantumMind v1 是我们基于 QART 方法体系实现的第一版模型。公开技术说明与评测结果将通过技术报告呈现。

01 / METHODOLOGY

QART 与 QuantumMind v1

QART 是我们的框架与方法体系,QuantumMind v1 是基于它实现的第一版模型。技术内容以公开报告为准。

QART / 方法概念示意QUANTUM-AUGMENTED REASONING
CONTEXT

任务与语义

理解任务背景与约束

REASONING

量子增强推理

探索复杂推理的方法

EVALUATION

结果与评测

通过实验检验方法表现

02 / EVALUATION

评测结果与比较方法

模型对比与方法实验分别呈现,并说明各自的评测口径。

QuantumMind v1 · 模型对比

将随技术报告提供同口径的评测结果与方法说明。

随技术报告更新

QART 跨模型增强实验

内部配对测试 · 以下为现有方法实验,不作为 QuantumMind v1 横评

相对 Direct 的性能变化
QART 跨模型增强实验:相对 Direct 的性能变化
BENCHMARKDeepSeek V4 FlashGLM-5.3
τ²-Bench+4.0%+5.9%
τ³-Bench+47.6%+4.8%
SciCode+84.1%+10.1%
LHTB+35.9%未提供
DeepSWE−7.8%+19.1%
Terminal-Bench 4.0+44.4%+44.4%

本页展示 2 款模型、6 项基准的 11 组内部配对结果,10 组提升、1 组下降。

计算方式

相对变化 =(接入 QART 后分数 − Direct 分数)/ Direct 分数 × 100%。

Direct 表示未接入 QART 的对照结果。LHTB 使用原生奖励指标;未提供不代表零分。

结果与局限

DeepSeek V4 Flash 在 DeepSWE 上下降 7.8%,增益受模型与任务适配影响。

结果可能与官方模型分数不同,不构成生产效果承诺。

来源:现有内部评测材料,后续与技术报告核对。

SciCode

DeepSeek V4 Flash
Direct17.18%
+ QART31.62%
得分变化+14.44 个百分点

Terminal-Bench 4.0

GLM-5.3
Direct14.29%
+ QART20.63%
得分变化+6.34 个百分点
03 / READING THE RESULTS

如何阅读这些结果

01 / COMPARISON

明确比较对象

现有配对实验比较同一模型接入 QART 前后的表现。QuantumMind v1 的模型对比将单独展示。

02 / METRICS

保留指标口径

相对提升、实际得分与百分点分别标注。不同基准的指标不合并为一个总分。

03 / SCOPE

说明适用范围

完整呈现本页范围内的负向结果和缺失项。公开实验条件及局限以技术报告为准。

TECHNICAL REPORT

更完整的技术说明,即将发布。

QuantumMind v1 · 公开方法与评测

完成后将在此提供下载

RESEARCH & COLLABORATION

一起讨论,
推理的下一步。

联系邮箱