Qingming-g64-ntt-cuda: RTX4090-24G results for native Goldilocks/G64 STARK-LDE NTT
AI 摘要
一句话摘要: 发布RTX4090-24G上原生Goldilocks/G64 STARK-LDE NTT的CUDA实现及验证结果。 关键事实: 实现了qingming_fast和qingming_standard两种接口,在domain_logn 20-30范围内通过验证,domain_logn 31因容量限制不支持,最高吞吐量达703.82 GB/s。 涉及主体: uulong950, RTX4090, A100-40G 可能影响: 提升STARK证明系统中NTT运算在消费级GPU上的效率,可能推动零知识证明应用在更广泛硬件上的部署。 是否值得继续跟踪: 是,因为该实现提供了可复现的基准,且对STARK-LDE性能优化有直接参考价值,未来可能扩展至更大规模或更多硬件。 噪音/炒作风险: 低,报告基于具体硬件测试和独立验证,数据透明且可复现,无夸大成分。