Together AI8/6 08:0089精选

DeepSeek-V4 Flash与GPT-5.6 Luna编码成本对比

DeepSeek-V4 Flash 0731 vs GPT-5.6 Luna on DeepSWE: Cost and Coding

阅读原文

推荐理由:值得看:900次实测对比两大模型,GPT-5.6 Luna性能领先14点,但DeepSeek每美元解决率4.8倍,直接帮你按预算选编码模型。

Together AI在DeepSWE基准上对DeepSeek-V4 Flash 0731和GPT-5.6 Luna进行了900次测试。结果显示,GPT-5.6 Luna在pass@1指标上领先14个百分点,而DeepSeek-V4 Flash在每美元解决率上是前者的4.8倍。该对比突出了两者在编码任务中的性能与成本差异,为开发者选择模型提供了参考。

关联讨论 · 4

来源与依据

时间证据
8/6 08:00
收录于 8/7 13:30
交叉线索
3 个独立来源
内容可信度:中高