Together AI8/6 08:0089 分精选
DeepSeek-V4 Flash与GPT-5.6 Luna编码成本对比
DeepSeek-V4 Flash 0731 vs GPT-5.6 Luna on DeepSWE: Cost and Coding
推荐理由:值得看:900次实测对比两大模型,GPT-5.6 Luna性能领先14点,但DeepSeek每美元解决率4.8倍,直接帮你按预算选编码模型。
Together AI在DeepSWE基准上对DeepSeek-V4 Flash 0731和GPT-5.6 Luna进行了900次测试。结果显示,GPT-5.6 Luna在pass@1指标上领先14个百分点,而DeepSeek-V4 Flash在每美元解决率上是前者的4.8倍。该对比突出了两者在编码任务中的性能与成本差异,为开发者选择模型提供了参考。