IA · Verificado por ViaMind
DeepSeek V4 Pro 0813 vs GPT-5.6 Sol: costo y precisión en DeepSWE
Together AI comparó ambos modelos en 904 ejecuciones de DeepSWE. GPT-5.6 Sol lidera pass@1 por 10 puntos, pero cuesta 35 veces más; DeepSeek V4 Pro gana en pass@4 y una cascada Pro-first alcanza 83,0%.
Fuente: Together AI · Ver original ↗
Lo reportado
Resultados del benchmark
Según Together AI, en 904 ejecuciones de DeepSWE, GPT-5.6 Sol supera a DeepSeek V4 Pro 0813 en pass@1 por 10 puntos, pero a un costo 35 veces mayor. DeepSeek V4 Pro gana en pass@4, y una cascada que prioriza Pro alcanza 83,0%.
Implicaciones de costo y enrutamiento
La diferencia de costo sugiere que usar DeepSeek V4 Pro como primera opción y recurrir a GPT-5.6 Sol solo cuando sea necesario puede optimizar el gasto sin sacrificar demasiada precisión. Together AI destaca la cascada Pro-first como estrategia eficiente.
Estado de evidencia: Las afirmaciones materiales incluidas fueron contrastadas con la evidencia enlazada.
Qué seguir
Observar si otros benchmarks independientes confirman la relación costo-precisión y si surgen implementaciones de cascada Pro-first en producción.
Compartir esta historia
RECIBE VIAMIND RADAR
Lo que importa,
directo en tu correo.
Un resumen diario con una historia clave de cada sección.


