El 18 de agosto, según lo divulgado por MaxForAI, el proyecto de IA J-Space Cognition Suite, que hoy se volvió viral en la plataforma X, ha generado críticas por parte de la comunidad. Se le acusa de que los resultados de las pruebas de DeepSeek V4 que promociona no pueden reproducirse. El proyecto había afirmado anteriormente que, con V4 Flash junto con J-Space, se podía igualar el rendimiento de GLM-5.3, y que V4 Pro, a su vez, podía superar a Fable 5 en múltiples Agent Benchmark, con un aumento de velocidad de 2.53 veces y una mejora de la eficiencia de tokens de 2.21 veces.
El usuario de GitHub GoForceX realizó una nueva prueba de verificación de alta concurrencia usando el subconjunto de 87 preguntas de Terminal Bench 2.1, y confirmó que se cargaron los módulos relacionados con J-Space. Los resultados mostraron que, al añadir J-Space, el rendimiento del benchmark en realidad disminuyó ligeramente; además, aumentaron tanto el uso de tokens como el costo, lo cual va en dirección contraria a las mejoras de rendimiento, velocidad y eficiencia de tokens que el proyecto afirma.
Después, la comunidad solicitó que el proyecto publicara la configuración completa de las evaluaciones, los resultados pregunta por pregunta, los registros de ejecución, el tiempo original empleado y los datos de consumo de tokens, entre otros. Por el momento, el proyecto solo ha compartido resultados consolidados y aún no ha proporcionado registros experimentales originales completos que permitan verificar con precisión los datos mencionados. Es importante destacar que, ante las críticas, el autor del proyecto respondió que los datos “sí son exagerados” y señaló que las mejoras reales se sitúan aproximadamente entre 1.6 veces y 3 veces. Hasta ahora, el autor no ha emitido una respuesta formal a las acusaciones de la comunidad, y algunas de las issues relacionadas con estas críticas se han eliminado.
🧧🧧🧧回复221获得$SOL 🧧🧧🧧
🎁🎁🎁👇👇👇🎁🎁🎁