Mensaje de IA de ME: Youdao de NetEase ha abierto el código de dos modelos en tiempo real, Confucius4-R2T2 (reconocimiento de voz en flujo) y Confucius4-T3PO (traducción en flujo). Ambos encabezan los rankings de tendencias de ASR y Traducción de Hugging Face. Los dos modelos logran reconocimiento y traducción “con incrementos estables”, es decir: mientras se habla, se reconoce; mientras se traduce, se interpreta. La latencia promedio de R2T2 es de aproximadamente 200—600 milisegundos. T3PO equilibra la baja latencia y la calidad; después de su lanzamiento de código abierto, obtuvo la ZeroGPU Demo, audio.cpp, cuantización GGUF y adaptación para llama.cpp/Ollama. Fuente: Youdao de NetEase (fuente: ME)
