Meta Superintelligence Labs lanza Muse Voice Transcribe: un modelo en tiempo real para transmisión de ASR, diarización y endpointing
La mayoría de las pilas de voz de producción son tres sistemas unidos. Un modelo transcribe, un segundo separa a los hablantes y un detector decide cuándo el usuario dejó…