GPT Realtime 2.1 en Retell: cuándo compensa el speech-to-speech y cuándo sigue ganando la cascada STT→LLM→TTS