Saltar al contenido principal
Actualizado el Aug 18, 2026

Preparar Texto Hablado

Usa esta acción cuando estés a punto de decir en voz alta un texto que se escribió para leerse y quieras que suene como algo que diría una persona. Devuelve solo texto — no produce audio.

Ideal para

  • Preparar la respuesta de un agente o de un LLM antes de decirla
  • Decir en voz alta una plantilla o un campo de texto enriquecido que lleve formato
  • Cualquier paso cuyo texto vaya hacia Sintetizar Voz

Esto no es lo mismo que quitar el formato. Una tabla no tiene forma hablada, así que quitar el marcado no da un texto decible — da una sopa de palabras, leyendo las celdas en fila o perdiendo la respuesta por completo. Esta acción le pide a un modelo pequeño y barato que diga lo mismo como lo diría una persona, mientras tu texto original queda intacto para el historial.

Usa otra cosa cuando

QuieresUsa
El audio en síSintetizar Voz — ejecuta esta acción antes y aquella después
Contenido nuevo, no la reescritura de un texto que ya tienesGenerar Respuesta LLM — usa tu propio prompt y modelo

Campos principales

CampoQué hace
MarkdownEl texto escrito a reescribir para voz, como máximo 8000 caracteres. Normalmente la respuesta de un paso anterior, como step(0).choices[0].message.content
PropósitoEtiqueta opcional para lo que hace este paso, visible en los registros

Qué pueden usar los pasos posteriores

ValorQué es
step(N).textLa forma hablada. Pásala directamente al campo Texto de Sintetizar Voz
step(N).modelEl modelo que produjo la reescritura

Límites

LímiteValor
Longitud de la entrada8000 caracteres
Solicitudes de voz60 por minuto, por empresa

La reescritura es deliberadamente corta, así que siempre cabe en el límite de 4096 caracteres de Sintetizar Voz — nunca hace falta recortarla por el camino.

El techo de 60 por minuto se comparte con el modo de voz de la aplicación y con Sintetizar Voz, así que un par preparar-y-decir cuesta dos de esas solicitudes por ejecución.

Coste

Este paso se descuenta del uso de tokens de IA de tu plan, no del de audio. Se ejecuta en un modelo pequeño y barato elegido por ti — no puedes escoger el modelo, porque la tarea es una reescritura mecánica y no razonamiento, y no debería costar precio de razonamiento.

Cuando falla

CódigoQué pasó
spoken_text_too_longLa entrada supera los 8000 caracteres. Acórtala o repártela en varios pasos

El modo de voz de la aplicación recurre discretamente al texto plano cuando esta reescritura falla, pero un flujo de trabajo no tiene esa salida: un fallo aquí hace fallar el paso. Si quieres la misma degradación suave, condiciona el paso de síntesis a step_ok(N) y pasa el texto original por la otra rama.