Um serviço do Azure que transforma documentos em dados utilizáveis. Anteriormente conhecido como Reconhecimento de Formulários do Azure.
Olá
Bem vindo à Comunidade Microsoft Azure
Bom dia. Este comportamento tem sido reportado por muitos usuários. Atualmente não há documentação pública da Microsoft que descreva oficialmente uma alteração de comportamento desse tipo no Speech Studio ou um parâmetro para reverter ao processamento anterior. O serviço de conversão de texto em fala do Azure espera entrada em texto simples ou SSML (Speech Synthesis Markup Language). O formato SSML permite definir explicitamente parágrafos, quebras e pausas usando tags como <p> ou <break> para controlar onde e como o áudio é gerado.
Se o seu fluxo de trabalho depende de parágrafos separados, a abordagem recomendada é:
- Converter o texto em SSML antes de enviar ao Speech Studio ou às APIs e envolver cada parágrafo com elementos <p> ou <s> conforme o controle de estrutura desejado.
- Usar pausas explícitas (<break time="500ms" />) entre parágrafos, se quiser controlar o espaçamento no áudio.
- Testar com a API REST ou SDK usando SpeakSsmlAsync (ou equivalente) em vez de texto simples para garantir que a estrutura de parágrafos seja respeitada.
Documentação de referência recomendada:
Estrutura e eventos de documentos do SSML
Como sintetizar a fala a partir de texto
Espero ter ajudado. Boas Festas!