Definition

Text-to-speech (TTS) converts written text into spoken audio using neural acoustic and vocoder models; modern systems add emotion, multilingual support, and natural-language voice controls.

Key Points

  • GitHub star counts and ARR claims are common traction signals but often company-reported
  • Enterprise TTS APIs compete on latency, cloning quality, and pricing
  • Roadmaps increasingly include audio understanding and speech-to-speech

Sources