Audio e musica com IA explodiram em 2026. ElevenLabs domina text-to-speech com vozes ultrarrealistas em portugues, Suno e Udio geram musicas completas a partir de texto, Descript revolucionou edicao de audio baseada em transcricao, e Whisper (OpenAI) oferece transcricao gratuita de alta qualidade. Para criadores de conteudo brasileiros, a qualidade do TTS em portugues melhorou dramaticamente.
SWEN.AI — Why trust us
Ferramenta de síntese de voz e personalização impulsionada por IA.
Crie narrações de voz com IA para várias aplicações com o Speechify Studio.
Melhore seu áudio com poderosas melhorias e ferramentas baseadas na web.
Transforme texto em fala realista em 142 idiomas com clonagem de voz.
Transforma áudio/vídeo em texto resumido, instantaneamente, em várias plataformas.
Transforme áudio/vídeo em texto editável e pesquisável; suporta mais de 40 idiomas.
Transforme texto em áudio falado realista e personalizável.
Crie vocais, corais e instrumentos prontos para estúdio a partir de MIDI.
Análise de voz impulsionada por IA para insights terapêuticos aprimorados.
Converte texto em áudio natural e de alta qualidade de forma eficiente.
Revolucione a criação musical com IA e ferramentas intuitivas.
Simplifique o licenciamento de música com faixas selecionadas para criadores.
Crie agentes de voz AI realistas com facilidade.
Uma ferramenta de IA para transformar áudio/vídeo em texto.
Revolucione a criação musical com composição dinâmica e colaboração impulsionadas por IA.
Liberte a criatividade musical com ferramentas de produção de código aberto impulsionadas por IA.
Ferramenta impulsionada por IA para transformar e melhorar áudio.
Geração de voz alimentada por IA e remoção de vocais para criação musical.
Noisee AI melhora a qualidade do áudio reduzindo o ruído de fundo.
Transforme aplicativos com IA de voz avançada em múltiplas línguas.
Transforme aplicativos com IA de voz avançada e multilíngue.
Transforme música em vídeos virais envolventes.
Crie narrações realistas a partir de texto sem esforço.
Adobe Mic Check é uma ferramenta de IA que ajuda a otimizar a qualidade do áudio, garantindo gravações nítidas e profissionais.
Adobe Podcast: ferramenta de IA da Adobe para criação e edição de áudio, unindo tecnologia avançada a uma interface amigável para podcasts.
Melhore a qualidade do áudio das suas gravações com o Adobe Speech Enhancer, uma ferramenta de IA que otimiza a clareza da fala.
Crie letras de músicas de forma fácil e rápida com o AI Lyrics Generator, uma ferramenta de IA que estimula sua criatividade musical.
AI Music Generator é uma ferramenta de IA que compõe músicas originais a partir de texto, com gêneros e instrumentos personalizáveis.
Crie efeitos sonoros personalizados de forma fácil e rápida com o AI Sound Effect Generator, ideal para projetos criativos e profissionais.
Crie efeitos sonoros únicos e envolventes com o AI Sound Effects Generator, uma ferramenta freemium fácil de usar.
Transforme suas ideias em episódios de podcast de forma simples e criativa com o AIdeaFlow Podcast, uma ferramenta acessível e intuitiva.
Create AI-hosted podcast interviews. Choose a topic, and Joe (the AI host) will research, host the interview, and generate your episode as audio or video.
AIPodNav é uma ferramenta de IA que transforma a navegação em áudio, facilitando o acesso a conteúdos de forma prática e intuitiva.
Aiva é uma ferramenta de inteligência artificial que cria trilhas sonoras personalizadas para projetos de áudio de forma intuitiva e acessível.
AIVA é uma IA compositora que cria trilhas sonoras originais para filmes, jogos e publicidade, com partituras exportáveis e estilos personalizáveis.
Amadeus Code é uma ferramenta de IA que cria músicas originais, oferecendo uma experiência musical inovadora e acessível.
Descubra o Amazing AI Radio, uma ferramenta inovadora que transforma sua experiência de áudio com inteligência artificial de forma simples e acessível.
An early look our AI Music experiment - YouTube Bl é uma ferramenta de IA na categoria audio.
AssemblyAI é uma API de speech-to-text com IA que transcreve áudio em tempo real, com análise de sentimento, sumarização e detecção de entidades.
Audify AI é uma ferramenta de IA que resume e transforma artigos longos em áudio curto, ideal para consumir conteúdo enquanto dirige ou se exercita.
Edit audios with text prompts
Audio Enhancer usa IA para melhorar a qualidade de gravações, identificando e corrigindo imperfeições para um som mais limpo e equilibrado.
Vocal and background audio separator
Vocal and background audio separator
AudioCraft é uma plataforma completa e open source para criar música e sons generativos de forma fácil e acessível.
AudioGPT é uma ferramenta de IA que processa áudio com modelos de linguagem para transcrição, geração e análise de som.
AudioLDM é uma ferramenta que gera áudio a partir de texto usando modelos de difusão latente, ideal para projetos criativos.
Audioldm Text To Audio Generation é uma ferramenta de IA na categoria audio.
AudioLDM2 Text2Audio Text2Music Generation (audiol é uma ferramenta de IA na categoria audio.
AudioSep é uma ferramenta de IA na categoria audio.
AudioX é uma ferramenta de IA na categoria audio.
audjust.ai é uma ferramenta de IA para edição de áudio com interface intuitiva, permitindo usuários de qualquer nível melhorar gravações com eficiência.
Bark with Voice Cloning é uma ferramenta de IA na categoria audio.
Bark with Voice Cloning (Bark-with-Voice-Cloning) é uma ferramenta de IA na categoria audio.
Beatoven.ai é uma ferramenta de geração musical por IA que cria trilhas sonoras emocionais personalizadas para diversos projetos.
BiRead transforma textos em áudio de forma prática, permitindo que você ouça conteúdos enquanto realiza outras atividades.
Com Boomy, você cria músicas rapidamente e ainda pode monetizá-las, tornando a produção musical acessível a todos.
Chain of Thought é uma ferramenta de IA na categoria audio.
Expressive Zeroshot TTS
Chatterbox TTS supporting 23 languages
ChatTTS Forge (ChatTTS-Forge) é uma ferramenta de IA na categoria audio.
Chattts Zero é uma ferramenta de IA na categoria audio.
Chattts Zero (ChatTTS) é uma ferramenta de IA na categoria audio.
Childbook é uma ferramenta de IA que transforma histórias em áudio, proporcionando uma experiência divertida e educativa para crianças.
O Cleanvoice AI é uma ferramenta que aprimora a qualidade do áudio, eliminando ruídos indesejados e melhorando a clareza das gravações.
Better AI powered platform to purify your speech signal
Cliptics é uma ferramenta de IA que transforma áudio em texto de forma prática e eficiente, oferecendo uma versão freemium para os usuários.
Generative AI for Voice.
Coqui é uma ferramenta open source de síntese de voz com IA que gera fala natural e expressiva em dezenas de idiomas, para criadores e desenvolvedores.
Coqui Bark Voice Cloning (instant-TTS-Bark-cloning é uma ferramenta de IA na categoria audio.
Coqui XTTS Voice Chat With Mistral or Zephyr (voic é uma ferramenta de IA na categoria audio.
CoquiTTS (Official) (CoquiTTS) é uma ferramenta de IA na categoria audio.
Createaivoiceovers usa IA para transformar texto em narrações de voz de alta qualidade, ideais para vídeos, podcasts e apresentações.
Generate daily news podcasts only on the topics you care about.
Neural Audio Synthesis for All
Deciphr AI transforma áudio em texto de forma rápida e precisa, facilitando a transcrição e análise de suas gravações.
Demucs Music Source Separation (v4) (music-separat é uma ferramenta de IA na categoria audio.
[Review](https://theresanai.com/descript-overdub) - Seamlessly integrates with Descript’s transcription and editing tools, ideal for content creators needing quick voiceovers.
Digest.fm transforma textos em áudio de forma prática, permitindo que você consuma conteúdo de maneira mais eficiente e acessível.
Distil Whisper Web (distil-whisper-web) é uma ferramenta de IA na categoria audio.
Turn any ebook into audiobook, 1107+ languages supported!
Ecrett Music usa IA para criar trilhas royalty-free em segundos, com música personalizável por cena, humor e gênero para vídeos, jogos e podcasts.
Edge TTS Text To Speech é uma ferramenta de IA na categoria audio.
EKHOS AI é uma ferramenta de transcrição de áudio e vídeo que oferece recursos avançados de correção em tempo real.
AI voice generator.
ElevenLabs TTS é uma ferramenta de IA na categoria audio.
Emergent Drums é uma ferramenta de IA que ajuda músicos e produtores a criar batidas e ritmos de forma rápida, intuitiva e acessível.
EzAudio é uma ferramenta de IA na categoria audio.
F5-TTS & E2-TTS: Zero-Shot Voice Cloning (Unofficial Demo)
Faster Whisper Webui (faster-whisper-webui) é uma ferramenta de IA na categoria audio.
faster-qwen3-tts (faster-qwen3-tts-demo) é uma ferramenta de IA na categoria audio.
Fish Audio S1 é uma ferramenta de IA na categoria audio.
FluentDictation usa IA para transcrever áudio em texto, ajudando profissionais e estudantes a converter gravações em documentos escritos.
Converta texto em áudio com IA: o Free AI Text to Speech by Leap AI gera narrações de alta qualidade com interface intuitiva, acessível a qualquer nível técnico.
Com o Free Voice Cloning, você pode criar clones de vozes de forma fácil e gratuita, ideal para projetos de áudio inovadores.
Free Youtube URL Video-to-Text Using OpenAI Whispe é uma ferramenta de IA na categoria audio.
GetSound é uma ferramenta de IA que transforma suas ideias em áudio de forma fácil e criativa, com opções gratuitas e pagas.
paid service for transcription
Harmonai é uma ferramenta de áudio de código aberto que torna a produção musical mais acessível e divertida para todos.
HarmonySnippetsAI é uma ferramenta freemium que transforma áudio em trechos úteis, facilitando a criação e edição de conteúdo sonoro.
HierSpeech++ (Zero-shot TTS) é uma ferramenta de IA na categoria audio.
HierSpeech++ (Zero-shot TTS) (HierSpeech_TTS) é uma ferramenta de IA na categoria audio.
Higgs Audio Demo
Transforme seu conteúdo em discussões em áudio envolventes geradas por IA com Illuminate.
Img To Music é uma ferramenta de IA na categoria audio.
IndexTTS 2 Demo é uma ferramenta de IA na categoria audio.
IndexTTS: An Industrial-Level Controllable and Eff é uma ferramenta de IA na categoria audio.
A demo of Indic Parler-TTS
multilingual speech-to-text
iSpeech é uma solução versátil para aplicações corporativas, oferecendo suporte a diversas línguas e vozes.
High-quality speech synthesis powered by Kokoro TTS
High-quality speech synthesis powered by Kokoro TTS
High-quality speech synthesis powered by Kokoro TTS
Upgraded to v1.0!
✨[With v1.0.0] Accelerated TTS on Kokoro-82M
Krisp elimina ruídos de fundo em chamadas de áudio, proporcionando uma comunicação clara e sem interrupções.
Kubernetes Podcast from Google é uma ferramenta de IA na categoria audio.
Pocket TTS optimized for Hugging Face Spaces on CPU
Lingostar é uma IA de áudio que cria e edita conteúdos sonoros de alta qualidade, com interface intuitiva para profissionais e amadores.
Zero Shot voice cloning with llasa 3b (Unofficial Demo)
Loudly é uma plataforma de IA que gera música original e livre de royalties para vídeos, podcasts, jogos e apps, com milhões de combinações de gêneros.
Lovo transforma texto em fala natural com IA, com vozes realistas e personalizáveis para vídeos, podcasts, audiolivros e apresentações.
Lovo.ai é a escolha ideal para profissionais criativos, facilitando a criação de áudios para anúncios e vídeos explicativos.
Lp Music Caps (LP-Music-Caps-demo) é uma ferramenta de IA na categoria audio.
Machine Learning – Software Engineering Daily é uma ferramenta de IA na categoria audio.
MaskGCT TTS Demo
MegaTTS 3 but with voice cloning!
Fast, efficient, & multilingual text-to-speech
Microsoft Azure Neural TTS é uma ferramenta escalável e personalizável, perfeita para integração em aplicações empresariais.
Midi Music Generator é uma ferramenta de IA na categoria audio.
Midi Music Generator (midi-composer) é uma ferramenta de IA na categoria audio.
MMAudio — generating synchronized audio from video é uma ferramenta de IA na categoria audio.
Moe TTS é uma ferramenta de IA na categoria audio.
Moe TTS (moe-tts) é uma ferramenta de IA na categoria audio.
Mubert é uma ferramenta que gera música em tempo real, adaptando-se a diferentes necessidades e ambientes.
Multilingual Anime TTS é uma ferramenta de IA na categoria audio.
Murf AI é uma plataforma intuitiva que oferece locuções de alta qualidade de forma rápida, ideal para aplicações comerciais e de marketing.
MuseGen é um estúdio de música virtual que ajuda criadores a compor letras e gerar canções de forma intuitiva e acessível.
Music Flamingo (music-flamingo) é uma ferramenta de IA na categoria audio.
MusicGen é uma ferramenta de IA na categoria audio.
MusicGen Streaming (musicgen-streaming) é uma ferramenta de IA na categoria audio.
In-browser text-to-music w/ Transformers.js!
MusicLM é o gerador de música do Google que cria faixas de áudio de alta fidelidade a partir de descrições textuais, com controle de gênero, humor e instrumentos.
nagish é uma ferramenta de inteligência artificial que transforma texto em áudio de forma simples e acessível, com opções gratuitas.
NaturalReader converte texto em áudio com vozes naturais e personalizáveis, ideal para estudantes, dislexia ou deficiência visual. Suporta português.
NaturalSpeech3 FACodec (naturalspeech3_facodec) é uma ferramenta de IA na categoria audio.
An open-source framework by NVIDIA for building speech AI systems, including automatic speech recognition and text-to-speech. #opensource
NeuTTS-Air (neutts-air) é uma ferramenta de IA na categoria audio.
NiceVoice cria vozes sintéticas de alta qualidade para narrações e diálogos. Ideal para criadores de conteúdo, jogos e podcasts, com plano gratuito.
Elimine ruídos indesejados de suas gravações com NOISE REMOVER, uma ferramenta de IA fácil de usar e com opção gratuita.
High-quality voice cloning TTS for 600+ languages
Open ASR Leaderboard é uma ferramenta de IA na categoria audio.
OpenAI TTS New é uma ferramenta de IA na categoria audio.
OpenAI TTS New (OpenAI_TTS_New) é uma ferramenta de IA na categoria audio.
OpenMusic é uma ferramenta de IA na categoria audio.
OpenVoice é uma ferramenta de IA na categoria audio.
OpenVoiceV2 é uma ferramenta de IA na categoria audio.
Try Orpheus TTS here
Palteca é uma ferramenta de IA que transforma suas ideias em áudio de forma simples e criativa, com uma opção freemium disponível.
Parakeet é uma ferramenta de reconhecimento de fala open source da NVIDIA, com suporte a múltiplos idiomas e transmissão em tempo real.
High-fidelity Text-To-Speech
PDF2Audio é uma ferramenta de IA na categoria audio.
Pipeline Conversation é uma ferramenta de IA na categoria audio.
Play.ht era uma ferramenta de IA para texto-para-fala com vozes realistas. Adquirida pela Meta em julho/2025 e descontinuada como produto independente.
PlayHT converte texto em fala realista com vozes emocionais em vários idiomas, incluindo português. Modelo freemium para criadores e empresas.
Descubra os melhores momentos dos seus podcasts favoritos com o Podcast Highlights, uma ferramenta de IA que transforma áudio em destaques.
Descubra o podcast.ai, um podcast totalmente gerado por inteligência artificial, com vozes realistas e conteúdo envolvente.
Podify.io usa IA para criar e editar podcasts com interface simples, ideal para iniciantes e profissionais. Teste grátis no modelo freemium.
Podnav transforma sua experiência com podcasts, oferecendo resumos e transcrições ao vivo de forma prática e eficiente.
Podzay é uma ferramenta de IA que transforma suas ideias em áudio de forma prática e acessível, com opções gratuitas disponíveis.
Poly AI cria assistentes virtuais de áudio que conversam em tempo real com PLN e aprendizado de máquina, ideal para atendimento e vendas.
Crie efeitos sonoros personalizados de forma fácil e rápida com o PopPop AI Sound Effect Generator, ideal para projetos criativos.
Practical AI: Machine Learning, Data Science é uma ferramenta de IA na categoria audio.
ProsekaTTS é uma ferramenta de IA na categoria audio.
Qwen3 TTS Demo é uma ferramenta de IA na categoria audio.
Qwen3 TTS Demo (Qwen3-TTS-Demo) é uma ferramenta de IA na categoria audio.
Qwen3-TTS Demo é uma ferramenta de IA na categoria audio.
Real Time Voice Cloning (Real-Time-Voice-Cloning) é uma ferramenta de IA na categoria audio.
Real-time Whisper WebGPU é uma ferramenta de IA na categoria audio.
Real-time Whisper WebGPU (realtime-whisper-webgpu) é uma ferramenta de IA na categoria audio.
Free Text-To-Speech generator with Emotion control (OpenAI)
Realtime implementation of Whisper large turbo
Realtime implementation of Whisper large turbo
Recast Studio é uma ferramenta de IA que transforma texto em áudio de forma simples e eficiente, com opções gratuitas e pagas.
Remove Silence From Audio
AI Music Generator and Music Learning Platform Online Free.
Rephrasely usa IA para transformar textos em áudio natural, reescrevendo scripts sem perder o tom original. Ideal para podcasters e criadores.
Resemble AI oferece síntese de voz em tempo real com opções de personalização, ideal para desenvolvedores e criativos.
Respeecher é uma ferramenta profissional que permite criar clones de voz realistas e emocionais, ideal para a indústria do entretenimento.
Riffusion é uma ferramenta de IA que gera música em tempo real a partir de texto, usando difusão estável aplicada a espectrogramas para criar sons e batidas originais.
Get Music from Generated Spectrogram with Diffusion
Riverside é uma plataforma de gravação profissional com IA para podcasts e vídeos: qualidade de estúdio, transcrição automática e edição baseada em texto.
Voice conversion framework based on VITS
Rythmex é uma IA para criar e editar áudio: produção musical, efeitos sonoros e podcasts, com interface intuitiva e plano freemium.
Seed Voice Conversion é uma ferramenta de IA na categoria audio.
SFX Engine é uma ferramenta de áudio que oferece efeitos sonoros de alta qualidade, com opções gratuitas e pagas para atender suas necessidades criativas.
Descubra o SimplePhones AI, uma ferramenta de áudio que transforma suas chamadas em experiências mais simples e eficientes.
Singing Voice Conversion (singing_voice_conversion é uma ferramenta de IA na categoria audio.
SmallTalk2 me é uma ferramenta de IA de áudio que permite conversas naturais em tempo real, ideal para empresas e desenvolvedores.
Descubra os principais insights dos seus podcasts favoritos de forma rápida e prática com o Snipd Podcast Summaries.
Song Prep (SongPrep) é uma ferramenta de IA na categoria audio.
SText to Audio(Sound SFX) Generator
SoundAI Studio é uma ferramenta de criação e edição de áudio que utiliza inteligência artificial para facilitar seu trabalho com som.
Soundful oferece músicas de alta qualidade e isentas de royalties, perfeitas para criadores de conteúdo.
Soundraw permite que os usuários criem composições musicais personalizadas de acordo com o humor e o estilo desejados.
A text-to-speech model powered by SparkAudio and Mobvoi.
SpeechGen io transforma texto em fala natural com vozes variadas, ideal para vídeos, podcasts e materiais educacionais.
SpeechT5 Speech Synthesis Demo (speecht5-tts-demo) é uma ferramenta de IA na categoria audio.
Splash Pro é uma ferramenta de IA para criar música original a partir de texto, com gêneros, batidas e melodias geradas em segundos para vídeos, jogos e podcasts.
Split Track to MusicGen (SplitTrack2MusicGen) é uma ferramenta de IA na categoria audio.
Stable Audio - Generative AI for music & sound fx é uma ferramenta de IA na categoria audio.
StemGen: A music generation model that listens é uma ferramenta de IA na categoria audio.
Efficient, fast, and natural text to speech with StyleTTS 2!
Sumly transforma textos em resumos de áudio, facilitando a absorção de informações de forma prática e acessível.
"make any song you can imagine"
Com o Suno AI, crie músicas incríveis apenas com sua imaginação, sem precisar de instrumentos.
Lightning-Fast, On-Device TTS
Lightning-Fast, On-Device, Multilingual TTS
SuperU AI é uma ferramenta de áudio que transforma suas ideias em conteúdo sonoro de forma prática e acessível.
Talking Face Generation with Multilingual TTS é uma ferramenta de IA na categoria audio.
Talking Face Generation with Multilingual TTS (ml- é uma ferramenta de IA na categoria audio.
ThinkSound é uma ferramenta de IA na categoria audio.
This Week in Machine Learning & AI é uma ferramenta de IA na categoria audio.
TopCalls é uma ferramenta de IA que transcreve e analisa chamadas telefônicas em tempo real, com interface intuitiva para atendimento, vendas e suporte.
A multi-voice text-to-speech system trained with an emphasis on quality. #opensource
ExpressivText-to-Speech
Turn TikToks into searchable transcripts and stats.
TranslateVideo traduz vídeos com IA, unindo texto e áudio numa experiência integrada. Ideal para criadores, educadores e empresas. Funciona em português.
Vote on the latest TTS models!
Blind vote on HF TTS models!
Text-to-speech (TTS) with Next-gen Kaldi
Text-to-speech (TTS) with Next-gen Kaldi
Open Source generative AI App for voice and music, supporting 15+ TTS models.
Generate Talking avatars from Text-to-Speech
vocal removal using AI
unlimited Audio generation with a few added features
VALL-E X é uma ferramenta de síntese de fala que permite criar áudio em diferentes idiomas de forma natural e fluida.
VERBATIK transforma suas gravações de áudio em texto de forma rápida e precisa, facilitando a transcrição e a análise de conteúdos.
Veritone Voice oferece clonagem de voz altamente personalizável, garantindo consistência de marca em mídia e entretenimento.
Vibe Transcribe transcreve áudio e vídeo offline com Whisper, sem enviar dados a servidores. App open-source gratuito para Windows, macOS e Linux.
VibeVoice é uma ferramenta de IA na categoria audio.
VibeVoice-Realtime-0.5B é uma ferramenta de IA na categoria audio.
Video Dubbing with Open Source Projects
Generates a sound effect that matches video shot
Transforme vídeos com dublagens em múltiplos idiomas de forma fácil e rápida usando o VideoDubber AI.
VoAgents transforma texto em áudio com IA, oferecendo vozes personalizáveis, entonação ajustável e modelo freemium — sem equipamento ou conhecimento técnico.
VocalReplica é uma ferramenta de IA que transforma texto em áudio realista, oferecendo uma experiência sonora inovadora e acessível.
Voice AI é uma ferramenta inovadora que transforma texto em áudio de forma natural e envolvente, com opções freemium.
Voice Clone é uma ferramenta de IA na categoria audio.
Languages ru,en,zh-cn,ja,de,fr,it,pt,pl,tr,ko,nl,cs,ar,es,hu
Voice Cloning é uma ferramenta de IA na categoria audio.
Voice Cloning (Voice-Cloning) é uma ferramenta de IA na categoria audio.
Voicemod é uma ferramenta de modulação de voz que transforma suas gravações e chamadas em experiências divertidas e criativas.
Voicv é uma ferramenta de IA que transforma texto em áudio de forma fácil e acessível, oferecendo uma experiência sonora envolvente.
VoiSpark é uma ferramenta de IA que transforma texto em áudio de forma simples e eficiente, com opções gratuitas e pagas.
Voxtral TTS Demo (voxtral-tts-demo) é uma ferramenta de IA na categoria audio.
Descubra o Voyp, a ferramenta de IA que transforma suas ideias em áudio de forma fácil e acessível.
WavJourney é uma ferramenta de IA na categoria audio.
Wellsaid é uma ferramenta de IA que transforma texto em áudio de alta qualidade, ideal para diversos projetos e apresentações.
Convert text to voice in real time.
Whisper é uma ferramenta de IA na categoria audio.
Whisper JAX é uma ferramenta de IA na categoria audio.
Whisper JAX Diarization (whisper-jax-diarization) é uma ferramenta de IA na categoria audio.
Whisper Large V2 (whisper-large-v2) é uma ferramenta de IA na categoria audio.
Whisper Large V3 é uma ferramenta de IA na categoria audio.
ML-powered speech recognition directly in your browser
Whisper Speaker Diarization é uma ferramenta de IA na categoria audio.
Whisper Speaker Diarization (Whisper_speaker_diari é uma ferramenta de IA na categoria audio.
Whisper Speaker Diarization (whisper-speaker-diari é uma ferramenta de IA na categoria audio.
Combine voice cloning and portrait lipsync animation
In-browser speech recognition w/ word-level timestamps
Whisper Turbo é uma ferramenta de IA na categoria audio.
Whisper Web é uma ferramenta de IA na categoria audio.
Whisper WebGPU (whisper-webgpu) é uma ferramenta de IA na categoria audio.
Whisper Webui é uma ferramenta de IA na categoria audio.
Whisper Webui (whisper-webui) é uma ferramenta de IA na categoria audio.
Whisper-Auto-Subtitled-Video-Generator é uma ferramenta de IA na categoria audio.
A Whisper CLI client compatible with the original OpenAI client, using CTranslate2 for faster inference. [#opensource](https://github.com/Softcatala/whisper-ctranslate2)
Port of OpenAI's Whisper model in C/C++. #opensource
WhisperSpeech é uma ferramenta de IA na categoria audio.
Wispr Flow transforma fala em texto em qualquer app, com edição automática por IA, mais de 100 idiomas e até 220 palavras por minuto.
XTTS é uma ferramenta de IA na categoria audio.
Youtube Whisperer é uma ferramenta de IA na categoria audio.
Youtube Whisperer (Youtube-Whisperer) é uma ferramenta de IA na categoria audio.
An app to generate podcast eposode ( script + Audio ) using AI.
No Brasil, audio IA e usado em podcasting (edicao automatizada, remocao de ruido), marketing (locucoes para videos e ads sem estudio), acessibilidade (leitura de conteudo para deficientes visuais), educacao (audiobooks e materiais de estudo), e atendimento (URA inteligente com voz natural). Podcasts como Cafe da Manha (Folha) e Flow ja experimentam com ferramentas de IA.
Avalie: (1) Caso de uso — TTS (ElevenLabs), musica (Suno), transcricao (Whisper), edicao (Descript). (2) Qualidade em PT-BR — ElevenLabs lidera, seguido por Azure TTS. (3) Clonagem de voz — ElevenLabs permite clonar sua voz. (4) Preco — Whisper e gratuito, ElevenLabs a partir de US$5/mes.
ElevenLabs oferece a melhor qualidade de TTS em PT-BR, com vozes naturais e clonagem de voz.
Sim. Suno e Udio geram musicas completas com letra e melodia a partir de prompts em texto.
Sim. Whisper (OpenAI) e gratuito e open source. Otter.ai tem plano free limitado.