Skip to main content
📖 The AI Tool Bible

AI tools tagged Powered By Whisper

16 tools matching this tag.model

All tags →
AssemblyAI preview image
AssemblyAI logo

AssemblyAI

Audio · Universal / Slam-1
8.7

Speech-to-text API with diarisation, summarisation, and topic detection.

Freemium· Pre-recorded Speech-to-Text API: $0.21 /hr · Universal-2: $0.15 /hr · Realtime Speech-to-Text API: $0.45 /hr · Universal-Streaming: $0.15 /hr · Universal-Streaming Multilingual: $0.15 /hrtranscriptiondiarisation
Whisper preview image
Whisper logo

Whisper

Audio · Whisper large-v3
8.6

OpenAI's open-source speech-to-text — the de-facto baseline.

Free· Free open weights; $0.006/min via OpenAI APItranscriptionself-hosted
OpenAI Playground preview image
OpenAI Playground logo

OpenAI Playground

Writing · Multi-model (GPT-4o, GPT-4.1, o-series, DALL-E, Whisper, TTS)
8.2

OpenAI's official browser sandbox for prompting, tuning, and testing every model on the platform before you ship API code.

Paid· Basic: $10 · Pro: $20 · Enterprise: Contact salesprompt-engineeringmodel-comparison
LocalAI preview image
LocalAI logo

LocalAI

Writing · Multi-model (llama.cpp, diffusers, whisper, etc.)
8.1

Self-hosted OpenAI-compatible API for running LLMs, image, and audio models on your own hardware.

Free· Free and open source (MIT)local-llm-inferenceopenai-api-replacement
Reflect preview image
Reflect logo

Reflect

Writing · OpenAI GPT-4 + Whisper
8.0

Networked note-taking app with GPT-4 and Whisper baked into the writing surface.

Paid· Free: Free · Pro: $20 · Business: $35note-takingvoice transcription
Amazon Q preview image
Amazon Q logo

Amazon Q

Coding · Multi-model (Amazon Bedrock)
7.9

AWS's enterprise AI assistant for developers, analysts, and knowledge workers, wired into your company data.

Freemium· Amazon Q Business Lite: $3 · Amazon Q Business Pro: $20 · Amazon Q Developer Free Tier: Free · Amazon Q Developer Pro Tier: ? · Amazon Q in QuickSight Author: $24code-generationenterprise-search
Voicebox preview image
Voicebox logo

Voicebox

Audio · Multi-model (Chatterbox, Qwen TTS, Whisper, etc.)
7.4

Open-source desktop voice studio for local cloning, dictation, and giving MCP agents a voice.

Free· Free and open source; optional $VOICEBOX token donationsvoice-cloningtext-to-speech
Vibe preview image
Vibe logo

Vibe

Audio · OpenAI Whisper (via whisper.cpp)
7.2

Offline desktop transcription app powered by Whisper, with diarization, batch processing, and an HTTP API.

Free· Free and open-source (MIT)transcriptionsubtitles
Groq preview image
Groq logo

Groq

Coding · Multi-model (Llama, Mixtral, Gemma, Qwen, Whisper)
7.1

Custom-silicon LPU inference platform serving open models at GPU-trouncing latency via an OpenAI-compatible API.

Freemium· Free API key with rate limits; per-token paid tiers; enterprise contractslow-latency inferencevoice agents
Interviews Chat preview image
Interviews Chat logo

Interviews Chat

Agents · Multi-model (GPT, Claude, Gemini)
7.1

AI interview copilot that whispers answers in real time during live job interviews.

Freemium· Basic: $10 · Pro: $20 · Enterprise: $30interview-coachingmock-interviews
Amazon Q Developer preview image
Amazon Q Developer logo

Amazon Q Developer

Coding · Multi-model (Amazon proprietary + partners)
7.0

AWS's in-IDE coding assistant and agent, formerly CodeWhisperer, tuned for cloud-heavy workflows.

Freemium· Free Tier: Free · Pro Tier: $19/mo. per usercode-completionagentic-coding
WhisperAPI preview image
WhisperAPI logo

WhisperAPI

Audio · OpenAI Whisper
6.9

Hosted OpenAI Whisper transcription with a pay-as-you-go API and drop-in web dashboard.

Paid· 20 API Credits: $5 · 100 API Credits: $20 · 200 API Credits: $30 · Custom: $100.00audio-transcriptionvideo-subtitles
EKHOS AI preview image
EKHOS AI logo

EKHOS AI

Audio · Proprietary local models
6.8

Offline Windows transcription app with speaker diarization, GPU acceleration, and 98-language support.

Freemium· Premium: $9transcriptionspeaker-diarization
Fish Audio preview image
Fish Audio logo

Fish Audio

Audio · Fish Audio S2.1 Pro (in-house); S1 and S2 checkpoints open-sourced

Expressive, emotion-controllable text-to-speech and voice cloning with an open-model heritage

Freemium· Basic: $10 · Pro: $20 · Enterprise: Contact salesYouTube video voiceoverAudiobook narration
Horch preview image
Horch logo

Horch

Audio · Whisper (local) for transcription; optional Ollama / MLX local LLMs for summarization

Privacy-first, on-device meeting assistant for macOS

Paid· One-time purchase: €49 onceConfidential client meeting transcriptionAutomatic action-item extraction
so-vits-svc preview image
so-vits-svc logo

so-vits-svc

Audio · SoftVC content encoder + VITS backbone + NSF-HiFiGAN vocoder; optional ContentVec, HuBERT-Soft, Whisper-PPG, WavLM encoders and shallow-diffusion module.

SoftVC VITS Singing Voice Conversion — open-source pipeline for training and running singing-voice models.

Free· Free / open-source (AGPL-3.0). You provide your own compute (typically a CUDA-capable GPU) and training datasets.Singing voice conversion (AI covers)VTuber and virtual-character singing voices