Fish Audio Transcribe 1 is Fish Audio's language model. An ASR model that converts spoken audio into accurate text with timed segments, returning transcripts, duration, and timestamped segment data.
Specifications
Canonical IDfish-audio-transcribe-1
TypeLanguage
StatusActive
CreatorFish Audio
Providers
Input ModalitiesText
Output ModalitiesText
Release Date · 7 months ago

Capabilities

Input1/5
Text✓
Image·
Audio·
Video·
PDF·
Output1/5
Text✓
Image·
Audio·
Video·
Embedding·
Capabilities0/13
Reasoning·
Adaptive Reasoning·
Function Calling·
Parallel Function Calling·
Structured Outputs·
Native JSON Schema·
Web Search·
URL Context·
Computer Use·
Code Execution·
File Search·
Prompt Caching·
Assistant Prefill·

Pricing by Provider

US Dollar ($)
Per 1M tokens
ProviderStandard
Audio In
$ / sec
Vercel AI Gateway logo
Vercel AI Gateway
fish-audio/transcribe-1
$0.000100

Cost Calculator

US Dollar ($)
Preset:

Versions

VersionReleasedContextInput / 1MOutput / 1MStatus
Fish Audio Transcribe 1———Current
Fish Audio Transcribe 1 Free———Available
Transcribe————Available

Model IDs

fish-audio-transcribe-1
fish-audio/transcribe-1