The AlphaEdge Audio & Transcription API lets you transcribe audio files to text. This feature is optimized for high performance and accuracy.
This page guides you through using the Audio & Transcription API, from the basics to advanced use cases.
Real-time audio transcription and audio file analysis
chef amond 1989 est un système cbr qui réalise des recettes de cuisine.
The AlphaEdge Audio & Transcription API lets you transcribe audio files to text. This feature is optimized for high performance and accuracy.
This page guides you through using the Audio & Transcription API, from the basics to advanced use cases.
Here is a minimal example to get started with the Audio & Transcription API:
import requests
url = "https://api-endpoints.alphaedge-ai.com/models/alpha-audio-v1/transcript"
headers = {"X-API-Key": "TA_CLE"}
with open("/chemin/audio.wav", "rb") as f:
files = {"audio": ("audio.wav", f, "audio/wav")}
data = {
"enable_diarization": "true",
"enable_postcorrect": "true",
}
r = requests.post(url, headers=headers, files=files, data=data, timeout=300)
print(r.status_code)
print(r.json())
curl https://api-endpoints.alphaedge-ai.com/models/alpha-audio-v1/transcript \
-H "X-API-Key: TA_CLE" \
-F "audio=@/chemin/audio.wav" \
-F "enable_diarization=true" \
-F "enable_postcorrect=true"
import fs from "node:fs";
const form = new FormData();
form.append("audio", new Blob([fs.readFileSync("/chemin/audio.wav")]), "audio.wav");
form.append("enable_diarization", "true");
form.append("enable_postcorrect", "true");
const res = await fetch("https://api-endpoints.alphaedge-ai.com/models/alpha-audio-v1/transcript", {
method: "POST",
headers: { "X-API-Key": "TA_CLE" },
body: form
});
console.log(res.status, await res.json());
Here are the available parameters for the Audio & Transcription API:
| PARAMETER | TYPE | REQUIRED | DEFAULT | DESCRIPTION |
|---|---|---|---|---|
model_slug |
string (path) | Yes | - | Slug du modèle dans l’URL (uniquement alpha-audio-v1). |
audio |
File | Yes | - | Fichier audio multipart (nom de champ : audio, pas file). |
enable_diarization |
boolean | No | false | Enables speaker diarization. |
enable_postcorrect |
boolean | No | false | Post-correction linguistique (français ; failsafe si indisponible). |
The AlphaEdge Audio & Transcription API supports a wide variety of audio formats for transcription. Here is the full list of supported formats:
The API can also extract and transcribe audio from video files:
The Audio & Transcription API returns a response in JSON format. Here is an example response structure:
{
"model_slug": "alpha-audio-v1",
"text": "Le texte transcrit depuis l'audio...",
"inference_seconds": 1.2,
"enable_diarization": false,
"audio_duration_seconds": 45.3,
"audio_filename": "audio.wav"
}
Get a transcription with timestamps for each segment:
import requests
url = "https://api-endpoints.alphaedge-ai.com/models/alpha-audio-v1/transcript"
headers = {"X-API-Key": "TA_CLE"}
with open("/chemin/audio.wav", "rb") as f:
files = {"audio": ("audio.wav", f, "audio/wav")}
data = {
"enable_diarization": "true",
"enable_postcorrect": "true",
}
r = requests.post(url, headers=headers, files=files, data=data, timeout=300)
print(r.status_code)
print(r.json())
Here is how to handle errors properly:
import requests
url = "https://api-endpoints.alphaedge-ai.com/models/alpha-audio-v1/transcript"
headers = {"X-API-Key": "TA_CLE"}
with open("/chemin/audio.wav", "rb") as f:
files = {"audio": ("audio.wav", f, "audio/wav")}
data = {
"enable_diarization": "true",
"enable_postcorrect": "true",
}
r = requests.post(url, headers=headers, files=files, data=data, timeout=300)
print(r.status_code)
print(r.json())
import fs from "node:fs";
const form = new FormData();
form.append("audio", new Blob([fs.readFileSync("/chemin/audio.wav")]), "audio.wav");
form.append("enable_diarization", "true");
form.append("enable_postcorrect", "true");
const res = await fetch("https://api-endpoints.alphaedge-ai.com/models/alpha-audio-v1/transcript", {
method: "POST",
headers: { "X-API-Key": "TA_CLE" },
body: form
});
console.log(res.status, await res.json());
Here are some common use cases for the Audio & Transcription API:
Automatically transcribe meetings for archiving and search.
Generate automatic subtitles for your video content.
Create transcriptions to improve accessibility and SEO.
To view all available audio & transcription models with their detailed specifications, visit the Our models and filter by type.