تجريبي
توثيق تحويل الكلام العربي إلى نص
تصفّح التوثيق
تحويل الكلام إلى نص
POST /v1/audio/transcriptions
modelstringاستخدم arabic asr. هذا الحقل مطلوب في حزم OpenAI.
filemultipartملف صوتي أو فيديو. يجب أن يبقى طلب الرفع كاملًا ضمن 25 ميجابايت.
response_formatstringاختياري: json (الافتراضي والمفضل) أو text. تُقبل verbose_json أيضًا، لكنها لا تضيف توقيت الكلمات أو المقاطع.
languagestringرمز لغة BCP-47 اختياري. الافتراضي ar.
temperaturenumberدرجة عشوائية اختيارية. الافتراضي 0.
| الحقل | النوع | ملاحظات |
|---|---|---|
| model | string | استخدم arabic asr. هذا الحقل مطلوب في حزم OpenAI. |
| file | multipart | ملف صوتي أو فيديو. يجب أن يبقى طلب الرفع كاملًا ضمن 25 ميجابايت. |
| response_format | string | اختياري: json (الافتراضي والمفضل) أو text. تُقبل verbose_json أيضًا، لكنها لا تضيف توقيت الكلمات أو المقاطع. |
| language | string | رمز لغة BCP-47 اختياري. الافتراضي ar. |
| temperature | number | درجة عشوائية اختيارية. الافتراضي 0. |
جهّز تسجيلًا يحتوي على كلام عربي واضح، واستبدل meeting.wav في المثال بمسار ملفك. يُرفع الملف بصيغة multipart؛ لا ترسله داخل JSON ولا تضبط فاصل multipart يدويًا.
curl --fail --show-error https://api.sawtakarabi.ai/v1/audio/transcriptions \ -H "Authorization: Bearer sk_ar_live_..." \ -F model="arabic asr" \ -F [email protected] \ -F response_format=json
مثال على استجابة JSON
{
"text": "النص المكتوب",
"usage": { "type": "duration", "seconds": 42 }
}تُحتسب التكلفة بعد معالجة الصوت وفق المدة في usage.seconds. يجب أن يكفي الرصيد لمعالجة الملف قبل بدء الطلب.
تتضمن استجابة json التفريغ في الحقل text، وبيانات الاستخدام عندما تعيدها خدمة التفريغ. أما response_format=text فيعيد نصًا مباشرًا دون كائن usage. لا تتضمن الصيغتان أسماء المتحدثين أو توقيت الكلمات.
راجع الأسماء والأرقام والمصطلحات المتخصصة قبل نشر التفريغ أو الاعتماد عليه في عمل مهم. قد تؤثر جودة التسجيل وتداخل أصوات المتحدثين وتعدد اللغات في النتيجة.