مهندس الواجهة الخلفية - منصة الذكاء الاصطناعي الصوتي
Hams.ai
3–5 سنوات خبرة
تفاصيل الوظيفة
"بصفتك مهندس باك إند، ستقوم ببناء الأنظمة الأساسية التي تقف خلف وكلاء الصوت الذكي لدينا. ستصمم خطوط المعالجة اللحظية التي تعالج الكلام الحي، وتنسق المحادثات المدعومة بنماذج اللغة الكبيرة، وتدير جلسات الصوت المتزامنة على نطاق واسع، وتضمن أن كل مكالمة سريعة وموثوقة وذكية. وهذا يعني العمل العملي مع معالجة الصوت اللحظية، وخطوط تحويل الكلام إلى نص والنص إلى كلام، وتنسيق نماذج اللغة الكبيرة، والاتصالات الهاتفية (SIP/Asterisk)، والبنية التحتية الموزعة للباك إند. ستعمل يوميًا مع Python وFastAPI وPipecat وLiveKit (WebRTC) وCelery وPostgreSQL وRedis وKubernetes.
ما الذي ستفعله
بناء وتحسين خطوط معالجة الصوت الذكية اللحظية — التعرف على الكلام (STT)، ومعالجة نماذج اللغة الكبيرة، وتركيب الكلام (TTS) التي تعمل في حلقات زمنية أقل من ثانية
تصميم وصيانة خدمات الباك إند التي تدير جلسات الوكلاء الصوتيين، وتوجيه المكالمات، والتكامل مع الاتصالات الهاتفية (SIP/Asterisk)
تصميم أنظمة تنسيق متعددة الوكلاء — تدفقات المحادثة، وتسليم الوكلاء، وتمرير السياق بين وكلاء الصوت الذكي
بناء وتوسيع البنية التحتية للتعامل مع آلاف المكالمات الصوتية المتزامنة بزمن استجابة منخفض
تطوير وتحسين طبقات الاتصال اللحظي القائمة على WebSocket وWebRTC
تنفيذ وإدارة معالجة المهام الموزعة لحملات الاتصال الجماعية، وتحليلات المكالمات، والتحليل الذكي لما بعد المكالمة
تصميم وتحسين وصيانة قواعد بيانات PostgreSQL، وذاكرة التخزين المؤقت Redis، وقوائم الرسائل
تنفيذ المراقبة عبر خطوط معالجة الصوت: تتبع زمن الاستجابة، ومقاييس جودة المكالمات، والتتبع الموزع (OpenTelemetry, Sentry)
التعامل مع تصحيح الأخطاء في أنظمة الصوت اللحظية في بيئة الإنتاج — تشخيص مشكلات جودة الصوت، وارتفاعات زمن الاستجابة، وفشل الجلسات
العمل عن كثب مع فرق الذكاء الاصطناعي والمنتج وDevOps لتسليم ميزات الصوت الذكي من البداية إلى النهاية
من أنت
إتقان قوي للغة Python مع فهم عميق لـ async/await وأنماط التزامن اللحظي
خبرة في بناء أنظمة باك إند إنتاجية باستخدام FastAPI أو أطر عمل غير متزامنة مماثلة
فهم عميق لـ PostgreSQL وتصميم قواعد البيانات العلائقية وأنماط ORM
خبرة في الأنظمة اللحظية — WebSockets، والبث، وخطوط معالجة الصوت، أو الاتصالات منخفضة الزمن
خبرة عملية في معالجة المهام الموزعة (Celery, Redis)
الراحة في امتلاك الأنظمة الإنتاجية من البداية إلى النهاية، من التصميم إلى النشر إلى الاستجابة للحوادث
الازدهار في البيئات سريعة الخطى وعالية المسؤولية حيث يكون الصوت الذكي هو المنتج الأساسي
ميزات إضافية مرغوبة
خبرة في الصوت الذكي، أو الذكاء الاصطناعي للمحادثة، أو معالجة الكلام (STT, TTS, VAD)
خبرة في أنظمة الاتصالات الهاتفية (SIP, Asterisk, WebRTC)
الإلمام بتنسيق الذكاء الاصطناعي/نماذج اللغة الكبيرة (OpenAI, LangChain, LangGraph, Pipecat, Livekit)
خبرة في أطر الصوت اللحظية أو منصات الروبوتات الصوتية
خبرة في البنية التحتية السحابية (AWS, GCP, Kubernetes)
قواعد البيانات المتجهة وأنماط RAG للوكلاء الصوتيين المدعومين بالمعرفة"