Kajo Voice هو قاعدة معرفة صوتية محلية: تُسقط فيه أي تسجيل صوتي أو مرئي، فيَنسخه ويترجمه ويلخّصه على جهازك — Mac أو Windows أو Linux — ثم يحفظه في مكتبة خاصة قابلة للبحث يمكنك سؤالها والحصول على إجابات مع اقتباسات تعود إلى اللحظة الدقيقة في التسجيل. لا يُرفع أي ملف صوتي أو نص إلى الإنترنت، لأنه لا يوجد مسار سحابي أصلاً.
النسخ المحلي الخاص
على عكس خدمات مثل Otter.ai وFireflies وNotta، لا يرسل Kajo Voice أي صوت إلى خوادم خارجية. يعمل محرّك نسخ واحد بالكامل على جهازك، ويدعم 98 لغة بما فيها العربية. هذا يعني:
- خصوصية بالبنية: تسجيلاتك ونصوصك تبقى على جهازك فقط
- عمل بدون إنترنت: بعد تنزيل النماذج لأول مرة، تعمل حلقة العمل كاملة دون اتصال
- لا رسوم بالدقيقة: حد مجاني تراكمي مدى الحياة (5 ملفات أو 150 دقيقة)، ثم دفعة واحدة
الحركة الوحيدة على الشبكة هي التحقق من الترخيص، وتقارير الأعطال ما لم توقفها؛ والتحليلات اختيارية لا تعمل إلا إذا فعّلتها. لا يحمل أيٌّ منها صوتاً أو نصاً.
دعم اللغة العربية بصراحة
يتعامل المحرّك مع الفصحى واللهجات، لكن الدقة تختلف باختلاف اللهجة وجودة التسجيل. على لوحة Open Universal Arabic ASR Leaderboard سجّل النموذج الذي يشغّله كاجو معدل خطأ كلمات يقارب 33٪ عبر مجموعات لهجية متعددة (arXiv:2412.13788، الجدول 1) — جيد للبحث والمسودة الأولى، وليس بديلاً عن المراجعة في النصوص الحساسة. راجع النص دائماً، خصوصاً في اللهجات، وصحّح الأسماء مرة واحدة بالتحرير المباشر داخل المقطع؛ التصحيح يُحدّث فهرس الدردشة دون إعادة النسخ.
يقرّر المحرّك لغة التسجيل مرة واحدة من بدايته، ثم يفكّ الترميز بمفردات تشمل كل لغاته. لذلك تظهر التحولات القصيرة بين العربية والإنجليزية أو الفرنسية غالباً كما قيلت، بينما قد تنجذب المقاطع الطويلة باللغة الثانية نحو اللغة المكتشفة — راجع تلك المواضع. إذا كانت لغة واحدة هي الغالبة، حدّدها في الإعدادات ← النسخ.
تمييز المتحدثين
يميّز كاجو المتحدثين تلقائياً في كل تسجيل على جهازك. يمكنك إعادة تسميتهم، وتعيين المقاطع التي أخطأ فيها الاكتشاف، واستعادة التسميات التلقائية إن لزم. لا توجد مكتبة متحدثين مشتركة بين التسجيلات — التسميات خاصة بكل تسجيل. تنتقل الأسماء إلى التصدير والملخصات والإجابات المستشهدة.
الملخص والترجمة والدردشة على الجهاز
- الملخص: يولّد كاجو ملخصاً على الجهاز عبر نموذج Gemma 4، وكل ملخص يحمل سطر «تلزم المراجعة».
- الترجمة: ترجمة النص على الجهاز إلى 59 لغة عبر النموذج نفسه — لا يُرسل أي نص إلى واجهة ترجمة سحابية. النص الأصلي يبقى مرجعاً.
- الدردشة باقتباسات: تبدأ المحادثة الجديدة في نطاق المجلد الذي تقف فيه؛ ثبّت تسجيلات أو مجلدات كمصادر، والبحث في المكتبة كاملة تأكيد صريح. كل إجابة تستشهد بالمتحدث والتوقيت، وإذا لم تجد الأدلة تقول ذلك بدلاً من اختلاق اقتباس.
المكتبة القابلة للبحث
كل نص يُحفظ في قاعدة بيانات محلية مشفّرة. يمكنك:
- البحث عبر جميع نصوصك بكلمة أو عبارة
- التصفية حسب اللغة أو الحالة، وتنظيم التسجيلات في مجلدات متداخلة
- تصدير كل ملف إلى SRT وVTT وTXT وCSV وJSON وMarkdown وDOCX وPDF وQDPX، مع نسخ ثنائية اللغة من SRT وVTT بعد الترجمة — مفيدة لصنّاع الأفلام الوثائقية والصحفيين
وعند حذف تسجيل من داخل التطبيق، يُحذف نسخة الصوت الخاصة بالتطبيق والنص وفهرس البحث والمحادثات التي لم تستخدم سوى ذلك التسجيل؛ أما الملف الأصلي على قرصك فلا يُمَس.
الخطط والأسعار
| الخطة | السعر | ما تشمله |
|---|---|---|
| مجانية | $0 | 5 ملفات أو 150 دقيقة نسخ (إجمالي مدى الحياة) — الحلقة الأساسية: نسخ، تمييز متحدثين، ترجمة، ملخص، مكتبة، دردشة باقتباسات |
| Lifetime | دفعة واحدة ($49 launch / $99 standard) | استيراد غير محدود، ورفع سقف فهرس الدردشة، ومجلدات المراقبة، والتصدير الجماعي — النسخة المُثبَّتة تبقى تعمل |
الشراء مرة واحدة ولا يوجد اشتراك. يتحقق التطبيق من الترخيص عندما يكون متصلاً؛ ودون اتصال تستمر مزايا Lifetime ثلاثين يوماً على الأقل بعد آخر تحقق ناجح، ثم يعود التطبيق إلى الحد المجاني حتى يتمكن من التحقق مجدداً — دون حذف أي شيء.
المتطلبات والتحميل
Kajo Voice متاح لنظم Mac وWindows وLinux، ويحتاج إلى 16 غيغابايت من الذاكرة. يُنزّل التطبيق نحو 2.2 غيغابايت من النماذج قبل أول نص (نحو 2.5 على macOS)، ونحو 9 غيغابايت في المجموع؛ ينزّل نموذج الدردشة في الخلفية بينما تقرأ نصك الأول. الخطة المجانية لا تتطلب بطاقة ولا حساباً.