عن جونزين
المنتجات

تواصل تقنية الذكاء الاصطناعي اختراقها العميق لمختلف الصناعات، ويشهد قطاع الاجتماعات تحولاً سريعاً من "التعاون التقليدي" إلى "التكامل الذكي". وباعتبارها مزودًا عالميًا للنظام البيئي لاجتماعات الذكاء الاصطناعي، طورت GONSIN حلولاً مبتكرة لعقد مؤتمرات الفيديو عن بُعد.
في مؤتمرات الفيديو التقليدية، غالبًا ما تظهر مشكلات شائعة مثل صعوبة تمييز المتحدثين في سجلات الاجتماعات، وحواجز اللغة في الاجتماعات متعددة الجنسيات، وتأثير الضوضاء المحيطة على جودة الاجتماع، وانخفاض كفاءة التنظيم اليدوي لمحاضر الاجتماعات.
استنادًا إلى منصة إدارة الاجتماعات الذكية Smart Link، ودمج ست تقنيات أساسية للذكاء الاصطناعي، ومن خلال الربط العميق بين الميكروفونات المصفوفية وكاميرات عالية الدقة، يتمكن الحل من تمييز المتحدثين المختلفين بوضوح، وإنشاء محاضر الاجتماعات في الوقت الفعلي، والترجمة الفورية بأكثر من 80 لغة، وتوفير تأثيرات صوتية نقية وواضحة، وتتبع دقيق للكاميرا، والتحكم الفعال في معدات الاجتماعات.
يدمج حل مؤتمرات الفيديو عن بُعد من GONSIN ست تقنيات أساسية للذكاء الاصطناعي بشكل عميق، مما يعزز فعالية الاجتماعات بشكل شامل بدءًا من معالجة الصوت وصولاً إلى التحكم التفاعلي.
التعرف على بصمة الصوت بالذكاء الاصطناعي: يحدد المتحدثين ويُستخدم للمصادقة وفصل الأصوات
من خلال تقنية التعرف على بصمة الصوت بالذكاء الاصطناعي، يمكن للنظام التعرف تلقائيًا على المتحدثين المختلفين أثناء الاجتماع، مما يحقق فصل الأدوار. وعند دمجها مع تقنية التعرف التلقائي على الكلام، يتم تعليق النص المحوَّل تلقائيًا، مما يحل مشكلة صعوبة تمييز المتحدثين في تسجيلات مؤتمرات الفيديو التقليدية، وهو مناسب للاجتماعات التعاونية متعددة الأقسام.
باستخدام تقنية التعرف التلقائي على الكلام (ASR)، يمكن تحويل الصوت في الاجتماع إلى نص في الوقت الفعلي بدقة تتجاوز 99٪. وتدعم التعرف المخصص على العديد من اللغات، وتقوم تلقائيًا بتقسيم النص المحوَّل وتعليق أسماء المتحدثين، وإنشاء محاضر اجتماعات منظمة دون حاجة إلى تنظيم يدوي بعد الاجتماع. ومع إمكانية التوزيع بنقرة واحدة بعد الاجتماع، يتحقق إغلاق دورة الاجتماع بسرعة.
متجاوزًا قيود الترجمة الثنائية التقليدية بين الصينية والإنجليزية، يدعم الحل الترجمة الفورية في الوقت الفعلي لأكثر من 80 لغة. واستنادًا إلى الدمج المبتكر لثلاث تقنيات رئيسية للذكاء الاصطناعي - التعرف على بصمة الصوت، وتحويل الصوت إلى نص، والترجمة الصوتية - يمكن للمشاركين في الاجتماعات متعددة الجنسيات رؤية الترجمة النصية المقابلة بلغتهم في الوقت الفعلي، والاستماع إلى الصوت المترجم باللغة التي يختارونها عبر سماعات الرأس، مما يزيل حواجز اللغة تمامًا ويتيح التعاون العالمي "بدون عوائق" عبر مؤتمرات الفيديو عن بُعد.
يستخدم مصفوفة مكبرات الصوت الذكية المانعة للضوء Model O خوارزمية تقليل الضوضاء بالتعلم العميق لتصفية أكثر من 300 نوع من ضوضاء البيئة المحيطة، مثل تكييف الهواء وأصوات الكتابة وتقليب الصفحات، مما يضمن وضوح الصوت ونقائه ونقل الكلام دون تشويش.
مزودة بتقنية تحديد موقع مصدر الصوت المكاني (Spatial DOA) في مصفوفة مكبرات الصوت الذكية المانعة للضوء Model O، تتيح تتبع الكاميرا تلقائيًا للمتحدث بدقة في كل من مؤتمرات الفيديو عن بُعد والاجتماعات المحلية. وهذا يضمن عرض صورة واضحة للمتحدث مع انتقالات سلسة في الوقت الفعلي، مما يمنح المشاركين عن بُعد تجربة تفاعلية.
يدعم الأوامر الصوتية باللغتين الصينية والإنجليزية، حيث يحتاج المشاركون فقط إلى نطق الأمر الصوتي المناسب، فيستجيب النظام بسرعة، مما يتيح عمليات مثل التحكم في الأجهزة واستدعاء وظائف الاجتماع، مما يقلل الوقت المستغرق في العمليات اليدوية ويجعل سير الاجتماع أكثر سلاسة.
جونسين هنا لتقديم الحلول المخصصة لنظام الصوت والفيديو للمؤتمرات.