> For the complete documentation index, see [llms.txt](https://library.zoom.com/llms.txt). Markdown versions of documentation pages are available by appending `.md` to page URLs; this page is available as [Markdown](https://library.zoom.com/technical-library/technical-library-ar/ai/ai-whitepaper/diagrams.md).

# المخططات وتدفقات البيانات

تمتد قدرات Zoom AI عبر مجموعة واسعة من المنتجات والخدمات وسير العمل، ما يعني أنه لا يمكن لمخطط واحد أن يوضح بصورة معقولة أو كاملة كيفية عمل الذكاء الاصطناعي عبر منصة Zoom بأكملها. تعتمد الميزات المختلفة على مدخلات ومسارات معالجة وسلوكيات تخزين وتفاعلات نماذج ومخرجات مختلفة. يعمل بعضها فقط على البيانات المباشرة والمؤقتة أثناء تفاعل نشط، بينما ينشئ بعضها الآخر عناصر محفوظة يمكنها لاحقًا دعم ميزات إضافية. تظل بعض الوظائف بالكامل ضمن بيئة Zoom الداخلية، بينما تعتمد وظائف أخرى على بنية الذكاء الاصطناعي الموحدة في Zoom، وفي بعض الحالات، على أنظمة خارجية متصلة. ولتسهيل فهم هذا النظام الديناميكي والواسع، تعرض هذه الصفحة سلسلة من المخططات بدلًا من الاعتماد على نموذج مرئي واحد. يسلط كل مخطط الضوء على طبقة أو مسار أو نمط ميزة مختلف ضمن منصة Zoom AI الأوسع. وفي أسفل هذه الأقسام توجد جداول توضح الميزات القابلة للتطبيق ومنتجها المرتبط بها وحالة الاحتفاظ بعناصرها. ثم تتناول الأقسام اللاحقة بعض ميزات المنتجات المخصصة بصورة فردية، مقدمةً تفسيرات أكثر تركيزًا لكيفية عمل تلك القدرات المحددة.

يبدأ التسلسل أدناه بنظرة عامة مبسطة على Zoom AI في أبسط صوره، موضحًا منصة في حالة تركز على الطرف الأول وتستخدم بنية النماذج الموحدة المعيارية في Zoom، لكنها لا تقدم بعد عمليات تكامل أعمال تابعة لجهات خارجية أو مصادر بيانات عملاء خارجية تتجاوز موفري نماذج الذكاء الاصطناعي التابعين لجهات خارجية لدى Zoom. ومن هناك، تقدم المخططات تدريجيًا أجزاء أكثر تخصصًا من منصة، بما فيها خيارات نهج الذكاء الاصطناعي لدى Zoom، وتحويل صوت المباشر إلى عناصر يمكن للذكاء الاصطناعي استخدامها، والطرق التي يمكن بها لتلك العناصر لاحقًا دعم ميزات وسير عمل أخرى. وتهدف هذه المخططات مجتمعة إلى جعل نظام شديد التعقيد أكثر سهولة في التناول عبر تقسيمه إلى عروض أصغر وأسهل للمتابعة، تعكس كيفية عمل الأجزاء المختلفة من منصة Zoom AI عمليًا.

## **Zoom AI**

<div data-with-frame="true"><figure><img src="/files/ac14c74a45f438275ca4288aeb1a502e6a2ae923" alt=""><figcaption><p>نظرة عامة بسيطة على Zoom AI</p></figcaption></figure></div>

يعرض المخطط أعلاه منصة الذكاء الاصطناعي لدى Zoom في صورة مبسطة، موضحًا منصة في إحدى حالاتها الأساسية للغاية. ويوضح كيف تتدفق الأجزاء المختلفة من بنية المنتجات والخدمات الأوسع لدى Zoom، والمعروفة باسم الواجهة الخلفية للويب في Zoom، بما في ذلك مجالات مثل الاجتماعات وPhone ومركز الاتصال والتعرف التلقائي على الكلام وعروض Zoom الأخرى، إلى منصة Zoom الأكبر، وتسهم في مجموعة المحتوى المتاح لمستخدم التي يمكن أن يدعم وظائف الذكاء الاصطناعي اللاحقة.

يتمثل مفهوم مركزي في هذا المخطط في **محتوى مستخدم Zoom**. يشير ذلك إلى المحتوى الذي يتم إنشاؤه من خلال تفاعلات مستخدم مع منتجات وخدمات Zoom، والذي قد يُستخدم لاحقًا كمدخلات أو سياق أو عناصر لتجارب مدعومة بالذكاء الاصطناعي. واستنادًا إلى المنتج وميزة المعنيين، يمكن أن يشمل ذلك مواد مثل رسائل Zoom دردشة، وملخصات للاجتماع، والنسخ، ومستندات Canvas، وMy Notes، والتسجيلات، وغيرها من العناصر المماثلة الموجهة إلى مستخدم. وتشكل هذه المواد جزءًا مهمًا من الطبقة السياقية التي يمكن أن تدعم لاحقًا الاسترجاع والاستدلال والتلخيص والمتابعة بمساعدة الذكاء الاصطناعي.

قد يتم أيضًا إعداد بعض هذا المحتوى لاستخدام الذكاء الاصطناعي في المستقبل من خلال بنية الاسترجاع، مثل الاسترجاع المفهرس أو وحدات التوليد المعزز بالاسترجاع. في تلك الحالات، يمكن استيعاب العناصر ذات الصلة وفهرستها لكي يمكن العثور عليها واستخدامها بكفاءة أكبر في استعلامات أو عمليات الذكاء الاصطناعي اللاحقة. ويساعد ذلك Zoom AI على العمل ليس فقط مع التفاعلات المباشرة، بل أيضًا مع السياق المحفوظ والمواد السابقة التي أنشأها مستخدم عبر منصة.

أخيرًا، يقدم المخطط أيضًا **Zoom AI** نفسه باعتباره طبقة الذكاء الاصطناعي المشتركة التي تعمل عبر هذا النظام البيئي الأوسع. في هذا العرض المبسط، يظهر Zoom AI من خلال النهج الموحد المعياري لدى Zoom، حيث يمكن لـZoom استخدام كل من النماذج المستضافة لدى Zoom والتي تعمل ضمن بنيتها التحتية الخاصة، وموفري نماذج الذكاء الاصطناعي المختارين من جهات خارجية عند ملاءمتهم للمهمة المطروحة. يتيح هذا النموذج الموحد لـZoom توجيه مهام الذكاء الاصطناعي عبر بيئة النموذج المتاحة الأنسب، مع الحفاظ على تجربة ذكاء اصطناعي موحدة عبر منصة.

## نهج نموذج خدمة Zoom AI

<div data-with-frame="true"><figure><img src="/files/0629ecca520ac1d8fa71d99d2725c0ccd60513fc" alt=""><figcaption><p>نظرة عامة على نهج الذكاء الاصطناعي لدى Zoom، بما في ذلك النهج الموحد وZM+ وZMO</p></figcaption></figure></div>

يوضح المخطط أعلاه نهوج الذكاء الاصطناعي الثلاثة لدى Zoom: النهج الموحد، ونماذج Zoom المستضافة الإضافية (ZM+)، ونماذج Zoom المستضافة فقط (ZMO). وتمثل هذه النهوج مجتمعةً الطرق الأساسية الثلاث التي تقدم بها Zoom خدمات الذكاء الاصطناعي للعملاء، حيث يوفر كل منها توازنًا مختلفًا بين اتساع نطاق الميزات ومرونة النماذج والتحكم في البيانات.

النهج الموحد هو النهج المعياري والأكثر اكتمالًا من حيث الميزات لدى Zoom. ويتيح لـZoom العمل مع موفري ذكاء اصطناعي متعددين، بما في ذلك النماذج المستضافة لدى Zoom وشركاء النماذج المختارون من جهات خارجية، بحيث يمكن توجيه المهام إلى النموذج الأنسب للطلب. ويوفر ZM+ نموذج نشر أكثر تحكمًا باستخدام مثيلات نماذج مخصصة تديرها Zoom، بينما يُبقي ZMO معالجة الذكاء الاصطناعي ضمن النماذج المستضافة لدى Zoom فقط، مقدمًا مسار النماذج الأكثر تقييدًا وتحكمًا، ولكن مع مجموعة ميزات أكثر محدودية.

لأغراض هذه الصفحة، توضح المخططات التالية عمومًا النهج الموحد، لأنه يعكس النهج المعياري لدى Zoom والرؤية الأوسع لوظائف Zoom AI. يمكن للمؤسسات التي تستخدم ZM+ أو ZMO غالبًا تفسير هذه المخططات نفسها عبر إزالة موفري نماذج الذكاء الاصطناعي التابعين لجهات خارجية ذهنيًا والتركيز على الأجزاء المتبقية التي تديرها Zoom في التدفق.

راجع صفحة نماذج Zoom AI والمعالجة والتخزين والاستخدام لمزيد من المعلومات.

## ميزات الوسائط المباشرة وعناصرها

<div data-with-frame="true"><figure><img src="/files/cd81d2a3e089f1077fe57d1b645f2c4af5f6be9d" alt=""><figcaption><p>نظرة عامة على كيفية تحويل الوسائط المباشرة إلى بيانات تحويل الكلام إلى نص التي تشغّل ميزات Zoom AI</p></figcaption></figure></div>

يوضح المخطط أعلاه كيف يمكن لتفاعلات الوسائط المباشرة، مثل الاجتماعات والمكالمات الهاتفية، أن تنتج ميزات وعناصر لاحقة مدعومة بالذكاء الاصطناعي عبر منصة Zoom. وفي كل حالة، يدخل صوت المباشر إلى Zoom من خلال نقطة الاتصال المرتبطة بذلك المنتج أو الخدمة. وبالنسبة للاجتماعات، يكون ذلك عمومًا **موجّه الوسائط المتعددة (MMR)**. بالنسبة إلى الاتصال الهاتفي، يدخل صوت عادةً عبر **مناطق SIP**.

بمجرد استيعاب صوت، يتم توجيهه إلى خدمة Zoom الخاصة بـ **التعرف التلقائي على الكلام (ASR)** ، التي تحول صوت المباشر إلى **بيانات تحويل الكلام إلى نص**. يمكن استخدام بيانات تحويل الكلام إلى نص هذه بطرق متعددة، استنادًا إلى الإعدادات والميزات المفعلة. وفي بعض الحالات، يتم تقديمها فورًا إلى المستخدمين على أنها **تسميات توضيحية مباشرة**. وفي السياقات المدعومة، قد يتم تمريرها أيضًا إلى خدمة Zoom المسماة **الترجمة المباشرة** ، التي تترجم مخرجات تحويل الكلام إلى نص إلى التسميات التوضيحية المترجمة للمشاركون الذين يتحدثون لغات أخرى.

يمكن لبيانات تحويل الكلام إلى نص أيضًا دعم ميزات أكثر استمرارية أو مشتقة. إذا كان **النسخ** مفعّلًا، أو إذا كان مستخدم يستخدم **ملاحظاتي**، فيمكن لخدمة ASR إنشاء النسخ بعد انتهاء جلسة المباشرة. ومع ذلك، إذا لم يكن الاحتفاظ بالنسخ مفعّلًا، فلن يتم الاحتفاظ ببيانات تحويل الكلام إلى نص المستخدمة أثناء التفاعل باعتبارها النسخ دائمًا. حتى في تلك الحالات، قد يظل Zoom AI يستخدم بيانات تحويل الكلام إلى نص بصورة مؤقتة أثناء جلسة لدعم ميزات الذكاء الاصطناعي المباشرة.

على سبيل المثال، قد يطرح مستخدم **الأسئلة أثناء الاجتماع** عبر Zoom AI خلال اجتماع. في تلك الحالة، يمكن لـZoom AI استخدام بيانات تحويل الكلام إلى نص المباشرة من اجتماع لفهم سؤال مستخدم وإنشاء إجابة ذات صلة تستند إلى المحادثة الجارية.

يتمثل تمييز رئيسي في هذا التدفق في أن Zoom AI لا يحتفظ بالضرورة بنسخ للمحادثة لمجرد استخدام بيانات تحويل الكلام إلى نص أثناء جلسة. ما لم يتم تفعيل الاحتفاظ بالنسخ تحديدًا، أو الاحتفاظ بالبيانات من خلال ميزة مثل **ملاحظاتي**، فقد تظل بيانات تحويل الكلام إلى نص نفسها مؤقتة. وفي الوقت نفسه، قد تستمر بعض العناصر اللاحقة التي يتم إنتاجها من تلك البيانات. على سبيل المثال، إذا طرح مستخدم أسئلة خلال اجتماع، فقد تظل محادثة الذكاء الاصطناعي الناتجة أو الملاحظات ذات الصلة متاحة لاحقًا باعتبارها عنصرًا محفوظًا، حتى عند عدم إنشاء النسخ دائم.

يمكن أن تصبح بعض العناصر المحفوظة أيضًا أساسًا لعناصر وسير عمل لاحقة إضافية. يمكن تحويل ملخص للاجتماع، أو ملخص ندوة عبر الإنترنت، أو ملخص مكالمة، أو ملاحظات مستخدم إلى **Zoom Canvas** ، حيث يمكن مواصلة تحريره وتوسيعه واستخدامه باعتباره عنصر عمل. وبدورها، قد تُستخدم هذه المستندات الناتجة لاحقًا كسياق لميزات أو سير عمل أخرى للذكاء الاصطناعي تمت مناقشتها في مواضع أخرى من هذا المستند. وبهذه الطريقة، يمكن أن يؤدي صوت المباشر ليس فقط إلى ميزات ذكاء اصطناعي فورية، بل أيضًا إلى سلسلة من العناصر المحفوظة التي تواصل دعم العمل اللاحق بمساعدة الذكاء الاصطناعي عبر منصة Zoom.

ينطبق هذا المخطط على الميزات التالية:

|             ميزة             |                                               الوصف                                              |          المنتج/المنتجات         | الاحتفاظ بالعناصر |
| :--------------------------: | :----------------------------------------------------------------------------------------------: | :------------------------------: | :---------------: |
|  التسميات التوضيحية المباشرة |               تسميات توضيحية لتحويل الكلام إلى نص في الوقت الفعلي للجلسات المباشرة.              | الاجتماعات، الندوات عبر الإنترنت |    غير محتفظ به   |
|  التسميات التوضيحية المترجمة |  التسميات التوضيحية المترجمة في الوقت الفعلي والمُولَّدة من بيانات تحويل الكلام إلى نص المباشرة. | الاجتماعات، الندوات عبر الإنترنت |    غير محتفظ به   |
|            النصوص            |                   سجلات نصية محتفظ بها لمحتوى تحويل الكلام إلى نص في الاجتماع.                   |        الاجتماعات، الهاتف        |      محتفظ به     |
|         ملخص للاجتماع        |     ملخص مُولَّد بالذكاء الاصطناعي للنقاط الرئيسية في مناقشة الاجتماع والقرارات وعناصر العمل.    |            الاجتماعات            |      محتفظ به     |
|   ملخص الندوة عبر الإنترنت   |     ملخص مُولَّد بالذكاء الاصطناعي للمحتوى الرئيسي للندوة عبر الإنترنت والمُشارَك بعد الجلسة.    |       الندوات عبر الإنترنت       |      محتفظ به     |
|         ملخص المكالمة        |          ملخص ما بعد المكالمة مُولَّد بالذكاء الاصطناعي للتفاصيل الرئيسية وعناصر العمل.          |            صفحة الهاتف           |      محتفظ به     |
|           ملاحظاتي           |            ملاحظات شخصية، والنسخ، وسياق الاجتماع محفوظة للرجوع إليها لاحقًا والمتابعة.           |            الاجتماعات            |      محتفظ به     |
|         مهام المتابعة        |             إجراءات المتابعة المقترحة بالذكاء الاصطناعي استنادًا إلى تفاصيل المحادثة.            |             مهام Zoom            |      محتفظ به     |
| إعطاء الأولوية للبريد الصوتي |   ترتيب رسائل البريد الصوتي بالاعتماد على الذكاء الاصطناعي وفقًا للأهمية التي يحددها المستخدم.   |            صفحة الهاتف           |      محتفظ به     |
|        أسئلة الاجتماع        |            إجابات الذكاء الاصطناعي على أسئلة الاجتماع باستخدام سياق الاجتماع المباشر.            |            الاجتماعات            |      محتفظ به     |
|   أسئلة الندوة عبر الإنترنت  | إجابات الذكاء الاصطناعي على أسئلة الندوة عبر الإنترنت باستخدام سياق الندوة عبر الإنترنت المباشر. |       الندوات عبر الإنترنت       |      محتفظ به     |
|        أسئلة المكالمة        |            إجابات الذكاء الاصطناعي على أسئلة المكالمة باستخدام سياق المكالمة المباشر.            |            صفحة الهاتف           |      محتفظ به     |

## ميزات التسجيل

<div data-with-frame="true"><figure><img src="/files/3d36cb47a35646c8061fd0bcec4cb5f31e3a27dc" alt=""><figcaption><p>نظرة عامة على كيفية معالجة Zoom للتسجيلات وميزات الذكاء الاصطناعي</p></figcaption></figure></div>

يوضح المخطط أعلاه كيف يدعم Zoom AI **ميزات الذكاء الاصطناعي المستندة إلى التسجيل** من خلال العمل على التسجيل المكتمل بعد انتهاء الجلسة المباشرة. وكما هو الحال مع تجارب Zoom الأخرى المستندة إلى الصوت، تدخل الوسائط الأصلية عبر البنية التحتية المرتبطة بالمنتج المستخدم — مثل **MMR** للاجتماعات أو **منطقة SIP** الاتصال الهاتفي ذات الصلة. وكجزء من ذلك المسار، يتم إنشاء التسجيل وإرساله إلى خدمة التسجيل الخاصة بـ Zoom، حيث يتم بعد ذلك تخزين التسجيل المكتمل في تخزين محتوى Zoom.

بعد أن يتم إتمام التسجيل، يُرسل الصوت المرتبط بذلك التسجيل إلى خدمة Zoom **التعرف التلقائي على الكلام (ASR)** للنسخ. وتنتج هذه العملية **نسخ خاص بالتسجيل**، والذي قد يختلف عن بيانات تحويل الكلام إلى نص المُولَّدة أثناء الجلسة المباشرة نفسها. وبعبارة أخرى، فإن النسخ المرتبط بالتسجيل المكتمل يتم توليده كجزء من مسار المعالجة بعد التسجيل، بدلًا من مجرد نسخه من طبقة التفاعل المباشر.

بعد إنتاج نسخ التسجيل، يمكن بعد ذلك إرساله إلى **Zoom AI** لإجراء تحليل إضافي. في هذه المرحلة، يعالج Zoom AI النسخ لتحديد عناصر تسجيل أعلى مستوى مثل الملخصات، وأبرز اللحظات، والفصول، وغيرها من التمثيلات المنظمة للمحادثة. ويُجرى هذا التحليل باستخدام طبقة معالجة الذكاء الاصطناعي في Zoom، بما في ذلك النماذج المستضافة لدى Zoom عند الاقتضاء، لتحويل نسخ التسجيل الخام إلى مخرجات أكثر قابلية للاستخدام بعد الاجتماع أو بعد المكالمة.

بمجرد اكتمال هذا التحليل، تُربَط النتائج المُولَّدة بالذكاء الاصطناعي بالتسجيل نفسه. وهذا ما يتيح للمستخدمين الذين يعرضون تسجيلًا أن يروا ليس فقط التسجيل والنسخ، بل أيضًا طبقات الذكاء الاصطناعي الإضافية التي تجعل المحتوى أسهل في التنقل والفهم. وبهذه الطريقة، يوضح المخطط كيف يمكن أن يصبح التسجيل المكتمل أساسًا لمرحلة ثانية من معالجة الذكاء الاصطناعي، مما ينتج ميزات تسجيل مُثرية تمتد إلى ما هو أبعد من الوسائط المخزنة الأصلية.

ينطبق هذا المخطط على الميزات التالية:

|                          ميزة                          |                                                      الوصف                                                      | المنتج/المنتجات | الاحتفاظ بالعناصر |
| :----------------------------------------------------: | :-------------------------------------------------------------------------------------------------------------: | :-------------: | :---------------: |
|                      التسجيل الذكي                     |                 أبرز اللحظات، والفصول، والملخصات المُولَّدة بالذكاء الاصطناعي للاجتماعات المسجلة                |    الاجتماعات   |      محتفظ به     |
|            إنشاء العناوين والأوصاف والعلامات           |                            عناوين وأوصاف وعلامات مُولَّدة بالذكاء الاصطناعي للمقاطع.                            |     المقاطع     |      محتفظ به     |
| إنشاء محتوى بالذكاء الاصطناعي للتسجيلات ومقاطع الفيديو | يستخدم نسخ تسجيل الفعالية لتوليد محتوى مكتوب ومقتطفات فيديو منقاة بالذكاء الاصطناعي من اللحظات الرئيسية للجلسة. |   فعاليات Zoom  |      محتفظ به     |

## ميزات الذكاء الاصطناعي المشتقة

<div data-with-frame="true"><figure><img src="/files/db7aa3e59e28f747c3d969da9c2f2d38062ab035" alt=""><figcaption><p>نظرة عامة على كيفية معالجة Zoom لميزات توليد محتوى الذكاء الاصطناعي المشتقة</p></figcaption></figure></div>

يوضح المخطط أعلاه كيف أن **ميزات الذكاء الاصطناعي المشتقة** تعمل من خلال استخدام محتوى المستخدم المتاح كسياق للمهام والمخرجات اللاحقة المدعومة بالذكاء الاصطناعي. في هذه الحالات، لم يعد Zoom AI يعمل فقط من بيانات التفاعل المباشر. وبدلًا من ذلك، فإنه يعتمد على عناصر موجودة بالفعل ضمن بيئة المحتوى الأوسع الخاصة بالمستخدم من أجل الإجابة عن سؤال، أو تلخيص المعلومات، أو المساعدة في إنتاج نتيجة جديدة.

واعتمادًا على المهمة، قد تتضمن هذه المادة السياقية عناصر مثل رسائل الدردشة، وملخصات الاجتماعات، وMy Notes، والنسخ، ومستندات Zoom Canvas، وعروض Zoom Slide، ومستندات Zoom Paper، أو محتوى Zoom البريد أو Zoom التقويم، أو بيانات البريد الإلكتروني أو التقويم المتصلة التابعة لجهة خارجية، أو الملفات التي رفعها المستخدم لدعم طلب معين. وبهذه الطريقة، يستخدم Zoom AI عناصر Zoom التي تم إنشاؤها مسبقًا، إلى جانب البيانات الشخصية المتكاملة عند توفرها، للمساعدة في تحقيق النتيجة التي طلبها المستخدم.

كما يعكس المخطط أيضًا أن هذه العملية يمكن أن تُنتج بدورها **محتوى مستخدم جديد**، فعلى سبيل المثال، قد يستخدم Zoom AI المواد الموجودة لإنشاء Zoom Sheet جديد، أو مستند Zoom Canvas، أو عرض Zoom Slide، أو مستند Zoom Paper. وبمجرد إنشائها، تصبح هذه العناصر الجديدة جزءًا من مستودع المحتوى الأوسع الخاص بالمستخدم، وقد تُستخدم لاحقًا مرة أخرى كسياق لوظائف وسير عمل مستقبلية مدعومة بالذكاء الاصطناعي. وهذا يخلق تقدمًا متعدد الطبقات بحيث يمكن للمحتوى السابق للمستخدم أن يدعم المخرجات اللاحقة، ويمكن لتلك المخرجات بدورها أن تصبح عناصر سياقية جديدة بمرور الوقت.

يمكن أن يظهر النمط نفسه في أسطح Zoom أخرى أيضًا. في بيئات مثل **Zoom موزع** أو **لوحة دردشة الذكاء الاصطناعي**، قد يطرح المستخدمون أسئلة عبر المنصة أو يتفاعلون مع المستندات والمواد المتاحة من خلال مجموعة إنتاجية الذكاء الاصطناعي من Zoom. وفي هذه الحالات، يعمل Zoom AI مرة أخرى انطلاقًا من العناصر الموجودة التي يمكن للمستخدم الوصول إليها لتوفير الاسترجاع، والتوليف، والإجابة على الأسئلة، أو المتابعة، مما يوضح كيف تمتد ميزات الذكاء الاصطناعي المشتقة بقيمة المحتوى السابق إلى مهام ونتائج جديدة.

{% hint style="info" %}
**ملاحظة**

عمليات تحميل ملفات المستخدم المحلية [يمكن تعطيلها](https://support.zoom.com/hc/en/article?id=zm_kb\&sysparm_article=KB0077150).
{% endhint %}

ينطبق هذا المخطط على الميزات التالية:

|             ميزة            |                                                                                   الوصف                                                                                  |          المنتج/المنتجات         | الاحتفاظ بالعناصر |
| :-------------------------: | :----------------------------------------------------------------------------------------------------------------------------------------------------------------------: | :------------------------------: | :---------------: |
|        إنشاء المحتوى        | يستخدم إنشاء المحتوى الذكاء الاصطناعي لإنشاء المستندات والعروض التقديمية وجداول البيانات والمخرجات الأخرى، وتحسينها، وتلخيصها، وتنظيمها من خلال مطالبات باللغة الطبيعية. | Canvas، وSheets، وPaper، وSlides |      محتفظ به     |
| لوحة دردشة الذكاء الاصطناعي |                                           مساعدة ذكاء اصطناعي حوارية لطرح الأسئلة، وإنشاء المحتوى، والعمل عبر سياق Zoom المتاح.                                          |    لوحة دردشة الذكاء الاصطناعي   |      محتفظ به     |
|         طرح الأسئلة         |                                            إجابات مولدة بالذكاء الاصطناعي استنادًا إلى المستندات والمواد المحددة في Zoom موزع.                                           |               موزع               |      محتفظ به     |

## ميزات التوليد والتأليف

<div data-with-frame="true"><figure><img src="/files/55abb284604f6ddbbd0a90fea3c99d59736a78a0" alt=""><figcaption><p>نظرة عامة على كيفية معالجة Zoom لطلبات الذكاء الاصطناعي الخاصة بالتوليد والتأليف</p></figcaption></figure></div>

يوضح المخطط أعلاه كيف أن **ميزات التوليد والتأليف** تعمل داخل منصة Zoom AI. وعلى عكس ميزات الذكاء الاصطناعي المشتقة، التي تعتمد على محتوى المستخدم الموجود مسبقًا للمساعدة في إنجاز مهمة أو مخرج لاحق، فإن ميزات التوليد والتأليف غالبًا ما تكون مدفوعة بشكل مباشر أكثر بإدخال المستخدم الفوري. في كثير من الحالات، لا تعتمد هذه الميزات على العناصر المحتفظ بها في Zoom والمخزنة بالفعل في مكان آخر ضمن بيئة محتوى المستخدم. وبدلاً من ذلك، تعتمد أساسًا على مطالبات المستخدم المباشرة، أو استعلاماته، أو الملفات المرفوعة، أو المحتوى الفوري على الشاشة المرتبط بتجربة المنتج النشطة.

يكتسب هذا التمييز أهمية خاصة للميزات التي تعمل انطلاقًا من المحتوى المرئي في سياق المستخدم الحالي بدلًا من العناصر المفهرسة أو المحتفظ بها سابقًا. على سبيل المثال، عندما يلخص المستخدم سلسلة دردشة، أو يلخص بريدًا إلكترونيًا، أو يطلب من Zoom AI صياغة رد على بريد إلكتروني، فإن المحتوى ذي الصلة يُؤخذ عادةً من سياق العميل النشط ويُحزَّم ضمن حمولة طلب لمعالجته بواسطة Zoom AI. وبعبارة أخرى، لا يسترجع Zoom هذا المحتوى بالضرورة من مستودع منفصل على الخادم من أجل تنفيذ المهمة. وبدلًا من ذلك، تُحوَّل المعلومات ذات الصلة من السلسلة النشطة أو مجموعة الرسائل أو سياق الواجهة المرئي الآخر إلى صيغة نصية وتُرسَل إلى Zoom AI من تطبيق Zoom Workplace حتى تتمكن الخدمة من إجراء معالجة اللغة الطبيعية، أو التلخيص، أو التوليد.

يشمل المخطط أيضًا حالات استخدام توليدية تعتمد أساسًا على تعليمات المستخدم المباشرة بدلًا من المادة المصدرية النصية. على سبيل المثال، عندما يطلب المستخدم توليد صورة، يصف المستخدم المخرج المطلوب من خلال مطالبة، ويولد النموذج الصورة بناءً على ذلك الوصف. في بعض سياقات المنتج، مثل Zoom السبورة البيضاء، قد يعتمد توليد الصورة هذا على مزودي نماذج ذكاء اصطناعي من جهة خارجية. وفي سياقات أخرى، قد يستخدم Zoom نماذجه المستضافة الخاصة. على سبيل المثال، يمكن أن يعتمد توليد صورة الخلفية الافتراضية من Zoom على نموذج مستضاف لدى Zoom يستخدم التضمينات والمعالجة المرتبطة بها لتوليد المخرجات المرئية، مع مرور المحتوى الناتج عبر عناصر تحكم الإشراف قبل إعادته إلى المستخدم.

وبالنظر إلى هذه العناصر مجتمعة، يوضح المخطط أن ميزات التوليد والتأليف تعتمد غالبًا بدرجة أقل على العناصر المحتفظ بها وبدرجة أكبر على نية المستخدم الفورية، أو سياق العميل النشط، أو المواد الداعمة المرفوعة. وبهذه الطريقة، تمثل هذه الميزات نمطًا رئيسيًا آخر من أنماط عمل Zoom AI: ليس فقط استرجاع المحتوى السابق والاستدلال عبره، بل أيضًا توليد مخرجات جديدة مباشرةً من طلب المستخدم الحالي والسياق المحيط به.

ينطبق هذا المخطط على الميزات التالية:

|               ميزة               |                                                                                       الوصف                                                                                      |             المنتج/المنتجات             |      الاحتفاظ بالعناصر     |
| :------------------------------: | :------------------------------------------------------------------------------------------------------------------------------------------------------------------------------: | :-------------------------------------: | :------------------------: |
|        الخلفية الافتراضية        |                                       يستخدم الذكاء الاصطناعي لإنشاء صور خلفية افتراضية مخصصة من مطالبات المستخدم لاستخدامها في جلسات Zoom.                                      | اجتماعات، وفعاليات، وندوات عبر الإنترنت |  محتفظ بها (إذا تم حفظها)  |
|            إنشاء الصور           |                        يستخدم الذكاء الاصطناعي لتحويل رسومات السبورة البيضاء أو العناصر البصرية الأولية إلى مخرجات بصرية أكثر صقلًا أو تجسيدًا أو أسلوبية.                       |             السبورة البيضاء             |  محتفظ بها (إذا تم حفظها)  |
|            إنشاء الصور           |                        يستخدم الذكاء الاصطناعي لإنشاء صور تحمل علامة تجارية وأصول بصرية أخرى للفعاليات، مثل الرؤوس وصور الجلسات والمواد المتعلقة بالمعرض.                        |                الفعاليات                |  محتفظ بها (إذا تم حفظها)  |
|           إنشاء المحتوى          | يستخدم الذكاء الاصطناعي لتوليد محتوى السبورة البيضاء على الشاشة مثل النصوص، والملاحظات اللاصقة، والجداول، والخرائط الذهنية، والعناصر البصرية المنظمة الأخرى من مطالبات المستخدم. |             السبورة البيضاء             |  محتفظ بها (إذا تم حفظها)  |
|           إنشاء المحتوى          |                           يستخدم الذكاء الاصطناعي لتوليد محتوى مكتوب للفعاليات مثل الأوصاف، وتفاصيل الجلسة، والسير الذاتية للمتحدثين، وإعلانات الردهة.                           |                الفعاليات                |  محتفظ بها (إذا تم حفظها)  |
|        إنشاء بريد إلكتروني       |                                  يستخدم الذكاء الاصطناعي لصياغة محتوى البريد الإلكتروني وتنقيحه، بما في ذلك متن الرسالة، وسطر الموضوع، والردود.                                  |             البريد إلكتروني             | محتفظ بها (إذا تم إرسالها) |
|            إنشاء دردشة           |                                    يستخدم الذكاء الاصطناعي لصياغة رسائل الدردشة ومراجعتها استنادًا إلى مطالبات المستخدم وسياق المحادثة المتاح.                                   |                 الدردشة                 | محتفظ بها (إذا تم إرسالها) |
|      ملخص البريد الإلكتروني      |                                               يستخدم الذكاء الاصطناعي لتلخيص المحتوى الرئيسي لبريد إلكتروني أو سلسلة بريد إلكتروني.                                              |             البريد إلكتروني             |        غير محتفظ به        |
| ملخص الرسالة، والسلسلة، والمستند |                                 يستخدم الذكاء الاصطناعي لتلخيص رسائل الدردشة وسلاسل المحادثة والمستندات المرفقة المدعومة أو محتوى Canvas المرتبط.                                |                 الدردشة                 |        غير محتفظ به        |
|           التحميل الذكي          |                                          يستخرج تفاصيل الفعالية من الملفات المرفوعة لبناء الجلسات والمتحدثين والأسئلة المخصصة تلقائيًا.                                          |               فعاليات Zoom              |  محتفظ بها (إذا تم حفظها)  |

## ملاحظاتي

### ملاحظاتي في اجتماعات Zoom

<div data-with-frame="true"><figure><img src="/files/7991c55c92905473370c838af413bbbd2708b526" alt=""><figcaption><p>نظرة عامة على تدفقات بيانات ملاحظاتي في اجتماعات Zoom</p></figcaption></figure></div>

يوضح المخطط أعلاه كيف تستخدم ملاحظاتي داخل اجتماعات Zoom مسار الصوت الموجود للاجتماع بدلًا من الاعتماد على صوت آخر موجود على جهاز المستخدم. عندما تكون ملاحظاتي مفعلة أثناء اجتماع Zoom، فإنها تصل إلى صوت الاجتماع المشترك الموجَّه عبر جلسة Multi-Media Router (MMR) الخاصة بالاجتماع. ثم تتم معالجة ذلك الصوت بواسطة خدمة التعرف التلقائي على الكلام (ASR) الخاصة بـ Zoom لإنتاج نسخ، والذي يُسلَّم إلى جهاز المستخدم ويمكنه لاحقًا دعم إنشاء الملاحظات بعد الاجتماع.

في هذا التدفق، يعتمد النسخ تحديدًا على صوت اجتماع Zoom المرتبط بتلك الجلسة. ولا يعتمد على صوت محلي غير ذي صلة من الجهاز خارج الاجتماع نفسه. بعد انتهاء الاجتماع، يمكن أن يظل النسخ والملاحظات الناتجان متاحين وفقًا لإعدادات الاحتفاظ المعمول بها لدى المستخدم، بينما لا يُحتفَظ بالصوت الأساسي المستخدم للنسخ بعد اكتمال المعالجة.

### ملاحظاتي خارج اجتماعات Zoom

<div data-with-frame="true"><figure><img src="/files/128aa2845198ded23bd94fcf55dcbe0456666396" alt=""><figcaption><p>نظرة عامة على تدفقات بيانات ملاحظاتي خارج اجتماعات Zoom</p></figcaption></figure></div>

يوضح المخطط أعلاه كيف تعمل ملاحظاتي خارج اجتماعات Zoom من خلال صوت جهاز المستخدم المحلي بدلًا من خلال جلسة اجتماع Zoom مشتركة. إذا تم تمكينها أثناء اجتماع تابع لجهة خارجية أو مناقشة حضورية، فيمكن لملاحظاتي استخدام الوصول على مستوى نظام التشغيل إلى ميكروفون المستخدم و، حيثما ينطبق، صوت النظام لالتقاط الصوت المحلي المتاح على ذلك الجهاز. ثم يُوجَّه هذا الصوت عبر جلسة MMR لمستخدم واحد ويُعالَج بواسطة خدمة التعرف التلقائي على الكلام (ASR) الخاصة بـ Zoom لإنتاج نسخ، والذي يُسلَّم إلى جهاز المستخدم ويمكنه لاحقًا دعم إنشاء الملاحظات بعد الاجتماع.

هذا يعني أنه، خارج اجتماعات Zoom، يعتمد النسخ حصريًا على الصوت المنقول من جهاز المستخدم المحلي بدلًا من الاعتماد على تدفق صوت اجتماع Zoom مشترك. وقد تطلب ملاحظاتي أيضًا من المستخدم بدء ملاحظة جديدة عند اكتشاف نشاط في ميكروفون الجهاز، مما يساعد على إبراز الميزة في حالات مثل اجتماعات الجهات الخارجية، أو التسجيلات المستندة إلى المتصفح، أو غيرها من تدفقات العمل النشطة للميكروفون. وكما هو الحال في تدفق داخل الاجتماع، لا يُحتفَظ بالصوت المستخدم للنسخ بعد اكتمال النسخ، بينما يمكن أن تظل الملاحظات والنسخ الناتجة محفوظة في الحساب الخاص بالمستخدم وفقًا لإعدادات الاحتفاظ المعمول بها.

## ZoomMate

<div data-with-frame="true"><figure><img src="/files/2fd8c9be0f9e4417c25c8c1099bfa193d616d252" alt=""><figcaption><p>نظرة عامة على تدفقات بيانات ZoomMate</p></figcaption></figure></div>

يوضح المخطط أعلاه كيف أن **يعمل ZoomMate كمساحة عمل رئيسية داخل Zoom Workplace**، ويعمل عند نقطة التقاء سياق المستخدم، والمعرفة المتصلة، وقدرات التنفيذ. وبدلاً من أن يكون مجرد مساعد مستقل، يتموضع ZoomMate في مركز بيئة عمل أوسع يمكن للمستخدمين فيها البحث، والاستدلال، والإنشاء، والتصرف عبر المواد والأنظمة التي تدعم عملهم اليومي.

جزء كبير من هذا الدور يأتي من وصول ZoomMate إلى **محتوى Zoom الأصلي**‌. ويمكن أن يشمل ذلك عناصر مثل الملخصات، وملاحظاتي، والتسجيلات، ومستندات Canvas، ورسائل الدردشة، وغيرها من المواد التي ينشئها المستخدم عبر منصة Zoom. تساعد هذه العناصر ZoomMate على توفير السياق الذي يحتاجه للإجابة عن الأسئلة، وتوليف المعلومات، وتوليد المخرجات، ودعم المتابعة. ويمكن لـ ZoomMate أيضًا استخدام **الذاكرة**، مما يسمح له بدمج تفضيلات المستخدم ذات الصلة أو التفاصيل المتعلقة بالعمل عند المساعدة في إكمال مهمة.

يوضح المخطط أيضًا كيف يتجاوز ZoomMate المحتوى الأصلي في Zoom من خلال التكامل مع **مصادر المعرفة التابعة لجهات خارجية**. فعلى سبيل المثال، يمكن لخدمات سحابة التخزين المتصلة مثل Google Drive أو OneDrive أن تعمل كمستودعات خارجية للمعلومات المتاحة للمستخدم. وعند دمج هذه المصادر، يمكن لـ Zoom فهرسة المحتوى المعتمد لدعم الاسترجاع عبر تلك المواد، مما يسمح لـ ZoomMate باستخدام **البحث الوكيلي** للعمل عبر كلٍّ من محتوى Zoom والمعرفة التابعة لجهات خارجية المتصلة. وبهذه الطريقة، يمكن لـ ZoomMate البحث ليس فقط عبر ما يوجد داخل Zoom، بل أيضًا عبر المستندات والمواد التي يُسمح للمستخدم بالوصول إليها في المنصات الخارجية المتصلة.

كما يمكن لمصادر البيانات الشخصية الأخرى، مثل **البريد إلكتروني والتقويم** (باستثناء رسائل البريد إلكتروني المشفرة من طرف إلى طرف)، أن تدعم ZoomMate أيضًا، لكنها تعمل بشكل مختلف. فبدلاً من فهرستها، تتواصل هذه المصادر عمومًا مع ZoomMate من خلال استرجاع مباشر قائم على واجهة برمجة التطبيقات. وهذا يجعلها مفيدة لمهام مثل تحديد سياق البريد إلكتروني ذي الصلة، ومراجعة معلومات التقويم، أو المساعدة في جدولة الأحداث، دون اعتبارها جزءًا من طبقة الاسترجاع المفهرسة المستخدمة للبحث الأوسع في المستندات.

ويُظهر المخطط أيضًا أن ZoomMate يمكنه الاتصال بمجموعة أوسع من **خدمات وموصلات الجهات الخارجية** التي تدعم تنفيذ الإجراءات وكذلك الوصول إلى المعرفة. وقد تشمل هذه الأنظمة مثل Jira وHubSpot وServiceNow وWorkday وغيرها من منصات الأعمال المتصلة. ومن خلال هذه الاتصالات، يمكن لـ ZoomMate تنفيذ **مهام وكيلية** نيابةً عن المستخدم، مثل إنشاء السجلات أو تحديثها، أو استرجاع المعلومات من الخدمات الخارجية، أو تنفيذ إجراءات متصلة أخرى داخل تلك الأنظمة. وهذا يجعل ZoomMate أكثر من مجرد واجهة للاسترجاع والتركيب؛ فهو يعمل أيضًا كطبقة تنفيذ يمكن أن تساعد في تحويل السياق إلى فعل.

وتساعد هذه القاعدة نفسها أيضًا في تشغيل **الوكلاء** و **سير العمل** داخل بيئة ZoomMate. يمكن للوكلاء استخدام السياق الأساسي نفسه، ومسارات الاسترجاع، والأنظمة المتصلة لتنفيذ دعم أكثر ديناميكية قائم على الاستدلال، مما يساعد المستخدمين على إنجاز مهام أوسع متعددة الخطوات مع مزيد من الاستمرارية والقدرة على التكيف. وعلى النقيض من ذلك، يمكن أن توفر سير العمل أتمتة أكثر تنظيمًا وقابلية للتكرار، مما يتيح للمستخدمين تعريف عمليات متكررة تعمل عبر محتوى Zoom، وحيثما كان ذلك مدعومًا، الأنظمة الخارجية المتصلة. وبهذه الطريقة، لا يعمل ZoomMate كواجهة محادثة فحسب، بل أيضًا كنقطة تنسيق لكل من النشاط الوكيلي الديناميكي والأتمتة الأكثر تنظيمًا.

**بيئة اختبار معزولة** يمكن أيضًا دعم بعض قدرات التنفيذ الأكثر تقدمًا لدى ZoomMate. بالنسبة للمهام التي تتطلب تنفيذ كود، أو إنشاء ملفات، أو أتمتة، أو معالجة أكثر تعقيدًا، يمكن لـ ZoomMate استخدام بيئة حاضنة (sandbox) منفصلة بدلًا من الاعتماد فقط على المعالجة الحوارية المعياري. تعمل هذه الحاضنة على البنية التحتية لـ خدمات AWS لدى Zoom وتوفر طبقة تنفيذ معزولة ومحدودة المدة للمهام ذات التعقيد الأعلى، مما يساعد ZoomMate على تنفيذ بعض العمليات في بيئة أكثر تحكمًا. وبهذه الطريقة، يمكن لنفس الأساس الأوسع لدى ZoomMate الذي يدعم الاسترجاع والاستدلال والـ agents والـ workflows أن يدعم أيضًا تنفيذ المهام الأكثر تقدمًا عندما تتطلب الأعمال المطلوبة ذلك.

أخيرًا، لا يوضّح المخطط كل مكوّن أساسي تحتي يساعد على تشغيل ZoomMate. كما أنه لا يَعرض صراحةً طبقات القدرات الأساسية مثل المهارات، أو الهياكل الداعمة الأخرى التي تُعد جزءًا من البنية التحتية والتصميم الأوسع لـ Zoom AI. ويُفترض أن تعمل تلك العناصر ضمن نظام الذكاء الاصطناعي الأساسي الذي يتيح سلوك ZoomMate. وبدلًا من ذلك، يهدف هذا المخطط إلى عرض السياق والمعرفة الأساسية وسُطوح الإجراءات التي يعمل من خلالها ZoomMate كسطح عمل موحّد عبر Zoom والأنظمة المتصلة.

### اتصالات وفهرسة الجهات الخارجية في ZoomMate

<figure><img src="/files/33b21c0faa0d393892f5e4ce179620f578e3142f" alt="" width="375"><figcaption><p>نظرة عامة على كيفية اتصال ZoomMate بالاتصالات ومصادر البيانات التابعة لجهات خارجية</p></figcaption></figure>

يوضح المخطط أعلاه جزأين مرتبطين لكنهما متميزان من بنية بيانات الجهات الخارجية في ZoomMate. الأول هو كيفية اتصال ZoomMate بالتطبيقات والخدمات التابعة لجهات خارجية المدعومة حتى يتمكن من استرجاع المعلومات أو تنفيذ إجراء داخل تلك الأنظمة. أما الثاني فهو كيفية استيعاب بعض مصادر المحتوى التابعة لجهات خارجية والمدعومة وفهرستها بحيث يمكن لـ ZoomMate لاحقًا استرجاع ذلك المحتوى بكفاءة أكبر من خلال التوليد المعزز بالاسترجاع.

#### <mark style="color:الأزرق;">يمكن لـ ZoomMate الاتصال مباشرةً بتطبيقات وخدمات الجهات الخارجية</mark>

يوضح أحد أجزاء المخطط كيف يتصل ZoomMate بتطبيقات الطرف الثالث المدعومة مثل Jira وConfluence وSalesforce وServiceNow وWorkday ومنصات تخزين سحابة، وغيرها من أنظمة الأعمال الخارجية. تسمح هذه الاتصالات لـ ZoomMate بالعمل بما يتجاوز المحتوى الأصلي في Zoom من خلال التفاعل مع الأدوات التي تخزن بيانات الأعمال أو تدعم العمل التشغيلي خارج منصة Zoom.

تُنشأ هذه الاتصالات عبر اتصال TLS من خلال نماذج وصول مُصرَّح بها، مثل التكاملات القائمة على واجهة برمجة التطبيقات أو الاتصالات القائمة على MCP. وفي كلتا الحالتين، يعمل ZoomMate ضمن الأذونات الممنوحة للخدمة المتصلة. يتيح ذلك لـ ZoomMate استرجاع المعلومات ذات الصلة من تلك الأنظمة، وحيثما يكون مدعومًا، اتخاذ إجراء داخلها بالنيابة عن مستخدم. على سبيل المثال، قد يسترجع ZoomMate تفاصيل من تذكرة Jira، أو يبحث في صفحة Confluence، أو يحدّث تسجيلًا في ServiceNow، أو يستخدم نظامًا متصلًا آخر كجزء من تنفيذ مهمة أوسع.

يُعد نموذج الاتصال المباشر هذا مهمًا بشكل خاص للمهام التي تعتمد على الحالة الحالية للنظام أو الوصول المباشر إلى أدوات الطرف الثالث. في تلك الحالات، يمكن لـ ZoomMate استخدام التطبيق المتصل كنقطة نهاية خدمة نشط بدلًا من أن يكون مجرد مستودع للمحتوى المفهرس سابقًا.

#### <mark style="color:الأزرق;">يمكن لـ ZoomMate فهرسة محتوى الجهات الخارجية المعتمد لاسترجاعه لاحقًا</mark>

يوضح جزء ثانٍ من المخطط كيف يمكن لـ ZoomMate استيعاب المحتوى وفهرسته من مصادر خارجية مدعومة، بحيث يمكن استرجاع المواد لاحقًا كجزء من بحث أو استجابة بمساعدة الذكاء الاصطناعي. ويكون نموذج الاسترجاع المفهرس هذا أكثر صلة بمستودعات المحتوى المتصلة مثل أنظمة تخزين سحابة، وقواعد المعرفة، ومنصات المستندات، وغيرها من المصادر المدعومة حيث قد يحتاج ZoomMate إلى البحث عبر كمية أكبر من المحتوى الخارجي المحتفَظ به.

بمجرد ربط مصدر مدعوم والموافقة عليه للفهرسة، يمكن لـ ZoomMate استرجاع المحتوى من ذلك المصدر وتجهيزه للبحث لاحقًا. ويمكن أن تتضمن عملية التجهيز هذه تقسيم الملفات أو التسجيلات الأكبر إلى وحدات أصغر وإرفاق بيانات وصفية مثل المصدر، ووقت التحديث، والملكية، ومعلومات الإذن. ثم يُكتب ذلك المحتوى في طبقة الفهرسة الخاصة بـ Zoom حتى يمكن البحث فيه لاحقًا عبر كلٍ من المطابقة الدقيقة والاسترجاع القائم على المعنى.

عندما يقدّم مستخدم طلبًا يعتمد على محتوى خارجي مفهرس، يمكن لـ ZoomMate البحث في ذلك المحتوى المفهرس، وتقييم النتائج الأكثر صلة، وتطبيق معلومات الإذن المرتبطة بالمصدر الأصلي بحيث لا يكون إلا المحتوى المصرّح به مؤهلًا للظهور. ويمكن بعد ذلك تمرير المحتوى المصرّح به الأكثر صلة إلى طبقة الذكاء الاصطناعي في ZoomMate كسياق داعم للاستجابة. وبهذه الطريقة، يوضح المخطط كيف يمكن للمحتوى الخارجي المفهرس أن يساعد ZoomMate على إنتاج إجابات تستند إلى مواد أعمال متصلة فعلية بدلًا من الاعتماد فقط على معرفة النموذج العامة.

## الأفاتارات المخصصة

### إنشاء الأفاتار

<div data-with-frame="true"><figure><img src="/files/4b826ffecb61d743d35b63a4cd32034bd62ef6f8" alt=""><figcaption><p>نظرة عامة على عملية إنشاء الأفاتار المخصص</p></figcaption></figure></div>

يوضح المخطط أعلاه كيف يتم إنشاء أفاتار مخصص من فيديو وصوت مُسجَّلين للمستخدم. تبدأ العملية عندما يُعرض على المستخدم نص ويُطلب منه تسجيل نفسه وهو يقرأه. وتتيح خطوة التسجيل الموجَّه هذه لـ Zoom التقاط المادة السمعية والبصرية اللازمة لتوليد كلٍ من مظهر الأفاتار الخاص بالمستخدم ونموذج الصوت المرتبط به المستخدم لاحقًا في المخرجات المستندة إلى الأفاتار.

بعد أن يُكمل المستخدم التسجيل، تتم معالجة مكوّنات الصوت والفيديو عبر مسارات مختلفة. ويُرسل الصوت إلى خدمة طرف ثالث تُنشئ محاكاة للصوت استنادًا إلى كلام المستخدم المُسجَّل. وبمجرد اكتمال تلك المعالجة، تُعيد خدمة الطرف الثالث معرِّف صوت فريدًا إلى Zoom. ويخزن Zoom هذا المعرف كمرجع صوتي للمستخدم حتى يمكن استخدامه لاحقًا عند إنشاء مقاطع قائمة على الأفاتار أو مخرجات مدعومة أخرى تعتمد على ذلك الصوت المُركَّب.

في الوقت نفسه، يُرسل مكوّن الفيديو إلى وحدة إنشاء الأفاتار المستضافة لدى Zoom، حيث يعالج Zoom المادة المرئية المُسجَّلة لإنشاء تمثيل الأفاتار الخاص بالمستخدم. وينتج عن ذلك قالب أفاتار يخزنه Zoom للاستخدام المستقبلي. وبالنظر إلى هذين المخرجين المحتفَظ بهما معًا — معرِّف الصوت المخزَّن وقالب الأفاتار المخزَّن — فإن ذلك يؤدي إلى السماح لـ Zoom بإنشاء مقاطع مستقبلية أو وسائط قائمة على الأفاتار تعكس كلًا من ملامح المستخدم وصوته المُركَّب.

### إنشاء المقطع

<div data-with-frame="true"><figure><img src="/files/60c5e338fe1b834a161f557b30747efef0713786" alt=""><figcaption><p>نظرة عامة على عملية إنشاء مقطع الصورة الرمزية المخصصة</p></figcaption></figure></div>

يوضح المخطط أعلاه كيف يتم إنشاء مقطع صورة رمزية مخصصة من الصورة الرمزية المخزنة لدى المستخدم وملف الصوت المُركَّب الخاص به. تبدأ العملية عندما يرفع المستخدم النص الذي يريد من الصورة الرمزية أن تعرضه. ويعمل ذلك النص كمحتوى مصدر للمقطع المُنشأ.\
\
ومن هناك، ينسق الجزء الخلفي على الويب في Zoom مدخلين متوازيين مطلوبين لإنشاء الناتج النهائي. أولاً، يرسل معرِّف الصوت المخزن لدى المستخدم مع النص إلى خدمة توليد الصوت التابعة لجهة خارجية، والتي تنتج الصوت الخاص بالمقطع باستخدام الصوت المُركَّب للمستخدم. ثانيًا، يرسل قالب الصورة الرمزية المخزن لدى المستخدم إلى وحدة توليد الصور الرمزية في Zoom حتى يمكن إعداد المكوّن المرئي للمقطع باستخدام شبه الصورة الرمزية الذي أنشأه المستخدم مسبقًا.\
\
وبمجرد أن تنتج خدمة توليد الصوت التابعة لجهة خارجية الصوت، تتم إعادة ذلك الصوت إلى Zoom وتمريره إلى وحدة توليد الصور الرمزية. ثم تجمع وحدة توليد الصور الرمزية بين قالب الصورة الرمزية المخزن والصوت المُولَّد، مع مزامنة حركات الوجه والفم للصورة الرمزية مع المحتوى المنطوق. وبعد اكتمال عملية مزامنة حركة الشفاه والعرض، ينتج Zoom مقطع الصورة الرمزية النهائي ويسلمه مرة أخرى إلى المستخدم.

## القاموس المخصص

<div data-with-frame="true"><figure><img src="/files/94e9d4c40175e687a949e2548aa0b0f5f1361bae" alt=""><figcaption><p>تدفقات بيانات القاموس المخصص</p></figcaption></figure></div>

يوضح المخطط أعلاه كيف تساعد ميزة القاموس المخصص في تحسين دقة مخرجات Zoom المعتمدة على الكلام من خلال تزويد خدمة التعرف التلقائي على الكلام (ASR) في Zoom بسياق إضافي للمفردات. صُممت هذه الميزة لدعم الكلمات والاختصارات والمصطلحات العامية وأسماء المنتجات أو المصطلحات المتخصصة التي قد تكون خاصة بمؤسسة أو صناعة أو فريق أو منطقة معينة، والتي قد لا يتم التعرف عليها أو عرضها بشكل صحيح أثناء النسخ.

تبدأ العملية عندما يقوم مسؤول الحساب بإنشاء قاموس مخصص وتخزينه في بوابة Zoom على الويب. يحتوي ذلك القاموس على قائمة بالكلمات أو العبارات المعتمدة التي ترغب المؤسسة في أن يتعرف عليها Zoom بدقة أكبر. وبمجرد حفظ القاموس على مستوى الحساب، يصبح متاحًا للاستخدام في سياقات الاجتماعات ومعالجة الكلام المدعومة.

عندما يبدأ المستخدم اجتماعًا لاحقًا، يمكن لخدمة AASR في Zoom أن تتلقى القاموس المخصص الخاص بالحساب كجزء من سياق المعالجة لديها. وبينما تقوم خدمة ASR بتحويل الصوت المباشر إلى بيانات تحويل الكلام إلى نص، يمكنها مقارنة الكلام المسموع المُدرك بالقاموس المخصص ومحاولة مطابقة الأصوات المتعرَّف عليها مع المصطلحات المخزنة. وهذا يمنح ASR إرشادًا إضافيًا بشأن الكلمات التي يجب البحث عنها، وكيف قد تُكتب بعض المصطلحات، وكيف ينبغي تفسير الاختصارات أو اللغة المتخصصة.

والنتيجة هي أن مخرجات التحويل الأولية من الكلام إلى نص يمكن أن تعكس بشكل أدق المصطلحات المستخدمة فعليًا في الاجتماع. ويمكن بعد ذلك أن تنتقل هذه الدقة المحسنة إلى العناصر اللاحقة المشتقة من المحادثة. فعلى سبيل المثال، إذا تم لاحقًا إنشاء ملخص للاجتماع أو التسميات التوضيحية أو النسخ أو أي أصل آخر قائم على بيانات تحويل الكلام إلى نص، فيمكن أن تعكس هذه المخرجات تمثيلًا أكثر دقة للكلمات التي تمت مشاركتها أثناء الاجتماع، مما يساعد على تحسين جودة وفائدة العنصر الذي تم إنشاؤه بواسطة الذكاء الاصطناعي.

## قوالب ملخص للاجتماع المخصصة

<div data-with-frame="true"><figure><img src="/files/f587f54e50a27aaf8f7f0a0e0dbae39401ce4d03" alt=""><figcaption><p>تدفقات بيانات قوالب ملخص للاجتماع المخصصة</p></figcaption></figure></div>

يوضح الرسم البياني أعلاه كيف يتم إنشاء ملخصات للاجتماع مخصصة من قالب محدد من قِبل مستخدم أو حساب. تبدأ العملية عند إنشاء قالب وحفظه في Zoom. على مستوى الحساب، يمكن لمسؤول تحديد قالب ملخص للاجتماع مخصص للاستخدام التنظيمي. وعلى المستوى الفردي، يمكن لمستخدم إنشاء قالب شخصي لملخص للاجتماع بناءً على تفضيلاته الخاصة. وبمجرد إنشائه، يتم تخزين القالب المحدد بحيث يمكن تطبيقه أثناء إنشاء الملخص لاحقًا.

عند انتهاء اجتماع، يمكن لـ Zoom AI استخدام بيانات تحويل الصوت إلى نص الخاصة بالاجتماع لإنشاء ملخص يتبع البنية والتركيز الخاصين بالقالب المخصص المختار. إذا كان القالب المخصص قد تم اختياره قبل إنشاء ملخص للاجتماع، فإن Zoom AI يطبق ذلك القالب مباشرة عند إنتاج الملخص. يتيح ذلك أن يعكس الناتج النهائي التنسيق المحدد أو الأقسام أو الأولويات المحددة في القالب بدلاً من مجرد بنية ملخص افتراضي.

إذا لم يتم اختيار قالب مخصص قبل إنشاء الملخص لأول مرة، فلن يتمكن Zoom من تطبيق ذلك القالب لاحقًا إلا إذا كان النسخ للاجتماع قد تم الاحتفاظ به. في هذه الحالة، يمكن لـ Zoom AI إعادة معالجة النسخ المحتفظ به باستخدام إعدادات القالب وإنتاج ملخص جديد يتوافق مع تلك البنية. أما إذا لم يتم الاحتفاظ بالنسخ، فلن يكون لدى Zoom النسخ الأساسي المتاح لإعادة المعالجة، مما يعني أنه لا يمكن تطبيق القالب المخصص بعد ذلك.

## عزل الصوت الشخصي

<div data-with-frame="true"><figure><img src="/files/7b884cca59104ac2a7062248eb2268f6415f1535" alt=""><figcaption><p>نظرة عامة على كيفية قيام عزل الصوت الشخصي بعزل صوت المستخدم</p></figcaption></figure></div>

يوضح المخطط أعلاه كيف أن **عزل الصوت الشخصي** تعمل هذه الميزة باستخدام بصمة صوتية مخزنة محليًا على جهاز المستخدم للتمييز بين كلام المستخدم وضوضاء الخلفية المحيطة. تبدأ العملية عندما يسجل المستخدم عينة صوتية من خلال ميزة عزل الصوت الشخصي في تطبيق Zoom Workplace. يُستخدم ذلك التسجيل لإنشاء بصمة صوتية محلية تساعد التطبيق على التعرّف إلى خصائص صوت المستخدم. وتبقى هذه البصمة الصوتية على الجهاز المحلي ولا يتم إرسالها إلى سحابة Zoom.

عندما يتحدث المستخدم لاحقًا أثناء اجتماع في بيئة تحتوي على ضوضاء محيطة، يستخدم تطبيق Zoom Workplace هذه البصمة الصوتية المخزنة محليًا للمساعدة في تحديد أنماط كلام المستخدم وفصلها عن الأصوات المحيطة. يتيح ذلك للتطبيق تقليل الضوضاء في الخلفية وعزل صوت المستخدم بفعالية أكبر قبل إرسال الصوت إلى الأمام عبر سير الاجتماع.

ونتيجةً لذلك، يكون الصوت المرسل إلى سحابة Zoom هو صوت الاجتماع المنقح بعد تصفية الضوضاء المحيطة إلى الحد الذي تدعمه الميزة. ولا يتم إرسال البصمة الصوتية الأساسية للمستخدم نفسها إلى بنية سحابة Zoom. وبهذه الطريقة، تعمل ميزة عزل الصوت الشخصي كميزة معالجة محلية على مستوى الجهاز تُحسّن وضوح الصوت قبل إرسال الصوت المنظف إلى جلسة Zoom المباشرة.


---

# Agent Instructions
This documentation is published with GitBook. GitBook is the documentation platform designed so that both humans and AI agents can read, navigate, and reason over technical content effectively. Learn more at gitbook.com.

## Querying This Documentation
If you need additional information that is not directly available in this page, you can query the documentation dynamically by asking a question.

Perform an HTTP GET request on the current page URL with the `ask` query parameter, and the optional `goal` query parameter:

```
GET https://library.zoom.com/technical-library/technical-library-ar/ai/ai-whitepaper/diagrams.md?ask=<question>&goal=<endgoal>
```

`ask` is the immediate question: it should be specific, self-contained, and written in natural language.
`goal` is optional and describes the broader end goal you are ultimately trying to accomplish on behalf of the user. GitBook uses it to tailor the answer towards what is most useful for that goal.

The response will contain a direct answer to the question and relevant excerpts and sources from the documentation.

Use this mechanism when the answer is not explicitly present in the current page, you need clarification or additional context, or you want to retrieve related documentation sections.
