# ماذا تحتفظ المساعدات الصوتية السحابية من صوتك، وما الذي يغيّره التعرّف على الكلام على الجهاز > تختلف Alexa وGemini وSiri في مكان معالجة الكلام ومدة الاحتفاظ بالتسجيلات والنصوص المفرَّغة. مراجعة قائمة على المصادر، وما يتغيّر حين يجري كل ذلك على جهاز Mac. FireAI Security & Research Team (HisnLabs) · Published 2026-10-08 Canonical: https://hisnlabs.com/ar/blog/cloud-voice-assistants-recordings-on-device-speech يحوّل المساعد الصوتي الصوتَ إلى نص، ثم النصَّ إلى جواب، ثم الجوابَ إلى صوت من جديد. ويمكن أن تجري كل مرحلة من هذه المراحل على خادم بعيد أو على الجهاز نفسه، وهذا الاختيار هو الذي يحدّد من يحتفظ بتسجيل لصوت المستخدم، وبنصّ مفرَّغ لما قاله، وإلى متى. تقارن هذه المذكرة، استنادًا إلى صفحات الخصوصية لدى الشركات نفسها وإلى شكوى جهة رقابية ودراسة قياس محكّمة، ما ترسله ثلاثة مساعدات واسعة الانتشار خارج الجهاز وما تحتفظ به. ثم تبيّن ما يغيّره التعرّف على الكلام على الجهاز وتشغيل النماذج اللغوية محليًا، وما لا يغيّره، متخذةً من AISir مثالًا تطبيقيًا، وهو مخطِّط ومساعد صوتي لجهاز Mac من HisnLabs صدر في 8 أكتوبر 2026. ## الخلفية يمرّ الطلب المنطوق بأربع مراحل: رصد النشاط الصوتي أو كلمة التنبيه، ثم التعرّف على الكلام (تحويل الكلام إلى نص)، ثم نموذج لغوي أو قواعد تقرّر الجواب، ثم تركيب الكلام (تحويل النص إلى صوت). وفي معظم المساعدات الموجّهة للمستهلكين لا تجري محليًا إلا المرحلة الأولى: يُصغي الجهاز إلى كلمة التنبيه، ثم يبثّ الصوت إلى خوادم الشركة حيث تجري المراحل الأخرى. وعندئذ يمكن أن تحتفظ الشركة بأثرين: التسجيل الصوتي والنص المفرَّغ. وللاحتفاظ أهمية لثلاثة أسباب: فالتسجيل المخزَّن معطًى قريب من البيانات البيومترية يكشف هوية المتكلّم، والنص المخزَّن قد يكشف أسماء وعناوين وتفاصيل صحية وشؤون عمل، وكلاهما قد يقرؤه بشر، سواء أكانوا مراجعين توظّفهم الشركة لتحسين الخدمة أم أيّ شخص يصل لاحقًا إلى الحساب أو إلى أنظمة الشركة. وقد جعلت نماذج التعرّف على الكلام المفتوحة تصميمًا آخر ممكنًا عمليًا. ففي ديسمبر 2022 وصف باحثون من OpenAI نموذج Whisper الذي دُرِّب على «680,000 ساعة من الإشراف متعدد اللغات ومتعدد المهام»، وأعلنوا: «نحن ننشر النماذج وشيفرة الاستدلال لتكون أساسًا لعمل لاحق في معالجة الكلام المتينة» [[8]](https://arxiv.org/abs/2212.04356). وفي يوليو 2025 قدّم مؤلفو WhisperKit «نظام استدلال محسَّنًا على الجهاز للتعرّف الآني على الكلام يتفوّق بفارق كبير على أبرز الأنظمة السحابية»، وهي دعوى يقدّمونها عن نظامهم وعلى مجموعة الاختبار التي اختاروها [[9]](https://arxiv.org/abs/2507.10860). ## النتائج ### Amazon Alexa: معالجة في السحابة، وتسجيلات محفوظة ما لم يرفض المستخدم تتيح صفحة الخصوصية لدى Amazon خيار عدم حفظ التسجيلات: «إذا اخترت عدم حفظ تسجيلاتك الصوتية، فستُحذف تلقائيًا بعد أن تعالج Alexa طلبك». أما النصوص المفرَّغة فتخضع لقاعدة مستقلة: «ستظل قادرًا على مراجعة النصوص المفرَّغة لطلباتك إلى Alexa مدة 30 يومًا قبل أن نبدأ حذفها تلقائيًا». ويمكن لمن يُبقي التسجيلات أن يختار «الحذف التلقائي لتسجيلاتك الصوتية بصورة مستمرة كل ثلاثة أشهر أو 18 شهرًا»، وتشرح Amazon سبب عرض خيار الحفظ: «باختيارك حفظ تسجيلاتك الصوتية تحصل على ميزات أكثر تخصيصًا، وتفهم Alexa الطلبات فهمًا أفضل، ونستطيع مواصلة تحسين الخدمة» [[1]](https://www.aboutamazon.com/news/devices/alexa-makes-privacy-even-easier). وقد أُتيحت المعالجة المحلية لفترة قصيرة على بضعة أجهزة ثم سُحبت. فقد أفاد موقع TechCrunch في 15 مارس 2025 بأن Amazon راسلت مالكي Echo Dot من الجيل الرابع وEcho Show 10 وEcho Show 15 الذين فعّلوا خيار «عدم إرسال التسجيلات الصوتية»، لتبلغهم أنها ستتوقف عن دعمه في 28 مارس. وجاء في الرسالة كما نقلها الموقع: «مع مواصلتنا توسيع قدرات Alexa بميزات الذكاء الاصطناعي التوليدي التي تعتمد على قدرة المعالجة في سحابة Amazon الآمنة، قرّرنا التوقف عن دعم هذه الميزة» [[2]](https://techcrunch.com/2025/03/15/amazons-echo-will-send-all-voice-recordings-to-the-cloud-starting-march-28/). وكان الاحتفاظ بالبيانات موضوعًا لإجراءات إنفاذ أيضًا. ففي 31 مايو 2023 أعلنت لجنة التجارة الفيدرالية الأمريكية (FTC) عن شكوى رفعتها وزارة العدل تتّهم Amazon بأنها «احتفظت ببيانات صوتية وبيانات موقع جغرافي حساسة لسنوات، واستخدمتها لأغراضها الخاصة، معرِّضةً إياها لخطر الوصول غير الضروري». ونصّ مشروع الأمر القضائي على أن تدفع Amazon خمسة وعشرين مليون دولار وأن تحذف بيانات الأطفال. ونُقل عن صامويل ليفين، مدير مكتب حماية المستهلك في اللجنة، قوله: «لا يسمح قانون COPPA للشركات بالاحتفاظ ببيانات الأطفال إلى الأبد لأي سبب، ولا سيّما لتدريب خوارزمياتها» [[6]](https://www.ftc.gov/news-events/news/press-releases/2023/05/ftc-doj-charge-amazon-violating-childrens-privacy-law-keeping-kids-alexa-voice-recordings-forever). ### Google Gemini: محادثات محفوظة، وبعضها يراجعه بشر حتى ثلاث سنوات تذكر صفحة مركز خصوصية تطبيقات Gemini، المحدَّثة في 24 سبتمبر 2026، أن المحادثات تُحفظ حتى مع إيقاف إعداد النشاط: «المحادثات المؤقتة والمحادثات التي تجريها حين يكون Keep Activity متوقفًا تُحفظ مع حسابك مدة 72 ساعة». وتنشئ المراجعة البشرية مستوى أطول: «المحادثات التي راجعها مراجعون بشريون (والبيانات المتصلة بها مثل لغتك ونوع جهازك ومعلومات موقعك أو ملاحظاتك) لا تُحذف حين تحذف نشاطك، بل يُحتفظ بها مدة تصل إلى ثلاث سنوات». وفي ما يخص الصوت، تشير الصفحة إلى أن «التسجيلات الصوتية قد تبدأ قبل التفعيل ببضع ثوانٍ»، وأن «Gemini قد يتفعّل عن طريق الخطأ، كأن يلتقط ضجيجًا يشبه ‹Hey Google›» [[3]](https://support.google.com/gemini/answer/13594961). ### Apple Siri: معالجة أكبر على الجهاز، مع استمرار استخدام النصوص المفرَّغة غيّرت Apple ممارستها عام 2019 بعد أن علّقت برنامج مراجعة قالت إنها كانت تراجع فيه «عيّنة صغيرة من الصوت المأخوذ من طلبات Siri — أقل من 0.2 في المئة — ونصوصها المفرَّغة آليًا». وكان الإعداد الافتراضي الجديد الذي أعلنته: «افتراضيًا، لن نحتفظ بعد الآن بالتسجيلات الصوتية لتفاعلات Siri، وسنواصل استخدام النصوص المفرَّغة آليًا لمساعدة Siri على التحسّن» [[4]](https://www.apple.com/newsroom/2019/08/improving-siris-privacy-protections/). وفي بيان صدر في 8 يناير 2025 قالت Apple إنه «على الأجهزة القادرة، يُعالَج صوت طلبات المستخدمين بالكامل على الجهاز باستخدام Neural Engine، ما لم يختر المستخدم مشاركته مع Apple»، وإنها «لا تحتفظ بالتسجيلات الصوتية لتفاعلات Siri ما لم يوافق المستخدمون صراحةً على المساعدة في تحسين Siri» [[5]](https://www.apple.com/newsroom/2025/01/our-longstanding-privacy-commitment-with-siri/). ويضيف البيان نفسه أن «بعض الميزات تتطلّب مدخلات آنية من خوادم Apple»، فالتعرّف على الجهاز لا يعني أن أي طلب لا يغادر الجهاز. ### تفعيلات لم يطلبها أحد تنطبق سياسات الاحتفاظ على كل ما يلتقطه الجهاز، بما في ذلك ما يلتقطه خطأً. فقد شغّل دوبوا وزملاؤه «جولتين من 134 ساعة من محتوى 12 برنامجًا تلفزيونيًا» قرب سمّاعات ذكية شائعة في الولايات المتحدة والمملكة المتحدة، ورصدوا «0.95 تفعيلًا خاطئًا في الساعة، أي 1.43 مرة لكل 10,000 كلمة منطوقة»، ولدى بعض الأجهزة استمرّ 10 في المئة من مدد التفعيل الخاطئ عشر ثوانٍ على الأقل [[7]](https://petsymposium.org/popets/2020/popets-2020-0072.php). وتقرّ صفحة Google نفسها بالظاهرة ذاتها في Gemini [[3]](https://support.google.com/gemini/answer/13594961). | المساعد | التعرّف على الكلام | هل يُحفظ الصوت افتراضيًا؟ | النصوص المفرَّغة والمراجعة | | --- | --- | --- | --- | | Amazon Alexa (Echo) | سحابة Amazon؛ انتهى الخيار المحلي في 28 مارس 2025 على الأجهزة الثلاثة التي كانت تتيحه | نعم، ما لم يختر المستخدم عدم الحفظ؛ الحذف التلقائي بعد 3 أشهر أو 18 شهرًا متاح | النصوص قابلة للمراجعة 30 يومًا حين لا تُحفظ التسجيلات | | Google Gemini | تعالجه Google؛ لا تصف الصفحة مرحلة الكلام على حدة | قد تبدأ التسجيلات قبل التفعيل ببضع ثوانٍ | تُحفظ 72 ساعة مع إيقاف النشاط؛ والمحادثات المراجَعة حتى ثلاث سنوات | | Apple Siri | على الأجهزة القادرة بالكامل على الجهاز؛ بعض الميزات تحتاج خوادم Apple | لا، ما لم يوافق المستخدم | تُستخدم النصوص المفرَّغة آليًا لتحسين Siri | | AISir (Mac) | على جهاز Mac (Whisper عبر WhisperKit) | لا: يبقى الصوت في الذاكرة ولا يُحفظ أبدًا | تُنسى المحادثة عند إغلاق AISir؛ ولا يُحفظ إلا نص المكالمات وملاحظاتها، على جهاز Mac | *أين يُعالَج الكلام وما الذي يُحفظ، كما يصفه كل مصدر (تمت المراجعة في 8 أكتوبر 2026)* > يسمعك AISir عبر Whisper على جهاز Mac نفسه: يبقى الصوت في الذاكرة، ولا يُحفظ، ولا يُرسَل إلى أي خادم. ويجيب Gemma ويتكلّم صوت Chatterbox، وكلاهما على جهاز Mac أيضًا. [Download FireAI for Mac](https://hisnlabs.com/fireai/en/download) ## ما يعنيه ذلك لمستخدمي Mac تترتّب على المصادر ثلاثة فروق. أولها أن عبارة «لا نحتفظ بالصوت» غير عبارة «لا نحتفظ بما قلته»: فكثير من السياسات تتخلّص من التسجيلات وتُبقي النصوص المفرَّغة، والنص يحمل معظم المحتوى الحساس. وثانيها أن أدوات الحذف تسري على المخزن الرئيسي للشركة؛ إذ تذكر Google أن المحادثات المراجَعة تبقى بعد حذف النشاط، فقد يفترق ما يحذفه المستخدم عمّا تحتفظ به الشركة. وثالثها أن المعالجة المحلية خاصية لجهاز بعينه ولإصدار برمجي بعينه، ويمكن سحبها كما في حالة Echo؛ فلا يدوم الإعداد إلا بقدر ما تقرّر الشركة الإبقاء عليه. يُخرج التعرّف على الكلام على الجهاز الخادمَ من مرحلة الكلام كليًا، لكنه لا يجعل المساعد خاصًا بذاته: فالنموذج اللغوي الذي يفسّر النص قد يعمل في السحابة، وقد يتطلّب الجواب بحثًا على الويب، وقد يُخزَّن النص محليًا حيث يمكن لبرامج أخرى أو لمستخدمين آخرين على الجهاز قراءته. فالسؤال الصحيح ليس «هل التعرّف على الكلام محلي؟» بل «أيّ المراحل الأربع تغادر الجهاز، وما الذي يُخزَّن، وأين، وإلى متى؟». ## توصيات 1. لكل مساعد تستخدمه، اعثر على صفحة الخصوصية الخاصة به ودوّن على حدة ما يحدث للصوت وللنصوص المفرَّغة وللمحادثات التي يراجعها بشر. 2. فعّل أقصر مدة للحذف التلقائي تتيحها الخدمة، وتحقّق إن كان حذف السجل يحذف النسخ المراجَعة أيضًا. 3. اكتم السمّاعات الذكية أو افصلها في الغرف التي تجري فيها محادثات سرّية؛ فالتفعيلات الخاطئة موثّقة. 4. فضّل المساعدات التي تذكر صراحةً أيّ المراحل تجري على الجهاز، وأعد التحقّق بعد التحديثات الكبرى، لأن الخيارات المحلية قد تُسحب. 5. راقب الشبكة: التطبيق الذي يقول إنه يعمل دون اتصال لا ينبغي أن يفتح أي اتصال وأنت تتكلم. ## صلة الموضوع بـ AISir AISir 1.0.1 مخطِّط وشريط سريع ومساعد صوتي لنظام macOS 15 على معالجات Apple silicon. وبحسب صفحات المساعدة فيه، تجري كل مراحل المحادثة المنطوقة على جهاز Mac: «يرصد Silero الكلام، ويكتبه Whisper، ويجيب Gemma، ويتكلّم Chatterbox. يبقى الصوت في الذاكرة فقط ولا يُحفظ أبدًا». والنموذج اللغوي هو Gemma 4 E2B ويعمل عبر MLX. وتدعم المحادثة المقاطعة (حين تتكلم فوق صوت AISir يتوقف فورًا)، وتنتهي حين يودّعه المستخدم. وتظهر المحادثة على الشاشة ثم تُنسى عند إغلاق AISir. أما الملاحظة الصوتية (بالضغط المطوّل على ⌥⇧Space) فيفرّغها Whisper على جهاز Mac، ويُتخلَّص من التسجيل فور كتابته. ولا يتصل AISir بالإنترنت من تلقاء نفسه إلا لتنزيل النماذج مرة واحدة، مع التحقق من كل ملف بمجموع اختباري. والبحث على الويب متوقف افتراضيًا؛ وإذا فُعّل أرسل عبارات بحث قصيرة ومحايدة إلى Wikipedia وWikidata، أو إلى Brave Search بمفتاح المستخدم الخاص، مباشرةً من جهاز Mac. التفاصيل في [صفحة AISir](https://hisnlabs.com/aisir/ar). ولا يزيل AISir كل الحدود المذكورة أعلاه. فأجوبته تستغرق نحو أربع ثوانٍ، والنموذج الصغير يخطئ، ولهذا تنتظر المهام التي يُعدّها قرار المستخدم: قبول أو تعديل أو تجاهل. ودعم العربية أضعف من الفرنسية والإنجليزية في بعض المواضع. ولا يعمل إلا على Apple silicon. وتُحفظ نصوص المكالمات وملاحظاتها، حين يختار المستخدم تدوينها، على جهاز Mac، فيظل أمن الجهاز نفسه، كتشفير FileVault وحساب المستخدم، أمرًا مهمًا. ولا يستطيع AISir أن يغيّر ما تسجّله مساعدات أخرى على الجهاز نفسه أو في الغرفة نفسها. > صدر AISir 1.0.1: تحدّث إليه، وقاطعه، وودّعه، ولا يُسجَّل شيء مما تقوله على أي خادم. كل الميزات متاحة 17 يومًا دون أي تسجيل حساب. [Download FireAI for Mac](https://hisnlabs.com/fireai/en/download) ## حدود هذه المذكرة تقارن هذه المذكرة سياسات منشورة لا سلوكًا مقيسًا، ولم يُتحقَّق هنا من أي تصريح للشركات بتحليل حركة الشبكة. والسياسات تتغيّر: فصفحة Amazon لا تحمل تاريخًا، وحُدّثت صفحة Google قبل اثني عشر يومًا من هذه المذكرة. وتعذّر فتح صفحة المساعدة لدى OpenAI حول الاحتفاظ ببيانات الوضع الصوتي، فلم توصف. ودراسة التفعيل الخاطئ تعود إلى عام 2020 واستخدمت صوتًا تلفزيونيًا لا منازل حقيقية. ووصف AISir مأخوذ من صفحات المساعدة فيه ومن صفحة المنتج، وHisnLabs هي من يصنع AISir، وهو ما ينبغي للقارئ أن يأخذه في الحسبان. للاستزادة: [النماذج اللغوية المحلية على Apple silicon](https://hisnlabs.com/ar/blog/local-llm-apple-silicon-security) و[استعادة التحكم في الكاميرا والميكروفون](https://hisnlabs.com/ar/blog/istirdad-idhn-kamirat-wa-mikrufun-mac). ## دور FireAI وHisnLabs مهما قالت صفحة الخصوصية لدى أي مساعد، فإن الشبكة تكشف ما يفعله فعلًا. يعرض FireAI، لكل تطبيق على حدة، كل اتصال يفتحه جهاز Mac، فترى إن كان تطبيق صوتي أو تطبيق ذكاء اصطناعي يتصل بخادم وأنت تتكلم، وتحجبه إن شئت. FireAI هو منتج HisnLabs نفسها: جدار حماية بذكاء اصطناعي يعمل على جهاز Mac مباشرة. يعرض بلغة واضحة كل اتصال تجريه تطبيقاتك، ويترك لك القرار فيما يخرج من جهازك — ذكاؤه الاصطناعي يعمل محليًا، فلا يُرسَل ترافيكك إلينا ولا إلى أي جهة أخرى أبدًا. فريق أبحاث الأمن في HisnLabs هو من يحافظ على دقة هذه القرارات: يصنّف النطاقات بين قياس عن بُعد عادي وخدمة حقيقية، ويتتبّع بلد وشبكة كل اتصال، ويدرّب النموذج المحلي (ميزة FireAI Pilot) على حركة اتصال حقيقية، دون أن يغادر أي شيء جهاز Mac. يمكنك الاطلاع على القرارات التقنية وراء ذلك، أو تجربة FireAI لمدة 17 يومًا، على [FireAI من HisnLabs](https://hisnlabs.com/fireai/ar/download). ## Sources - [Amazon: “Alexa makes privacy even easier”, About Amazon (no date shown on the page)](https://www.aboutamazon.com/news/devices/alexa-makes-privacy-even-easier) - [TechCrunch: “Amazon’s Echo is ending its ‘Do Not Send Voice Recordings’ feature, starting March 28”, 15 March 2025](https://techcrunch.com/2025/03/15/amazons-echo-will-send-all-voice-recordings-to-the-cloud-starting-march-28/) - [Google: Gemini Apps Privacy Hub, last updated 24 September 2026](https://support.google.com/gemini/answer/13594961) - [Apple Newsroom: “Improving Siri’s privacy protections”, 28 August 2019](https://www.apple.com/newsroom/2019/08/improving-siris-privacy-protections/) - [Apple Newsroom: “Our longstanding privacy commitment with Siri”, 8 January 2025](https://www.apple.com/newsroom/2025/01/our-longstanding-privacy-commitment-with-siri/) - [US Federal Trade Commission: FTC and DOJ charge Amazon with violating children’s privacy law by keeping kids’ Alexa voice recordings forever, 31 May 2023](https://www.ftc.gov/news-events/news/press-releases/2023/05/ftc-doj-charge-amazon-violating-childrens-privacy-law-keeping-kids-alexa-voice-recordings-forever) - [Dubois, Kolcun, Mandalari, Paracha, Choffnes and Haddadi, “When Speakers Are All Ears: Characterizing Misactivations of IoT Smart Speakers”, PoPETs 2020 (4)](https://petsymposium.org/popets/2020/popets-2020-0072.php) - [Radford et al., “Robust Speech Recognition via Large-Scale Weak Supervision” (Whisper), arXiv:2212.04356, December 2022](https://arxiv.org/abs/2212.04356) - [Orhon et al., “WhisperKit: On-device Real-time ASR with Billion-Scale Transformers”, arXiv:2507.10860, July 2025](https://arxiv.org/abs/2507.10860) - [HisnLabs: AISir product page](https://hisnlabs.com/aisir/en)