فهرست مطالب
پیشرفت روزافزون هوش مصنوعی مولد باعث شده که استفاده از چتباتها و سرویسهای مختلف به بخش مهمی از زندگی روزمره ما تبدیل شود.
تا همین چند وقت پیش، اجرای مدلهای هوش مصنوعی روی گوشی اندرویدی بدون اتصال به سرویسهای ابری تصوری محال به نظر میرسید. اما امروز با بهینهسازیهای نرمافزاری و قویتر شدن چیپستهای موبایل، امکان اجرای هوش مصنوعی روی اندروید به صورت کاملاً مستقل و بینیاز از اینترنت فراهم شده است.
اپلیکیشن MNN Chat اندروید یکی از قدرتمندترین و مدرنترین ابزارها برای اجرای محلی مدلهای هوش مصنوعی است که به شما اجازه میدهد مدلهای زبان بزرگ LLM را مستقیماً روی حافظه و پردازنده گوشی هوشمند خود اجرا کنید. در این مقاله قرار است صفر تا صد راهاندازی MNN Chat، دانلود مدل از Hugging Face و اجرای هوش مصنوعی آفلاین روی دستگاههای مختلف را با هم مرور کنیم.
اجرای مدلهای هوش مصنوعی روی اندروید چگونه امکانپذیر است؟

در حالت عادی وقتی با یک چتبات صحبت میکنید، درخواست شما از طریق اینترنت به ابرسِروِرهای پرقدرت فرستاده شده و پاسخ پردازششده مجدداً به گوشی شما برمیگردد. اما اجرای مدل LLM روی گوشی بر پایهی کوانتایزیشن (Quantization) و بهینهسازی وزنهای ریاضی مدلها انجام میشود. به زبان ساده، تکنولوژیهای جدید توانستهاند حجم مدل هوش مصنوعی روی موبایل را بدون افت شدید کیفیت، آنقدر کوچک کنند که روی تراشههای موبایل قابل پردازش باشد.
اجرای محلی LLM چه تفاوتی با ChatGPT، Gemini و Perplexity AI دارد؟
سرویسهایی مانند ChatGPT، Gemini و Perplexity AI تمام توان محاسباتی خود را از ابر دریافت میکنند. در مقابل، اجرای LLM به صورت محلی کاملاً متکی به پردازنده (CPU)، پردازنده گرافیکی (GPU) و حافظه RAM برای اجرای LLM در خود گوشی شماست. در سرویسهای ابری، شما محدود به سیاستها و قطعیهای سرور هستید، اما در روش محلی، همهچیز زیر کلید خودتان قرار دارد.
مزایای اجرای هوش مصنوعی آفلاین و بدون اینترنت روی گوشی
دسترسی به یک دستیار هوش مصنوعی آفلاین مزایای بینظیری دارد:
- استقلال کامل از اینترنت: در پرواز، سفر، مناطق بدون پوشش شبکه یا در زمان قطعی اینترنت، همچنان یک چتبات آفلاین اندروید همراه شماست.
- سرعت پاسخدهی بدون تأخیر شبکه (Latency): هیچ زمان انتظاری برای ارسال و دریافت داده روی پروتکلهای اینترنتی تلف نمیشود.
- عدم وجود سانسور یا محدودیتهای تحریمی: بسیاری از سرویسهای بینالمللی کاربران ایرانی را تحریم کردهاند، اما مدلهای متنباز هوش مصنوعی روی گوشی شما بدون هیچ محدودیتی کار میکنند.
حریم خصوصی و پردازش اطلاعات روی دستگاه
بزرگترین مزیت اجرای مدل هوش مصنوعی بدون اینترنت، امنیت و حریم خصوصی هوش مصنوعی است. هنگام پردازش هوش مصنوعی روی دستگاه (On-Device Processing)، هیچکدام از پرامپتها، سوالات، فایلها یا اطلاعات شخصی شما به هیچ سرور بیرونی ارسال نمیشود. این ویژگی برای پرسنل شرکتها، پژوهشگران و افرادی که دادههای حساس دارند، یک نقطهی عطف حیاتی است.
مرتبط: گوگل به دانشجویان یک سال اشتراک هوش مصنوعی رایگان می دهد
برای اجرای LLM روی گوشی اندرویدی به چه سختافزاری نیاز داریم؟

اگرچه فناوری بهینهسازی به طرز شگفتانگیزی پیشرفت کرده، اما محدودیت سختافزاری اجرای LLM روی گوشیهای هوشمند همچنان یک فاکتور تعیینکننده است. برای دستیابی به خروجی مناسب، دستگاه شما باید حداقلهایی را دارا باشد.
نقش حافظه RAM در اجرای مدلهای زبان بزرگ
مهمترین قطعه سختافزاری برای اجرای مدلهای زبانی روی گوشی، حافظه RAM است. مدلهای هوش مصنوعی پیش از شروع پردازش باید به صورت کامل روی رم بارگذاری شوند. اگر مقدار رم گوشی کمتر از حجم مدل و لایههای پردازشی آن باشد، برنامه کرش کرده یا سیستمعامل آن را میبندد.
اجرای LLM روی گوشی با 8 گیگابایت رم
یک گوشی با 8 گیگابایت رم نقطه شروع عالی برای ورود به دنیای هوش مصنوعی آفلاین اندروید است. با این میزان رم، شما میتوانید به راحتی یک مدل 4 میلیارد پارامتری (مانند مدل هوش مصنوعی 4B) یا مدلهای سبکتر ۱ تا ۳ میلیارد پارامتری را بدون مشکل اجرا کنید.
اجرای LLM روی گوشی با 12 گیگابایت رم و بیشتر
اگر یک گوشی با 12 گیگابایت رم یا ۱۶ گیگابایت رم دارید، دستتان برای اجرای مدلهای بسیار سنگینتر باز است. شما میتوانید مدلهای محلی هوش مصنوعی جدیتر مانند نسخههای کوانتایزشده 7B یا 8B را روی گوشی اجرا کرده و سرعت بالاتری در تولید توکن (کلمات) تجربه کنید.
محدودیت اجرای مدلهای چند میلیارد پارامتری روی گوشیهای میانرده
هنگام اجرای مدل هوش مصنوعی روی گوشی میانرده، علاوه بر رم، تراشه پردازشی (SoC) نیز اهمیت مییابد. پردازندههای سری Snapdragon 7 یا MediaTek Dimensity در رده میانرده میتوانند مدلهای LLM سبک را اجرا کنند، اما ممکن است سرعت تولید متن (Tokens per second) در آنها پایینتر باشد.
عملکرد مدلهای هوش مصنوعی روی گوشیهای پرچمدار
در فرآیند اجرای مدل هوش مصنوعی روی گوشی پرچمدار (مجهز به Snapdragon 8 Gen 2/Gen 3 یا تراشههای ردهبالای ابعاد جدید)، شتابدهندههای عصبی (NPU) و پردازندههای گرافیکی قدرتمند باعث میشوند سرعت تولید متن شبیه به نسخه وب ChatGPT باشد!
تأثیر اجرای مدلهای هوش مصنوعی بر باتری و فضای ذخیرهسازی
دو عامل کلیدی را نباید فراموش کرد:
- مصرف باتری مدلهای هوش مصنوعی: پردازش محلی سنگین باعث فشار به CPU و GPU شده و مصرف باتری را افزایش میدهد و ممکن است گوشی کمی گرم شود.
- فضای ذخیرهسازی مدلهای هوش مصنوعی: هر مدل هوش مصنوعی آفلاین بسته به حجم و تعداد پارامترهایش بین ۱.۵ تا ۸ گیگابایت از حافظه داخلی را اشغال میکند.
MNN Chat چیست و چه کاربردی در اندروید دارد؟

برنامه MNN Chat یک فریمورک و چتبات متنباز قدرتمند است که توسط موتور پیشرفته MNN (مخفف Mobile Neural Network توسعهیافته توسط غول فناوری Alibaba) قدرت میگیرد. این نرمافزار به طور اختصاصی برای اجرای هوش مصنوعی با MNN Chat روی دستگاههای موبایل و لبه (Edge) بهینهسازی شده است.
قابلیتها و مدلهای پشتیبانیشده در MNN Chat
نرمافزار MNN Chat اندروید به لطف موتور رندرینگ فوقالعاده سبک خود، میتواند فرکانس محاسباتی پردازنده را بهینهسازی کند. این برنامه امکاناتی نظیر تنظیم پارامترهای تولید متن، مدیریت حافظه کانتکست و پشتیبانی از انواع مدلهای ساختاریافته را فراهم میکند.
پشتیبانی از مدلهای زبانی و مدلهای چندوجهی
یکی از هیجانانگیزترین خصوصیات اجرای LLM با MNN Chat، پشتیبانی همزمان از مدلهای متنی ساده و مدلهای چندوجهی (Multimodal Models) است. یعنی علاوه بر چت متنی، میتوانید تصاویر را نیز به مدل بدهید تا آن را آنالیز کند!
آشنایی با بخشهای Models Market، My Models و Import Models
محیط کاربری برنامه MNN Chat بسیار ساده و کاربردی طراحی شده است:
- Models Market: بازارچهای داخلی برای دانلود مستقیم مدلهای بهینهشده و آماده.
- My Models: آرشیوی از مدلهای دانلودشده که آمادهی اجرا و چت هستند.
- Import Models: ابزاری دستی برای Import Models که اجازه میدهد مدلهای دانلودشده از منابع بیرونی را وارد اپلیکیشن کنید.
مرتبط: گوگل ابزارهای جدید هوش مصنوعی را برای مطالعه معرفی کرد
آموزش نصب و راهاندازی MNN Chat روی گوشی اندرویدی

برای راهاندازی MNN Chat و تبدیل گوشی به یک مرکز هوش مصنوعی، مراحل زیر را گامبهگام دنبال کنید:
دانلود و نصب MNN Chat
- به صفحه رسمی پروژه MNN Chat در GitHub مراجعه کنید یا نسخه جدید آن را از فروشگاههای معتبر دریافت کنید.
- فایل APK را دانلود و روی گوشی اندرویدی خود نصب کنید (نصب MNN Chat).
انجام تنظیمات اولیه برنامه
پس از اولین بازکردن برنامه، MNN Chat سختافزار دستگاه شما (مقدار RAM، نوع CPU و توان گرافیکی) را آنالیز میکند تا مشخص کند چه کلاسی از مدلها روی گوشی شما روانتر اجرا میشوند.
بررسی دسترسیها و آمادهسازی گوشی برای اجرای مدل
برنامه برای ذخیرهسازی مدلهای چندگیگابایتی نیاز به دسترسی به حافظه داخلی (Storage Permission) دارد. این دسترسی را تایید کنید و مطمئن شوید که گزینههای بهینهسازی باتری (Battery Optimization) برای MNN Chat خاموش است تا در حین چت، برنامه توسط مدیریت رم اندروید بسته نشود.
آموزش دانلود مدل LLM در MNN Chat

بدون داشتن یک مدل، برنامه مثل یک بدنه بدون روح است! برای آموزش دانلود MNN Chat و دریافت مدلها سه راه اصلی پیش رو دارید:
دانلود مدل از Models Market
سادهترین راه، رفتن به تب Models Market در داخل خود برنامه است. در این بخش لیستی از مدلهای تستشده (مانند Qwen یا Llama) قرار دارد. کافی است روی دکمه Download در کنار مدل مورد نظر کلیک کنید تا فایلها به صورت خودکار دریافت و نصب شوند.
دانلود مدلهای هوش مصنوعی از Hugging Face
پلتفرم Hugging Face بزرگترین مرجع دنیا برای فایلهای هوش مصنوعی است. شما میتوانید با مرور Hugging Face، مدلهای تبدیلشده به فرمت MNN (با پسوند .mnn) را جستوجو کرده و دانلود مدل از Hugging Face را به صورت مستقیم انجام دهید.
وارد کردن مدل دانلودشده از بخش Import Models
اگر مدلی را به صورت جداگانه با مرورگر یا کامپیوتر دانلود کردهاید:
- فایلهای مدل را به حافظه گوشی انتقال دهید.
- وارد تب Import Models شوید.
- پوشه حاوی فایلهای مدل mnn. را انتخاب کنید تا برنامه آن را شناسایی و اضافه کند.
مدیریت مدلهای نصبشده از بخش My Models
در بخش My Models، لیست تمام مدلهای آمادهبهکار را میبینید. در این بخش میتوانید مدلهای قدیمی را حذف کنید تا فضای ذخیرهسازی گوشی آزاد شود یا تنظیمات اختصاصی هر مدل را تغییر دهید.
مرتبط: گوگل با هوش مصنوعی مشکل رد رگههای سفید هواپیما را حل کند
کدام مدلهای هوش مصنوعی را میتوان روی گوشی اجرا کرد؟

دنیای مدلهای متنباز هوش مصنوعی بسیار گسترده است، اما همه آنها مناسب اجرا روی موبایل نیستند. در ادامه بهترین گزینهها را معرفی میکنیم:
اجرای مدلهای خانواده Qwen روی اندروید
خانواده مدلهای Qwen که توسط غول فناوری Alibaba توسعه یافتهاند، بینظیرترین عملکرد را روی موبایل دارند. مدل Qwen (بهویژه نسخههای Qwen 1.5 و Qwen 2 در احجام 0.5B، 1.5B و 3B) سرعت فوقالعاده بالا و درک زبان فارسی و انگلیسی خیرهکنندهای را روی گوشی ارائه میدهد.
اجرای مدلهای DeepSeek روی اندروید
مدل DeepSeek یکی دیگر از شگفتیهای دنیای هوش مصنوعی است. نسخههای سبک و بهینهشدهی DeepSeek برای کدنویسی، تحلیلهای ریاضی و استدلالهای منطقی روی گوشی اندرویدی فوقالعاده عمل میکنند.
اجرای مدلهای Llama روی اندروید
مدل Llama (محصول شرکت Meta) استاندارد طلایی مدلهای متنباز است. نسخههای Llama 3 و Llama 3.2 در ابعاد کوچکتر، برای اجرای مدلهای زبانی روی گوشی گزینهای فوقالعاده هوشمند با استدلال قوی هستند.
اجرای Gemma 7B و مدلهای مشابه
مدل Gemma 7B که توسط گوگل معرفی شده، یکی از باکیفیتترین مدلهاست. البته اجرای Gemma 7B نیازمند گوشی پرچمدار با حداقل ۱۲ گیگابایت رم است، زیرا حجم بیشتری دارد.
چرا مدلهای سبک و 4B برای اجرای محلی روی موبایل مناسبتر هستند؟
برای ایجاد تعادل میان سرعت تولید کلمات، کیفیت پاسخ و عدم داغ شدن گوشی، یک پارامترهای مدل هوش مصنوعی در حدود ۱.۵ تا ۴ میلیارد (مدل 4 میلیارد پارامتری) بهترین شیرینی (Sweet Spot) محسوب میشود. مدلهای سبکتر هم حافظه رم کمتری اشغال میکنند و هم فشار معقولی به باتری وارد میسازند.
آموزش اجرای مدل LLM با MNN Chat

پس از راهاندازی MNN Chat و دانلود مدل مورد نظرتان، زمان آن رسیده که وارد محیط چت شوید و قدرت پردازش هوش مصنوعی روی دستگاه را از نزدیک لمس کنید. این برنامه امکانات متنوعی را برای شخصیسازی خروجی در اختیارتان میگذارد.
انتخاب و بارگذاری مدل هوش مصنوعی
وارد تب My Models شوید. تمام مدلهایی که از قبل دانلود کردهاید یا از طریق Import Models وارد برنامه ساختهاید در اینجا لیست شدهاند. روی مدل دلخواه ضربه بزنید تا فرایند بارگذاری روی حافظه RAM آغاز شود. این مرحله بسته به حجم مدل ممکن است بین ۲ تا ۱۰ ثانیه زمان ببرد.
شروع گفتوگوی آفلاین با مدل
پس از بارگذاری کامل، صفحه چت باز میشود. اکنون میتوانید اینترنت و وایفای گوشی را کاملاً خاموش کنید! پرامپت یا سوال خود را وارد کرده و دکمه ارسال را بزنید تا چتبات بدون نیاز به هیچ سرور بیرونی، شروع به تولید پاسخ کند.
تنظیم System Prompt برای کنترل پاسخهای مدل
یکی از گزینههای بسیار مهم، System Prompt است. با تنظیم این بخش، لحن، نقش و حدود رفتار مدل تعیین میشود؛ برای مثال میتوانید به مدل دستور دهید: «تو یک دستیار کدنویسی پایتون هستی که پاسخها را بسیار خلاصه و به زبان فارسی میدهد.»
تنظیم Max new tokens و پارامترهای تولید پاسخ
برای کنترل میزان مصرف منابع و طول پاسخها میتوانید پارامترهای فنی را دستکاری کنید:
- Max new tokens: تعیین میکند که مدل در هر پاسخ حداکثر چه تعداد توکن (کلمه/بخش) تولید کند تا جلوی پاسخهای خیلی طولانی و مصرف بیرویه باتری گرفته شود.
- Temperature: میزان خلاقیت پاسخ را کنترل میکند (مقادیر پایینتر برای پاسخهای دقیق و علمی، مقادیر بالاتر برای پاسخهای خلاقانه).
استفاده از Benchmark Mode برای بررسی عملکرد مدل
با فعال کردن Benchmark Mode، ابزار سنجش عملکرد MNN Chat وارد عمل میشود. این بخش به شما نشان میدهد که گوشی شما با چه سرعتی (تعداد توکن بر ثانیه یا Tokens/s) در حال پردازش متن است و چقدر از حافظه رم درگیر شده است.
مرتبط: آیا هوش مصنوعی میتواند سرطان را درمان کند؟
اجرای مدلهای چندوجهی روی گوشی اندرویدی

دنیای هوش مصنوعی تنها به متن محدود نمیشود؛ نسل جدید مدلهای چندوجهی یا Multimodal Models توانایی درک همزمان تصویر و متن را دارا هستند.
پردازش همزمان متن و تصویر با مدلهای Multimodal
با بارگذاری یک مدل چندوجهی (مانند نسخههای چندوجهی Qwen-VL یا Llama-Vision)، میتوانید تصاویری از محیط، نمودارها، یا متون روی کاغذ را با دوربین گرفته یا از گالری انتخاب کنید و از هوش مصنوعی بخواهید محتوای تصویر را تحلیل کرده، متنش را بخواند یا درباره آن توضیح دهد.
محدودیتهای سختافزاری مدلهای چندوجهی روی موبایل
تحلیل تصویر نیاز به رم بیشتر و محاسبات سنگینتر دارد. به همین دلیل، اجرای روان Multimodal Models روی موبایل معمولاً نیازمند گوشی با 12 گیگابایت رم یا بالاتر است؛ در غیر این صورت ممکن است پردازش تصویر با کندی مواجه شود.
MNN Chat فقط برای اجرای مدلهای زبانی است؟

پاسخ کوتاه خیر است! اگرچه تمرکز اصلی بر روی مدلهای زبان بزرگ LLM است، اما فریمورک MNN توانایی پردازش مدالیتههای صوتی و تصویری مختلف را نیز دارد.
اجرای مدلهای تولید تصویر Image Generation
علاوه بر چت متنی، امکان بارگذاری مدلهای سبک تولید تصویر با هوش مصنوعی آفلاین (Image Generation) مانند نسخههای فوقالعاده کوانتایزشده Stable Diffusion روی MNN Chat وجود دارد تا بدون اینترنت عکس خلق کنید.
اجرای مدلهای تبدیل متن به گفتار Text-to-Speech
با پشتیبانی از تبدیل متن به گفتار TTS (Text-to-Speech)، برنامه میتواند پاسخهای متنی تولیدشده توسط LLM را خوانده و تولید صدا با هوش مصنوعی را به صورت کاملاً آفلاین انجام دهد.
اجرای مدلهای تشخیص خودکار گفتار Automatic Speech Recognition
ویژگی تشخیص خودکار گفتار ASR (Automatic Speech Recognition) به شما اجازه میدهد به جای تایپ کردن، با صوت خود با هوش مصنوعی صحبت کنید تا صدای شما به متن تبدیل شده و وارد چت شود.
امکان اجرای مدلهای تولید صدا و ویدئو روی گوشی
با وجود اینکه امکان فنی اجرای الگوریتمهای تولید ویدئو با هوش مصنوعی یا موزیک روی گوشی فراهم است، اما به دلیل حجم فوقالعاده بالا و فشار شدید محاسباتی، فعلاً اجرای کاربردی آنها روی گوشیهای معمولی کاملاً محدود است.
مرتبط: آمازون کتابهای کمیاب را برای آموزش هوش مصنوعی نابود می کند
مشکلات رایج هنگام اجرای هوش مصنوعی روی گوشی اندرویدی

اجرای محلی مدلهای هوش مصنوعی ممکن است با چالشهایی همراه باشد که شناخت آنها به رفع سریعتر مشکل کمک میکند:
اجرا نشدن مدل به دلیل کمبود حافظه RAM
اگر مدل سنگینتر از ظرفیت رم باشد، سیستمعامل اندروید برای جلوگیری از هنگ کردن دستگاه، برنامه MNN Chat را به ناگاه میبندد (Crash). راه حل: استفاده از مدلهای سبکتر مانند مدل هوش مصنوعی 4B یا کمتر.
کند بودن سرعت تولید پاسخ
اگر سرعت تولید کلمات بسیار پایین است، علت آن ضعیف بودن پردازنده یا عدم استفاده صحیح برنامه از شتابدهندههای گرافیکی است.
افزایش مصرف باتری و داغ شدن گوشی
استفاده از تمام هستههای پردازشی باعث مصرف باتری مدلهای هوش مصنوعی و تولید حرارت میشود. توصیه میشود هنگام چتهای طولانی، بارهای کاری سنگین به دستگاه ندهید.
کمبود فضای ذخیرهسازی برای مدلهای بزرگ
هر مدل حجم بالایی دارد. حتماً فایلهای نصب اضافی را از بخش My Models پاک کنید تا حافظه داخلی پر نشود.
ناسازگاری برخی مدلها با سختافزار گوشی
برخی فایلهای مدل دانلودشده از Hugging Face ممکن است با معماری پردازنده گوشی یا فریمورک MNN ناسازگار باشند. همیشه فایلهایی با پسوند استاندارد .mnn دانلود کنید.
استفاده از ADB برای رفع محدودیتهای اجرای مدل روی اندروید

سیستمعامل اندروید به صورت پیشفرض برای حفظ سلامت دستگاه، محدودیتهایی روی میزان استفاده برنامهها از حافظه رم اعمال میکند.
ADB چه کاربردی در اجرای مدلهای هوش مصنوعی دارد؟
با استفاده از ابزار ADB (Android Debug Bridge) و اتصال گوشی به کامپیوتر، میتوانید محدودیتهای تخصیص حافظه پردازشهای پسزمینه اندروید (Phantom Process Killer) را تغییر داده یا بهینه کنید.
چه زمانی استفاده از ADB ضروری است؟
اگر گوشی شما RAM بالایی دارد (مثلاً ۱۲ یا ۱۶ گیگابایت)، اما اندروید به برنامه اجازه نمیدهد بیش از ۴ گیگابایت آن را اشغال کند و برنامه کرش میکند، استفاده از دستورات ADB جهت آزادکنندگی کامل حافظه ضروری خواهد بود.
مرتبط: شرکت OpenAI ترمز هوش مصنوعی را کشید
آیا اجرای هوش مصنوعی آفلاین روی گوشی ارزش دارد؟

پاسخ به این سوال بستگی به نوع نیاز شما دارد.
مزایای چتبات و دستیار هوش مصنوعی آفلاین
استقلال از اینترنت، امنیت بینظیر، حفظ حریم خصوصی هوش مصنوعی و عدم وجود سانسور، بزرگترین دلایلی است که اجرای محلی را فوقالعاده ارزشمند میکند.
محدودیت مدلهای محلی در مقایسه با سرویسهای ابری
مدلهای محلی موبایل به دلیل حجم کوچکتر، توانایی استدلال همسطح با مدلهای غولپیکر چندصد میلیارد پارامتری مانند GPT-4o را ندارند و دانش عمومی آنها محدودتر است.
چه کاربرانی بیشترین استفاده را از LLM محلی خواهند داشت؟
برنامهنویسان، پژوهشگران، برنامهریزان، مسافران، و تمام افرادی که با اطلاعات محرمانه یا در محیطهای بدون اینترنت کار میکنند، بیشترین بهره را از یک دستیار هوش مصنوعی آفلاین خواهند برد.
سوالات متداول درباره اجرای مدلهای هوش مصنوعی روی اندروید
بله، با برنامههایی مانند MNN Chat اندروید و دانلود قبلی مدل، تمام فرآیند چت و پردازش به صورت ۱۰۰٪ آفلاین روی گوشی انجام میشود.
حداقل رم مورد نیاز ۶ گیگابایت است، اما برای اجرای روان مدلهای کاربردی، داشتن گوشی با 8 گیگابایت رم پیشنهاد میشود.
خانواده مدلهای Qwen (بهویژه نسخههای Qwen 1.5 و Qwen 2 با حجم 1.5B و 3B) به دلیل سرعت بسیار بالا و پشتیبانی عالی از زبان فارسی، بهترین گزینه هستند.
بله، اما نیازمند گوشی با 12 گیگابایت رم یا بیشتر و تراشههای پرچمدار است.
بله، این برنامه و فریمورک کاملاً متنباز و رایگان بوده و هیچ هزینه یا اشتراکی ندارد.
بله، از آنجایی که پردازنده و رم گوشی در تمام طول پاسخدهی تحت فشار محاسباتی قرار میگیرند، مصرف باتری نسبت به حالت عادی بیشتر خواهد بود.















