اپل در آستانه یک جهش بزرگ؛ آیا آیفون به‌زودی هوش مصنوعی را بدون اینترنت اجرا می‌کند؟

گزارش اختصاصی منبع: CNBC / رویترز زمان مطالعه: ۵ دقیقه

کمپانی اپل در حال ارزیابی و مذاکره با استارتاپ PrismML است؛ شرکتی برخاسته از دانشگاه کلتک که ادعا می‌کند فناوری نوین آن قادر است مدل‌های بزرگ هوش مصنوعی مولد را بدون کاهش چشمگیر کارایی، چنان فشرده و بهینه کند که مستقیماً و بدون نیاز به اینترنت روی آیفون اجرا شوند.

انقلاب سخت‌افزاری

شکستن مرزهای پردازشی؛ مدل‌های ۲۷ میلیارد پارامتری در جیب شما

استارتاپ PrismML که توسط موسسه فناوری کالیفرنیا (Caltech) پایه‌گذاری شده و بازوی مالی قدرتمندی همچون Khosla Ventures را پشت سر خود دارد، توانسته نسخه فوق‌فشرده‌ای از مدل متن‌باز معروف Qwen (متعلق به هلدینگ علی‌بابا) را با موفقیت روی تراشه‌های آیفون پیاده‌سازی کند.

📊 مقایسه میزان فشرده‌سازی حجم مدل هوش مصنوعی Qwen
حجم مدل اصلی (پیش‌فرض) ۵۴ گیگابایت
حجم مدل فشرده‌شده با فناوری PrismML کمتر از ۴ گیگابایت (قابل اجرا روی آیفون ۱۵+)

* این کاهش ۱۳ برابری در حجم مدل، اجرای روان نسخه ۲۷ میلیارد پارامتری را بدون پر شدن رم گوشی ممکن می‌سازد.

«بابک حسیبی»، مدیرعامل ایرانی‌تبار PrismML در گفت‌وگو با شبکه CNBC تایید کرد که اپل و چند غول فناوری دیگر در حال حاضر به طور جدی در حال ارزیابی این تکنولوژی از نظر سرعت، مصرف باتری و میزان حفظ دقت استدلال هستند.

تجربه کاربری و حریم خصوصی

چرا اجرای آفلاین و روی دستگاه (On-Device) برای اپل حیاتی است؟

این گزارش تنها یک روز پس از عرضه بتای عمومی iOS 27 منتشر شد؛ سیستم‌عاملی که بازسازی اساسی دستیار صوتی سیری (Siri) را هدف قرار داده است. اپل با تکیه بر این فناوری، چهار مزیت رقابتی مهم را به دست خواهد آورد:

پاسخ‌گویی آنی و بدون تاخیر: حذف فرآیند ارسال داده به سرورهای ابری و دریافت پاسخ.
🔒 حریم خصوصی مطلق: اطلاعات شخصی و صدای کاربر هرگز از مرزهای فیزیکی گوشی خارج نمی‌شوند.
📉 کاهش هزینه‌های سرسام‌آور ابر: سبک شدن بار پردازشی دیتاسنترهای گران‌قیمت اپل.
✈️ عملکرد ۱۰۰٪ آفلاین: امکان استفاده از هوش مصنوعی در هواپیما، نقاط بدون آنتن و اینترنت ضعیف.
اسرار مهندسی

فناوری فشرده‌سازی کوانتایزیشن PrismML چگونه کار می‌کند؟

رویکرد PrismML برای معجزه کوچک‌سازی مدل، بازنویسی نحوه ذخیره وزن‌ها و اطلاعات داخلی شبکه‌های عصبی است. این استارتاپ به جای استفاده از محاسبات متداول ۱۶ بیتی (یا حتی ۸ بیتی)، اطلاعات مدل را تنها با یک یا سه مقدار فوق‌فشرده ذخیره می‌کند.

۱۰ تا ۱۵ برابر مصرف حافظه کمتر (RAM)
۶ تا ۸ برابر پاسخ‌گویی و سرعت بیشتر
۳ تا ۶ برابر کاهش چشمگیر مصرف باتری
⚖️ بهای این بهینه‌سازی چیست؟

به گفته مدیرعامل PrismML، این کاهش حجم بدون جریمه نیست؛ دقت مدل‌ها در فشرده‌سازی بسیار بالا اندکی افت می‌کند. جالب اینجاست که توانایی مدل‌ها در یادآوری اطلاعات و فکت‌های واقعی زودتر از مهارت‌های استدلالی، برنامه‌نویسی یا حل مسائل ریاضی با کاهش روبرو می‌شود.

افق فراتر از موبایل

از ربات‌های هوشمند تا خودروهای خودران آفلاین

توسعه‌دهندگان PrismML معتقدند این فناوری فشرده‌سازی انقلابی، پتانسیل تحول در صنایعی بسیار بزرگ‌تر از تلفن همراه را دارد. در آینده، مدل‌های سبک به خودروها، ربات‌های صنعتی و تجهیزات کارخانه‌ای اجازه می‌دهند بدون تکیه به اتصال دائمی، پایدار و پرسرعت اینترنت، تصمیمات حیاتی و هوشمندانه را به صورت آنی اتخاذ کنند. هم‌اکنون نسخه‌های فشرده Qwen به صورت رایگان برای تست روی مک‌بوک‌ها و کامپیوترهای شخصی منتشر شده و نسخه فشرده مدل Gemma (متعلق به گوگل) نیز در صف انتشار است.

🔮 فرجام: رویای دیرینه اپل در آستانه تحقق

اپل به لطف رویکرد انحصاری و یکپارچه خود در طراحی هم‌زمان سخت‌افزار (تراشه‌های سری A و M) و نرم‌افزار، مناسب‌ترین کاندیدا برای بهره‌برداری از دستاوردهای فشرده‌سازی PrismML است. هدف استراتژیک اپل کاملاً هوشمندانه است: پردازش اکثریت درخواست‌های روزمره و شخصی سیری روی پردازنده اختصاصی آیفون شما، و انتقال وظایف استدلالی فوق سنگین به ابرهای ایمن اپل. در صورت نهایی شدن این توافق، غول کوپرتینو گام بزرگی را در رهبری بازار «هوش مصنوعی محلی و ایمن» برخواهد داشت و استانداردی جدید برای امنیت داده‌ها در عصر نوین تکنولوژی تعریف خواهد کرد.

دیدگاهتان را بنویسید

نشانی ایمیل شما منتشر نخواهد شد. بخش‌های موردنیاز علامت‌گذاری شده‌اند *