کمپانی اپل در حال ارزیابی و مذاکره با استارتاپ PrismML است؛ شرکتی برخاسته از دانشگاه کلتک که ادعا میکند فناوری نوین آن قادر است مدلهای بزرگ هوش مصنوعی مولد را بدون کاهش چشمگیر کارایی، چنان فشرده و بهینه کند که مستقیماً و بدون نیاز به اینترنت روی آیفون اجرا شوند.
شکستن مرزهای پردازشی؛ مدلهای ۲۷ میلیارد پارامتری در جیب شما
استارتاپ PrismML که توسط موسسه فناوری کالیفرنیا (Caltech) پایهگذاری شده و بازوی مالی قدرتمندی همچون Khosla Ventures را پشت سر خود دارد، توانسته نسخه فوقفشردهای از مدل متنباز معروف Qwen (متعلق به هلدینگ علیبابا) را با موفقیت روی تراشههای آیفون پیادهسازی کند.
* این کاهش ۱۳ برابری در حجم مدل، اجرای روان نسخه ۲۷ میلیارد پارامتری را بدون پر شدن رم گوشی ممکن میسازد.
«بابک حسیبی»، مدیرعامل ایرانیتبار PrismML در گفتوگو با شبکه CNBC تایید کرد که اپل و چند غول فناوری دیگر در حال حاضر به طور جدی در حال ارزیابی این تکنولوژی از نظر سرعت، مصرف باتری و میزان حفظ دقت استدلال هستند.
چرا اجرای آفلاین و روی دستگاه (On-Device) برای اپل حیاتی است؟
این گزارش تنها یک روز پس از عرضه بتای عمومی iOS 27 منتشر شد؛ سیستمعاملی که بازسازی اساسی دستیار صوتی سیری (Siri) را هدف قرار داده است. اپل با تکیه بر این فناوری، چهار مزیت رقابتی مهم را به دست خواهد آورد:
فناوری فشردهسازی کوانتایزیشن PrismML چگونه کار میکند؟
رویکرد PrismML برای معجزه کوچکسازی مدل، بازنویسی نحوه ذخیره وزنها و اطلاعات داخلی شبکههای عصبی است. این استارتاپ به جای استفاده از محاسبات متداول ۱۶ بیتی (یا حتی ۸ بیتی)، اطلاعات مدل را تنها با یک یا سه مقدار فوقفشرده ذخیره میکند.
به گفته مدیرعامل PrismML، این کاهش حجم بدون جریمه نیست؛ دقت مدلها در فشردهسازی بسیار بالا اندکی افت میکند. جالب اینجاست که توانایی مدلها در یادآوری اطلاعات و فکتهای واقعی زودتر از مهارتهای استدلالی، برنامهنویسی یا حل مسائل ریاضی با کاهش روبرو میشود.
از رباتهای هوشمند تا خودروهای خودران آفلاین
توسعهدهندگان PrismML معتقدند این فناوری فشردهسازی انقلابی، پتانسیل تحول در صنایعی بسیار بزرگتر از تلفن همراه را دارد. در آینده، مدلهای سبک به خودروها، رباتهای صنعتی و تجهیزات کارخانهای اجازه میدهند بدون تکیه به اتصال دائمی، پایدار و پرسرعت اینترنت، تصمیمات حیاتی و هوشمندانه را به صورت آنی اتخاذ کنند. هماکنون نسخههای فشرده Qwen به صورت رایگان برای تست روی مکبوکها و کامپیوترهای شخصی منتشر شده و نسخه فشرده مدل Gemma (متعلق به گوگل) نیز در صف انتشار است.
🔮 فرجام: رویای دیرینه اپل در آستانه تحقق
اپل به لطف رویکرد انحصاری و یکپارچه خود در طراحی همزمان سختافزار (تراشههای سری A و M) و نرمافزار، مناسبترین کاندیدا برای بهرهبرداری از دستاوردهای فشردهسازی PrismML است. هدف استراتژیک اپل کاملاً هوشمندانه است: پردازش اکثریت درخواستهای روزمره و شخصی سیری روی پردازنده اختصاصی آیفون شما، و انتقال وظایف استدلالی فوق سنگین به ابرهای ایمن اپل. در صورت نهایی شدن این توافق، غول کوپرتینو گام بزرگی را در رهبری بازار «هوش مصنوعی محلی و ایمن» برخواهد داشت و استانداردی جدید برای امنیت دادهها در عصر نوین تکنولوژی تعریف خواهد کرد.

