راهاندازی مدل هوش مصنوعی محلی روی مک مینی M4 Pro
خلاصه
یک توسعهدهنده جزئیات راهاندازی خود برای اجرای مدلهای هوش مصنوعی محلی روی مک مینی M4 Pro را به اشتراک گذاشته است. این مطلب با ۱۴۲ امتیاز و ۶۷ نظر در Hacker News توجه زیادی را به خود جلب کرده است. این راهاندازی نشان میدهد که سیلیکون جدید اپل چقدر برای اجرای مدلهای زبانی بزرگ به صورت محلی قدرتمند است.
سیلیکون اپل به طور اساسی چشمانداز استنتاج هوش مصنوعی محلی را تغییر داده است و چیپ M4 Pro در مک مینی جدید نمونه بارز این تحول است. یک توسعهدهنده اخیراً راهنمای مفصلی از راهاندازی خود برای اجرای مدلهای زبانی بزرگ به صورت کاملاً محلی منتشر کرده که نیاز به ارسال دادههای حساس به سرویسهای ابری را از بین میبرد. این مطلب به سرعت در Hacker News با ۱۴۲ امتیاز و ۶۷ نظر مورد توجه قرار گرفت.
این راهاندازی از معماری حافظه یکپارچه M4 Pro بهره میبرد که اشتراکگذاری حافظه بین CPU و GPU را به صورت یکپارچه امکانپذیر میسازد. این طراحی هنگام اجرای مدلهای بزرگ که در غیر این صورت به کارتهای GPU اختصاصی با VRAM زیاد نیاز دارند، مزیت حیاتی محسوب میشود. با ابزارها و بهینهسازیهای مناسب، مک مینی میتواند مدلهایی را اجرا کند که قبلاً به سختافزار بسیار گرانتری نیاز داشتند.
توسعهدهنده از فریمورکهای محبوبی مانند Ollama و llama.cpp استفاده میکند که هر دو برای Apple Silicon بهینهسازی شدهاند. این ابزارها اجرای روان مدلهای متنباز مانند Llama، Mistral و دیگران را با سرعت تولید توکن چشمگیر امکانپذیر میسازند. پیکربندی همچنین شامل یک رابط وب میزبانیشده محلی است که تعامل با مدلها را از طریق یک رابط چت آشنا بدون نیاز به اینترنت آسان میکند.
جامعه Hacker News با اشتیاق پاسخ داد و بسیاری از کاربران تجربیات خود را در اجرای مدلهای محلی روی سختافزار اپل به اشتراک گذاشتند. موضوع مکرر در نظرات، مزیت حریم خصوصی نگهداشتن تمام استنتاج روی دستگاه است که تضمین میکند هیچ پرامپت یا پاسخی به خارج منتقل نمیشود. اجماع گستردهای وجود دارد که مک مینی M4 Pro ارزش استثنایی برای کسانی ارائه میدهد که میخواهند هوش مصنوعی محلی را بدون سرمایهگذاری در سختافزار گرانقیمت سرور آزمایش کنند.
به کمک فناوری اطلاعات در استکهلم نیاز دارید؟
پشتیبانی Sovin IT را از ۴۹۹ کرون رزرو کنید