بهجای ارسال همه داده به ابر، تراشههای عصبی و شتابدهندههای لبه، استنتاج را نزدیک کاربر نگه میدارند. این معماری برای اینترنت اشیاء، خودرو و پزشکی پوشیدنی حیاتی است.
چرا لبه؟
پهنای باند، تأخیر شبکه و مقررات حریم خصوصی، پردازش محلی را جذاب میکند.
مدلهای فشردهشده و کوانتیزهشده روی سختافزار اختصاصی اجرا میشوند.
چالشها
مدیریت حرارت، بهروزرسانی امن مدل و تنوع سختافزار هنوز باز است.
استانداردهای مشترک برای استقرار مدل روی دستگاه در حال شکلگیری است.
این گزارش ترجمهای آزاد و خلاصهشده برای مخاطبان فارسیزبان کلینیک علوم ایران است. منبع اصلی: «Edge AI chips low-power on-device intelligence» — Phys.org (لینک منبع).