هابی‌تکستHUBBYTEXT اپ کانال اختصاصی بساز
آی‌تی و برنامه‌نویسی

مقایسه دقت نسخه‌های فشرده‌سازی مدل هوش مصنوعی Qwen3.8 27B

بررسی‌های جدید نشان می‌دهد که مدل هوش مصنوعی Qwen3.8 27B با وجود حجم ۵۵ گیگابایتی نسخه کامل BF16، در نسخه‌های فشرده‌شده نیز عملکرد چشمگیری دارد. نسخه فشرده ۱۷ گیگابایتی Q4_K_M توانسته است نتایج مدل کامل را در بنچمارک کدنویسی Terminal-Bench 2.1 به طور کامل تکرار کند. این نسخه به راحتی روی یک کارت گرافیک ۲۴ گیگابایتی مانند RTX 4090 نصب می‌شود و همچنان فضای کافی برای پردازش حدود ۶۴ هزار توکن از متن زمینه را فراهم می‌کند. پژوهشگر این بررسی برای اجرای بنچمارک‌های زمان‌بر از جمله GPQA Diamond و IFBench هزینه‌ای معادل ۳ هزار دلار روی پردازنده‌های گرافیکی Modal صرف کرده است. نتایج نشان می‌دهد که در فشرده‌سازی تا سطح ۴ بیت افت کیفیت محسوسی مشاهده نمی‌شود، اما فشرده‌سازی شدیدتر به مرز سقوط کارایی می‌رسد. انتخاب میزان تلاش مدل نیز اهمیت بالایی دارد، هرچند تنظیم پیش‌فرض روی حد بسیار بالا ممکن است منجر به بیش‌پردازش شود. استفاده از کش کلید-مقدار F16 نیز به ازای هر ۳۲ هزار توکن حدود ۲٫۳ گیگابایت حجم مصرف می‌کند.
منبع: Hacker News

خبرهای مرتبط RELATED

آی‌تی و برنامه‌نویسی
پژوهش جدیدی با عنوان «توسعه سوگیری‌های اجتماعی جدید در مدل‌های زبانی بزرگ از طریق کاوش تطبیقی» در پایگاه علمی اوپن‌ریویو منتشر شده است. این مطالعه به بررسی رفتار مدل‌های هوش مصنوعی پیشرفته و چگونگی شکل‌گیری انحرافات جدید رفتاری در آن‌ها می‌پردازد. طبق یافته‌های این پژوهش، مدل‌های زبانی بزرگ هنگام تعامل و الگوی کاوش تطبیقی، سوگیری‌های اجتماعی تازه‌ای ایجاد می‌کنند. این رویداد نشان می‌دهد که یادگیری هوش مصنوعی ممکن است به شکل‌گیری تعصبات ناخواسته و پیچیده‌تر از دادگان اولیه ختم شود. بررسی این پدیده برای طراحان سیستم‌های هوش مصنوعی اهمیت بالایی دارد تا از بازتولید تبعیض‌های نوظهور جلوگیری کنند. نتایج این تحقیق بحث‌های گسترده‌ای را در جامعه متخصصان یادگیری ماشین و اخلاق فناوری برانگیخته است.
منبع: Hacker News
آی‌تی و برنامه‌نویسی
مایکروسافت در آخرین بستهٔ به‌روزرسانی امنیتی ماه سپتامبر، بیش از ۹۷۲ آسیب‌پذیری را برطرف کرد که ۱۱۲ مورد از آن‌ها دارای سطح بحرانی بوده‌اند. این تعداد نسبت به دو ماه پیش که ۵۷۰ مورد ثبت شده بود، افزایش چشمگیری داشته است. دیستینی چایلدز، پژوهشگر شرکت صفرروز، این افزایش را «نرمال جدید» می‌نامد و هشدار می‌دهد که اگرچه اکتشاف هوشمندانهٔ آسیب‌پذیری‌ها توسط هوش مصنوعی همچنان در حال گسترش است، اما هنوز شاهد افزایش چشمگیر حملات فعال نبوده‌ایم. از ابتدای سال ۲۰۲۴، مایکروسافت بیش از ۲۷۶۰ آسیب‌پذیری را برطرف کرده که بیش از دو برابر تعداد سال قبل است. اگر این روند ادامه یابد، تعداد کل آسیب‌پذیری‌های برطرف شده در سال ۲۰۲۴ بیشتر از ترکیب سال‌های ۲۰۲۳، ۲۰۲۴ و ۲۰۲۵ خواهد بود.
منبع: Ars Technica
آی‌تی و برنامه‌نویسی
شرکت OpenAI مدل جدید ChatGPT Images 2.5 را با دو مدل API جدید منتشر کرد که یکی از آن‌ها توسط شرکت ادوبی در سرویس Firefly به کار گرفته شده است. این مدل جدید نسبت به نسخه ۲.۰ دارای جزئیات دقیق‌تر، ویرایش دقیق‌تر و تا ۵۰ درصد تأخیر کمتر است. مدل‌های جدید شامل GPT-Image-2.5 Flare به عنوان گزینه پیش‌فرض و Sunburst برای کارهای خلاقانه با کنترل بالاتر هستند. ادوبی با ادغام این مدل‌ها در ابزارهای خود، استراتژی خود را بر تبدیل شدن به یک رابط کاربری جامع برای مدل‌های مختلف متمرکز کرده است. طبق اعلام OpenAI، هفته‌ای بیش از ۳ میلیارد تصویر در ChatGPT و APIهای آن تولید می‌شود. همچنین ویژگی‌های جدیدی مانند قابلیت اشتراک‌گذاری دستورها (prompt) در کنار تصویر، قابلیت Sketch برای طراحی و استفاده از الگوهای آماده برای کاربران در دسترس قرار گرفته است.
منبع: The Next Web
آی‌تی و برنامه‌نویسی
شرکت OpenAI مدعی شد که مدل هوش مصنوعی داخلی این شرکت توانسته است معادلات سه‌بعدی ناویر-استوکس را اثبات کند. این پروژه با استفاده از حدود ۱۰ هزار عامل هوش مصنوعی و صرف هزینه‌ای میلیونی طی ۸۸ ساعت به نتیجه رسیده است. با وجود این ادعا، شرکت هنوز فایل اثبات رسمی و قابل راستی‌آزمایی را منتشر نکرده است. تریستان باک‌مستر و لِوِنت آلپوگه، از پژوهشگران مستقل، پیش‌نویس‌های مرتبطی را با فرمالیسم Lean منتشر کرده‌اند که امکان بررسی ماشینی را دارد. برخی کارشناسان و ریاضی‌دانان ابراز تردید کرده‌اند و خواستار انتشار فایل‌های کامل برای بررسی دقیق شده‌اند. شرکت OpenAI اتهامات مربوط به استفاده از پژوهش‌های منتشرنشده دیگران را رد کرده و هدف از این اعلام را نشان دادن پیشرفت مدل‌های خود عنوان کرده است.
منبع: The Next Web
آی‌تی و برنامه‌نویسی
شرکت «متا» از هوش مصنوعی شخصی جدید خود با نام «میوز» رونمایی کرد که جزئیات و قابلیت‌های آن در وب‌سایت رسمی این شرکت منتشر شده است. این ابزار جدید به عنوان یک دستیار شخصی هوشمند طراحی شده است تا تعاملات کاربران را بهبود بخشد. اطلاعات اولیه این پروژه در پلتفرم‌های مختلف فناوری از جمله «هکریوکر» مورد بحث و بررسی کاربران قرار گرفته است. در حال حاضر امتیاز این مقاله در وب‌سایت مرجع به ۵۳ رسیده و ۳۰ دیدگاه درباره آن ثبت شده است. شرکت «متا» تلاش می‌کند با معرفی این قابلیت‌های جدید، حضور خود را در بازار رقابتی هوش مصنوعی تقویت کند.
منبع: Hacker News
آی‌تی و برنامه‌نویسی
شرکت OpenAI از انتشار نسخه جدید ابزار تصویرساز خود با نام ChatGPT Images ۲.۵ خبر داده است. این نسخه جدید توجه کاربران زیادی را در وب‌سایت‌های فناوری به خود جلب کرده است. به گزارش منابع آنلاین، این ابزار توانسته امتیاز ۱۰۹ را از کاربران دریافت کند. همچنین ۸۳ دیدگاه مختلف پیرامون قابلیت‌های این نسخه به ثبت رسیده است. توسعه‌دهندگان امیدوارند این به‌روزرسانی عملکرد بهتری در تولید تصاویر ارائه دهد. اطلاعات بیشتر در وب‌سایت رسمی شرکت سازنده در دسترس است.
منبع: Hacker News
📲 کانال اختصاصی علایق خودت را رایگان بساز