مدلهای تصمیمگیری متنباز اولایا امکان اجرای محلی و پاسخگویی به سؤالات ساختاریافته را در کسری از ثانیه فراهم میکنند. این سیستمها میتوانند درخواستهای متنی یا JSON را پردازش کرده و در یک بارگذاری منفرد و بدون نیاز به تولید توکن به توکن پاسخ دهند. بر اساس تستهای انجامشده روی کارت گرافیک RTX 4090، یک درخواست پنجسؤالی تنها به حدود ۱۰ میلیثانیه زمان نیاز دارد. این پروژه با رابطهای برنامهنویسی مختلف سازگار بوده و امکان استفاده از مدلهای متنوعی مانند مدلهای زبان کوچک و طبقهبندیکنندههای صفرشات را فراهم میکند. حفظ حریم خصوصی و پردازش دادهها روی سختافزار شخصی کاربران از مهمترین ویژگیهای این پلتفرم محسوب میشود.