معماری هوشیار: از سند خام تا پاسخ مستند
شش لایهی پردازشی، یک پایپلاین ۷ مرحلهای با زمانبندی واقعی، و گاردریلهایی که تضمین میکنند هیچ پاسخی بدون منبع تولید نمیشود.
شش لایهی پردازشی هوشیار
لایه ۱ — دریافت و استخراج اسناد
OCR دوزبانه (فارسی/انگلیسی) و قطعهبندی معنایی اسناد ورودی.
لایه ۲ — پایگاه دانش سهگانه
ترکیب پایگاه دادهی رابطهای، پایگاه برداری و پایگاه گرافی برای بازیابی دقیقتر.
لایه ۳ — موتورهای پردازش هوشمند
موتورهای استنتاج و پردازش زبانی روی دادههای استخراجشده.
لایه ۴ — فرمساز و گردشکار
گردشکار حسابرسی، انطباق و چرخهی اسناد مالی و بیمهای.
لایه ۵ — ارکستراسیون و اقدام امن
هماهنگی میان سرویسها و اجرای اقدامات با کنترل دسترسی.
لایه ۶ — محاسبات مالی و بیمهای
تبدیل خروجیهای تحلیلی به شاخصهای مالی و بیمهای قابل اتکا.
پنج ماژول اصلی HooshYar Kernel
هر ماژول بخشی مستقل از هسته را پوشش میدهد؛ از استنتاج امن و درک چندوجهی تا ارکستراسیون، انطباق و نگاشت ریسک.
hy_kernel — هسته استنتاج زبانی امن
قلب سیستم؛ موتور استنتاج مبتنی بر RAG که پاسخگویی را صرفاً بر اساس شواهد بازیابیشده از پایگاه دانش سهگانه (رابطهای، برداری، گرافی) انجام میدهد. هر پاسخ پیش از انتشار از دروازه کنترل صحت عبور میکند.
hy_multimodal — دریافت و درک چندوجهی
خط لوله پردازشی پنجمرحلهای برای اسناد Word، Excel، PDF و اسکنها؛ از کنترل منبع و اعتبار تا استخراج جداول، قطعهبندی معنایی و مدلسازی الزامات.
hy_ops — ارکستراسیون و اقدام امن
اجرای سیاستهای خودترمیمی روی سیستمهای عامل، پایگاههای داده و تجهیزات شبکه از طریق درگاههای امن؛ با ثبت کامل شواهد و تاریخچه تغییرات.
hy_compliance — انطباق و حسابرسی
فرمساز پویا و گردشکار حسابرسی؛ تولید خودکار پرسشنامهها بر اساس نوع دارایی، سطح حساسیت و دامنه استاندارد، و تطبیق بلادرنگ سؤالات با سناریو.
hy_risk — موتور نگاشت ریسک
نگاشت خودکار رویدادها، آسیبپذیریها و ریسکهای سازمانی به چارچوبهای هدف؛ همراه با شواهد لازم برای ممیزی و تبدیل ریسک فنی به ضرایب مالی و بیمهای.
پایپلاین ۷ مرحلهای با زمانبندی واقعی
از دریافت پرسش تا پاسخ اعتبارسنجیشده — هر مرحله با زمان اجرای واقعی اندازهگیری شده است.
ترجمه/نرمالسازی پرسش
۱ ثانیهپرسش کاربر استانداردسازی و برای پردازش آماده میشود.
بردار معنایی ۱۰۲۴ مؤلفهای
۲ ثانیهپرسش به بردار معنایی با ۱۰۲۴ مؤلفه تبدیل میشود.
جستوجوی معنایی در Qdrant
۰.۱ ثانیهجستوجو میان بیش از ۵۴۵ هزار قطعهی سند در پایگاه برداری Qdrant.
بازیابی ترکیبی و دنبالکردن ارجاعها
ترکیب نتایج بازیابی معنایی و کلیدواژهای همراه با پیگیری ارجاعات بینسندی.
رتبهبندی مجدد Cross-encoder
۷ ثانیهاز میان ۸۰ نامزد اولیه، ۸ شاهد برتر با مدل Cross-encoder انتخاب میشوند.
تولید پاسخ
۴۰–۹۰ ثانیهپاسخ نهایی فقط بر پایهی ۸ قطعهی منتخب و مستند تولید میشود.
اعتبارسنجی پس از تولید
< ۱ ثانیهبررسی نهایی صحت استناد و انطباق پاسخ با منابع پیش از تحویل.
۱۰ گاردریل برای تضمین صحت پاسخ در هر لایه
Grounding اجباری
تولید صرفاً از ۸ شاهد بازیابیشده؛ بدون دانش پارامتری آزاد.
راستیآزمایی نقلقول
تطبیق عبارتبهعبارت پاسخ با متن بند استنادشده.
استناد الزامی
هر گزاره باید شناسهی سند، شماره بند و صفحه داشته باشد.
بررسی اعداد
اعتبارسنجی مقادیر عددی، واحدها و شروط در پاسخ.
دنبالکردن ارجاع متقابل
کشف استثناها و بندهای محدودکننده در صفحات دیگر.
تفکیک چارچوبها
جلوگیری از آمیختن منابع غیرهمارز مقرراتی.
آستانه اطمینان
عدم پاسخگویی در صورت پایین بودن درجه اطمینان آماری.
دروازه کیفیت انسانی
تأیید متخصص GRC پیش از ارتقای دانش به وضعیت معتبر.
لاگ ممیزی کامل
ثبت زنجیره استدلال و شواهد هر پاسخ برای ممیزی.
جداسازی شبکهای
استقرار Air-Gapped؛ بدون خروج هیچ دادهای از محیط.
هوش مصنوعی بدون یک بایت خروج داده
برای سازمانهایی که هیچ اتصال اینترنتی مجاز نیست، هوشیار با مدلهای متنباز محلی (مانند نسخهی فاینتیونشدهی Llama-3، DeepSeek و مدلهای بومی بهینهشده) بهصورت ۰ تا ۱۰۰٪ داخلی مستقر میشود.
هوشیار در برابر ابزارهای عمومی و سنتی
معیارها مستقیماً از معماری مستند پلتفرم گرفته شدهاند.
| معیار | هوشیار | ابزارهای عمومی (Chatbot ابری) | راهکارهای سنتی (قاعدهمحور) |
|---|---|---|---|
| استقرار Air-Gapped | ۰ تا ۱۰۰٪ کاملاً داخلی | وابسته به ابر خارجی | محدود و پرهزینه |
| استناد اجباری به منبع | شناسهی سند، صفحه و نقلقول در هر پاسخ | بدون کنترل مستند | فاقد پاسخ زبان طبیعی |
| پایگاه دانش | سهگانه: رابطهای + برداری + گرافی | عمدتاً برداری ساده | پایگاه دادهی رابطهای صرف |
| چندمستأجری امن | Row-Level Security و فضاینام مجزا | بسته به ارائهدهنده | وابسته به پیادهسازی سازمان |
معماری سازمانی
API-First: رابط کاربری صرفاً یک کلاینت است و همهی منطق از طریق REST و gRPC عرضه میشود.
Strict Multi-Tenancy: جداسازی کامل مستأجران با Row-Level Security و فضاینام مجزا — هیچ پاسخی نباید قطعهدادهای از مستأجر A را به مستأجر B نشت دهد.
اتصالپذیری
- اتصال فقط-خواندنی به SQL Server، Oracle، PostgreSQL و MySQL
- SharePoint، Nextcloud و درایوهای ابری
- سازگار با چارگون، فراگستر و همکاران سیستم
- یکپارچگی با Jira، GitLab، ServiceNow و Syslog/Kafka/Webhook
عمق فنی بیشتر میخواهید؟
مستندات API و مشخصات فنی کامل را ببینید یا مستقیم با تیم فنی صحبت کنید.