چرا این موضوع مهم است؟
Transformer معماری شبکه است؛ LLM مدل زبانی بزرگی است که معمولاً روی Transformer ساخته میشود—مثل تفاوت موتور و خودروی کامل. Pretraining پیشبینی توکن بعدی روی داده عظیم است؛ Continued Pretraining همان مسیر را روی دامنه خاص (پزشکی، حقوق، فارسی تخصصی) ادامه میدهد.
کارتهای مفهومی
Transformer vs LLM
معماری در برابر مدل کامل
Pretraining / CPT
آموزش پایه و دامنه خاص
SFT
Instruction Tuning
RLHF / DPO / RLAIF
مسیرهای Alignment

در عمل چه کار کنیم؟
Instruction Tuning (SFT) مدل را با جفت دستور–پاسخ فرمانپذیر میکند. Alignment با RLHF، RLAIF، DPO و ORPO/KTO/PPO انجام میشود. در عمل، برای محصول کسبوکار اغلب مدل پایه + RAG کافی است؛ Train سنگین فقط وقتی «سبک» یا دامنهٔ بسیار خاص میخواهید. قبل از Alignment پرهزینه، faithfulness RAG را روی تعرفه و سیاست سازمان بسنجید.
برای تیمهای فارسیزبان، این مرحله یعنی تعریف intentهای واقعی، آمادهسازی پایگاه دانش قابل استناد، و اتصال چت بات سایت یا کانالهای پیامرسان به همان منبع حقیقت—نه تکیه بر حافظهٔ عمومی مدل. اگر هنوز میپرسید دستیار هوشمند چیست، معیار عملی این است: پاسخ باید از سند تأییدشده بیاید، قابل ارزیابی باشد و در ابهام به کارشناس ارجاع دهد.
نکات طلایی مصاحبه
- LLM معمولاً بر پایه Transformer است.
- SFT برای پیروی از دستور ضروری است.
- DPO جایگزین سادهتر RLHF در بسیاری پروژههاست.
پیشنهاد سایماتک
Train هوشمندانه، استقرار سریع
Alignment مهم است؛ دانش کسبوکار را با RAG به دستیار هوشمند فارسی بدهید.
جمعبندی کاربردی
بسیاری از تیمها بهجای Train سنگین، از RAG برای دستیار هوشمند فارسی استفاده میکنند. مسیر سایماتک را برای صحبت با هوش مصنوعی روی دانش سازمان ببینید.
آماده شروع هستید؟
آمادهاید از دستیار هوشمند RAG استفاده کنید؟
همین حالا با ما تماس بگیرید و از مشاوره رایگان بهرهمند شوید. اگر میخواهید بدانید دستیار هوشمند چیست و چطور یک چت بات فارسی روی سایت شما کار میکند، تست رایگان و دمو بهترین قدم بعدی است. برای سوال سریع هم میتوانید از دستیار گوشه صفحه — صحبت با هوش مصنوعی آنلاین — کمک بگیرید.
اگر پلن فعال ندارید به بخش پلنهای قیمتگذاری هدایت میشوید؛ در غیر این صورت وارد پنل میشوید. نصب دستیار و راهاندازی چت بات سایت معمولاً چند دقیقه طول میکشد.


