فرهنگ اصطلاحات
مدل زبانی بزرگ
مدل زبانی بزرگ سیستمی است که با آموزش روی حجم عظیمی از متن، الگوهای زبان را فرا گرفته و میتواند متن تولید کند، خلاصه کند، ترجمه کند و استدلال زبانی انجام دهد. این مدل موتور بسیاری از سیستمهای هوش مصنوعی امروزی است، اما بهتنهایی یک محصول نیست.
با نام دیگر Large Language Model (LLM)
مدل زبانی بزرگ در واقع یک پیشبین است: بر اساس متنی که دریافت کرده، محتملترین ادامه را تولید میکند. این سازوکار ساده، در مقیاس بزرگ، رفتارهایی تولید میکند که شبیه فهم و استدلال به نظر میرسند.
درک دو محدودیت برای استفادهٔ سازمانی ضروری است. نخست، مدل فقط چیزی را میداند که در دادهٔ آموزشیاش بوده و تا تاریخ مشخصی؛ دادهٔ امروز شرکت شما در آن نیست. دوم، مدل ذاتاً «نمیداند که نمیداند» و ممکن است پاسخی روان اما نادرست تولید کند.
به همین دلیل، سیستمهای سازمانی قابل اتکا، مدل را به داده واقعی متصل میکنند، خروجی را در برابر داده اعتبارسنجی میکنند، و مسیرهای اقدام را تحت کنترل نگه میدارند.
سؤالهای رایج
- آیا مدل زبانی دادهٔ ما را یاد میگیرد؟
- در استفادهٔ متعارف از API، خیر؛ داده در پاسخ استفاده میشود اما مدل با آن بازآموزی نمیشود.
- کدام مدل بهتر است؟
- به کاربرد بستگی دارد؛ برای کارهای ساختاریافته مدل کوچکتر و ارزانتر معمولاً کافی است.
فرآیندهایتان را عاملمحور کنیم
از کجا شروع کنیم؟