منظور ما از «AI» چیست
عنوان اصلی: What we mean by AI
هدف یادگیری: تعریف دقیق نوع سامانهای که در این جزوه به آن میپردازیم — یک Large Language Model (LLM) مولد و مدرن مانند Claude — و تمایز آن از ایدههای قدیمی AI، اتوماسیون اسکریپتی و چیزی که در رسانهها به آن «الگوریتم» میگویند.
مفاهیم کلیدی: Generative AI, LLM, pretraining, probabilistic system, emergent capability
وقتی در این جزوه از «AI» سخن میگوییم، منظور ما بهطور مشخص یک Large Language Model مولد و مدرن است؛ سامانهای مانند Claude که روی پیکرهی متنی بسیار بزرگی pretrain شده و سپس fine-tune شده است. این سامانهها الگوهای آماری زبان را میآموزند: اینکه کدام واژهها، جملهها و ایدهها معمولاً در کنار یکدیگر میآیند. آنها سندی را بازیابی نمیکنند؛ آنها دنبالههای تازهای تولید میکنند که با توجه به context دادهشده، محتمل بهنظر میرسند.
نگاه Anthropic در اینجا اهمیت دارد: مدلهای بزرگ از نظر کیفی با مدلهای کوچک متفاوتاند. تواناییها میتوانند با افزایش مقیاس بهطور ناگهانی پدیدار شوند — تواناییهایی مانند استدلال، انتقال میانزبانی، و کدنویسی. به همین دلیل این جزوه با LLM همچون یک سامانهی رفتاری برخورد میکند که باید مشاهده و توصیف شود، نه برنامهای قطعی که خطبهخط مشخصاتش نوشته شده باشد.
این درس همچنین دو سوءتفاهم رایج را کنار میگذارد. نخست، AI بهمعنای سامانههای خبرهی قاعدهمحور قدیمی نیست. دوم، AI همان «الگوریتم» در رسانهها (یعنی recommender system شبکههای اجتماعی) نیست. هیچکدام از این دو، ماهیت یک LLM مولد را توصیف نمیکنند.
سرانجام، چون این سامانه آماری و emergent است، روش درست استفاده از آن این است که برای چهار خصلت اصلی شهود ایجاد کنید (next token prediction، knowledge، working memory، steerability) — نه اینکه فهرست ویژگیهای آن را حفظ کنید.
مثال عملی
یک پرسش واقعی را به دو صورت متفاوت از Claude بپرسید: «پایتخت فرانسه چیست؟» و «نام شهری که در آن برج ایفل قرار دارد و مقر دولت فرانسه است را به من بگو.» هر دو پاسخ، روان و مطمئن خواهند بود. اما توجه کنید که نحوهی صورتبندی شما رفتار مدل را تغییر میدهد. این رفتار مولد است، نه بازیابانه.
اشتباهات رایج
- «AI همان موتور جستوجویی است که حرف میزند.» نه — مدل تولید میکند، بازیابی نمیکند.
- «AI قاعدهمحور است؛ اگر اشتباه کرد، یعنی یک نفر قاعدهای را اشتباه نوشته است.» قاعدهی موضوعی وجود ندارد؛ رفتار از training میآید.
- «مدل بزرگتر، حتماً بهتر است.» معمولاً بهتر است، اما تواناییهای جدید همراه با حالتهای شکست تازه ظاهر میشوند.