corpus linguistics

پیشنهاد کاربران

## پیکره شناسی زبان ( Corpus Linguistics ) چیست؟
**پیکره شناسی زبان** ( Corpus Linguistics ) رویکردی در زبان شناسی است که به جای تحلیل جملات ساخته شده توسط زبان شناس ( روش شهودی ) ، از **مجموعه های بزرگ و نظام مند از متون طبیعی** ( نوشتاری یا گفتاری ) استفاده می کند. این مجموعه ها �پیکره� ( Corpus، جمع: Corpora ) نام دارند و معمولاً به صورت پایگاه دادهٔ رایانه ای ذخیره و پردازش می شوند.
...
[مشاهده متن کامل]

### ویژگی های کلیدی پیکره شناسی
- **داده محور ( Data‑driven ) **: بر اساس شواهد زبانی واقعی، نه قضاوت ذهنی زبان شناس.
- **بسامدگرا ( Frequency‑based ) **: الگوهای زبانی را از طریق شمارش و تحلیل آماری استخراج می کند.
- **ابزاری رایانه ای ( Computer‑assisted ) **: با استفاده از نرم افزارهای مخصوص ( مانند AntConc، Sketch Engine ) پیکره را جستجو و تجزیه می کند.
### پیکره ( Corpus ) چیست؟
پیکره مجموعه ای از متون واقعی است که:
- بر اساس معیارهای مشخص ( زمان، ژانر، گویش، رسانه ) گردآوری شده باشد.
- حجم آن به اندازهٔ کافی بزرگ باشد ( اغلب میلیون ها واژه ) تا الگوهای معنادار ظاهر شوند.
- به شکل دیجیتال و برچسب گذاری شده ( مثلاً برچسب دستوری یا نقشی ) ذخیره شود.
### مثال هایی از پیکره های معروف انگلیسی
| نام پیکره | حجم | ویژگی |
| - - - - - - - - - - - | - - - - - - | - - - - - - - - |
| **BNC** ( British National Corpus ) | ۱۰۰ میلیون واژه | انگلیسی بریتانیایی، نوشتاری و گفتاری |
| **COCA** ( Corpus of Contemporary American English ) | بیش از ۱ میلیارد واژه | انگلیسی آمریکایی، به روزرسانی سالانه |
| **ICLE** ( International Corpus of Learner English ) | ~۳ میلیون واژه | نوشته های زبان آموزان انگلیسی از ملیت های مختلف |
### کاربردهای پیکره شناسی
- **واژه نامه نویسی**: یافتن معانی و مثال های واقعی از کاربرد کلمات ( مانند فرهنگ های Collins، Oxford ) .
- **هم آیی ( Collocation ) **: تشخیص کلماتی که معمولاً با هم می آیند ( مثلاً *strong coffee* نه *powerful coffee* ) .
- **تحلیل گونه های زبانی ( Register variation ) **: مقایسه زبان گفتار و نوشتار، رسانه های مختلف.
- **زبان شناسی آموزشی**: بررسی خطاهای رایج زبان آموزان و تهیهٔ مواد درسی معتبر.
- **ترجمه و مطالعات تطبیقی**.
### تفاوت با زبان شناسی سنتی
| زبان شناسی سنتی ( شهودی ) | پیکره شناسی |
| - - - - - - - - - - - - - - - - - - - - - - - - | - - - - - - - - - - - - - |
| مبتنی بر قضاوت درونی زبان شناس | مبتنی بر داده های واقعی |
| جمله های ساخته شده و مثال های محدود | حجم زیاد داده، قابل تعمیم |
| تأکید بر دستور و شم زبانی | تأکید بر بسامد و الگوهای آماری |
### جمع بندی
**پیکره شناسی زبان** یک رویکرد تجربی و کمی به مطالعهٔ زبان است که با بهره گیری از مجموعه های بزرگ متون طبیعی ( ذخیره شده در رایانه ) و ابزارهای محاسباتی، به کشف الگوهای زبانی، معنایی و کاربردشناختی می پردازد. این رشته به طور گسترده در فرهنگ نویسی، تحلیل گفتمان، آموزش زبان و مطالعات ترجمه کاربرد دارد.

شاخه‏ ای از زبان شناسی که در آن با ایجاد بانک های اطلاعات گسترده به بررسی جنبه‏ های مختلف زبان می‏پردازد.
یک بانک اطلاعات بزرگ ( که امروزه در رایانه ذخیره میشود ) از مجموعه مکالمات و نوشته های مرتبط با یک زبان.
...
[مشاهده متن کامل]

به این معنی که برخی دانشگاه ها یا موسسات تحقیقاتی برای زبان شناسی، شناسایی کلمات و جملات پرکاربرد در یک زبان، آشنایی با اصطلاحات عامیانه و . . . . . اقدام به جمع کردن صحبت ها و نوشته ها از میان مردم، رسانه ها و . . . . کرده و این اطلاعات را جهت بررسی و استخراج نتیجه به ابرکامپیوترها داده و بر روی نتایج حاصله تحقیق و مطالعه می نمایند.

corpus linguistics ( زبان‏شناسی )
واژه مصوب: زبان‏شناسی پیکره‏ای
تعریف: شاخه‏ای از زبان شناسی که در آن با ایجاد پایگاه های داده‏ای گسترده به بررسی جنبه‏های مختلف زبان می‏پردازد