First Initialization

This commit is contained in:
aliakbar
2026-06-29 15:32:24 +03:30
commit 29c2add74e
105 changed files with 13177 additions and 0 deletions
@@ -0,0 +1,11 @@
proposition_id,sentence,proposition_text
1,از این رو، قبل از پردازش برروی داده¬ها نیازمند به یک پیش¬پردازش جهت آماده¬سازی داده¬ها خواهیم داشت. کاهش نمونه یا الگوریتم انتخاب نمونه یکی از پرکاربرد ترین روش های پیش پردازش داده در زمینه¬ی داده کاوی است که به عنوان صافی یا فیلتر داده در مرحله¬ی پیش پردازش عمل می¬نماید، و مجموعه¬ی یادگیری را قبل از اجرای فرایند یادگیری ماشین جهت پیشگویی، هرس می¬کند [10]. در اکثر روش¬های کاهش داده، اولویت حذف با نمونه¬های نویزی، تکراری و بی¬اهمیت است، به این صورت که یک مجموعه¬داده با اسم T داریم که روی آن الگوریتم انتخاب نمونه اعمال شده تا مقدار زیادی نمونه¬ها که ترجیحاً نویزی و بی¬اهمیت باشند را از آن کم کند، در نتیجه، یک زیرمجموعه¬ی کوچک¬تر و خالص¬تر با اسم S را به عنوان خروجی فراهم نموده است که مقدار زیادی داده از آن کم شده و نمونه های نویزی و اضافی نیز در آن به حداقل رسیده است,قبل از پردازش داده‌ها نیاز به پیش‌پردازش برای آماده‌سازی آن‌ها است
2,از این رو، قبل از پردازش برروی داده¬ها نیازمند به یک پیش¬پردازش جهت آماده¬سازی داده¬ها خواهیم داشت. کاهش نمونه یا الگوریتم انتخاب نمونه یکی از پرکاربرد ترین روش های پیش پردازش داده در زمینه¬ی داده کاوی است که به عنوان صافی یا فیلتر داده در مرحله¬ی پیش پردازش عمل می¬نماید، و مجموعه¬ی یادگیری را قبل از اجرای فرایند یادگیری ماشین جهت پیشگویی، هرس می¬کند [10]. در اکثر روش¬های کاهش داده، اولویت حذف با نمونه¬های نویزی، تکراری و بی¬اهمیت است، به این صورت که یک مجموعه¬داده با اسم T داریم که روی آن الگوریتم انتخاب نمونه اعمال شده تا مقدار زیادی نمونه¬ها که ترجیحاً نویزی و بی¬اهمیت باشند را از آن کم کند، در نتیجه، یک زیرمجموعه¬ی کوچک¬تر و خالص¬تر با اسم S را به عنوان خروجی فراهم نموده است که مقدار زیادی داده از آن کم شده و نمونه های نویزی و اضافی نیز در آن به حداقل رسیده است,کاهش نمونه یا الگوریتم انتخاب نمونه یکی از پرکاربردترین روش‌های پیش‌پردازش داده در زمینه داده‌کاوی است
3,از این رو، قبل از پردازش برروی داده¬ها نیازمند به یک پیش¬پردازش جهت آماده¬سازی داده¬ها خواهیم داشت. کاهش نمونه یا الگوریتم انتخاب نمونه یکی از پرکاربرد ترین روش های پیش پردازش داده در زمینه¬ی داده کاوی است که به عنوان صافی یا فیلتر داده در مرحله¬ی پیش پردازش عمل می¬نماید، و مجموعه¬ی یادگیری را قبل از اجرای فرایند یادگیری ماشین جهت پیشگویی، هرس می¬کند [10]. در اکثر روش¬های کاهش داده، اولویت حذف با نمونه¬های نویزی، تکراری و بی¬اهمیت است، به این صورت که یک مجموعه¬داده با اسم T داریم که روی آن الگوریتم انتخاب نمونه اعمال شده تا مقدار زیادی نمونه¬ها که ترجیحاً نویزی و بی¬اهمیت باشند را از آن کم کند، در نتیجه، یک زیرمجموعه¬ی کوچک¬تر و خالص¬تر با اسم S را به عنوان خروجی فراهم نموده است که مقدار زیادی داده از آن کم شده و نمونه های نویزی و اضافی نیز در آن به حداقل رسیده است,این روش به عنوان صافی یا فیلتر داده در مرحله پیش‌پردازش عمل می‌کند
4,از این رو، قبل از پردازش برروی داده¬ها نیازمند به یک پیش¬پردازش جهت آماده¬سازی داده¬ها خواهیم داشت. کاهش نمونه یا الگوریتم انتخاب نمونه یکی از پرکاربرد ترین روش های پیش پردازش داده در زمینه¬ی داده کاوی است که به عنوان صافی یا فیلتر داده در مرحله¬ی پیش پردازش عمل می¬نماید، و مجموعه¬ی یادگیری را قبل از اجرای فرایند یادگیری ماشین جهت پیشگویی، هرس می¬کند [10]. در اکثر روش¬های کاهش داده، اولویت حذف با نمونه¬های نویزی، تکراری و بی¬اهمیت است، به این صورت که یک مجموعه¬داده با اسم T داریم که روی آن الگوریتم انتخاب نمونه اعمال شده تا مقدار زیادی نمونه¬ها که ترجیحاً نویزی و بی¬اهمیت باشند را از آن کم کند، در نتیجه، یک زیرمجموعه¬ی کوچک¬تر و خالص¬تر با اسم S را به عنوان خروجی فراهم نموده است که مقدار زیادی داده از آن کم شده و نمونه های نویزی و اضافی نیز در آن به حداقل رسیده است,این روش مجموعه یادگیری را قبل از اجرای فرایند یادگیری ماشین جهت پیشگویی هرس می‌کند
5,از این رو، قبل از پردازش برروی داده¬ها نیازمند به یک پیش¬پردازش جهت آماده¬سازی داده¬ها خواهیم داشت. کاهش نمونه یا الگوریتم انتخاب نمونه یکی از پرکاربرد ترین روش های پیش پردازش داده در زمینه¬ی داده کاوی است که به عنوان صافی یا فیلتر داده در مرحله¬ی پیش پردازش عمل می¬نماید، و مجموعه¬ی یادگیری را قبل از اجرای فرایند یادگیری ماشین جهت پیشگویی، هرس می¬کند [10]. در اکثر روش¬های کاهش داده، اولویت حذف با نمونه¬های نویزی، تکراری و بی¬اهمیت است، به این صورت که یک مجموعه¬داده با اسم T داریم که روی آن الگوریتم انتخاب نمونه اعمال شده تا مقدار زیادی نمونه¬ها که ترجیحاً نویزی و بی¬اهمیت باشند را از آن کم کند، در نتیجه، یک زیرمجموعه¬ی کوچک¬تر و خالص¬تر با اسم S را به عنوان خروجی فراهم نموده است که مقدار زیادی داده از آن کم شده و نمونه های نویزی و اضافی نیز در آن به حداقل رسیده است,در اکثر روش‌های کاهش داده، اولویت حذف با نمونه‌های نویزی، تکراری و بی‌اهمیت است
6,از این رو، قبل از پردازش برروی داده¬ها نیازمند به یک پیش¬پردازش جهت آماده¬سازی داده¬ها خواهیم داشت. کاهش نمونه یا الگوریتم انتخاب نمونه یکی از پرکاربرد ترین روش های پیش پردازش داده در زمینه¬ی داده کاوی است که به عنوان صافی یا فیلتر داده در مرحله¬ی پیش پردازش عمل می¬نماید، و مجموعه¬ی یادگیری را قبل از اجرای فرایند یادگیری ماشین جهت پیشگویی، هرس می¬کند [10]. در اکثر روش¬های کاهش داده، اولویت حذف با نمونه¬های نویزی، تکراری و بی¬اهمیت است، به این صورت که یک مجموعه¬داده با اسم T داریم که روی آن الگوریتم انتخاب نمونه اعمال شده تا مقدار زیادی نمونه¬ها که ترجیحاً نویزی و بی¬اهمیت باشند را از آن کم کند، در نتیجه، یک زیرمجموعه¬ی کوچک¬تر و خالص¬تر با اسم S را به عنوان خروجی فراهم نموده است که مقدار زیادی داده از آن کم شده و نمونه های نویزی و اضافی نیز در آن به حداقل رسیده است,یک مجموعه‌داده با نام T داریم که روی آن الگوریتم انتخاب نمونه اعمال شده است
7,از این رو، قبل از پردازش برروی داده¬ها نیازمند به یک پیش¬پردازش جهت آماده¬سازی داده¬ها خواهیم داشت. کاهش نمونه یا الگوریتم انتخاب نمونه یکی از پرکاربرد ترین روش های پیش پردازش داده در زمینه¬ی داده کاوی است که به عنوان صافی یا فیلتر داده در مرحله¬ی پیش پردازش عمل می¬نماید، و مجموعه¬ی یادگیری را قبل از اجرای فرایند یادگیری ماشین جهت پیشگویی، هرس می¬کند [10]. در اکثر روش¬های کاهش داده، اولویت حذف با نمونه¬های نویزی، تکراری و بی¬اهمیت است، به این صورت که یک مجموعه¬داده با اسم T داریم که روی آن الگوریتم انتخاب نمونه اعمال شده تا مقدار زیادی نمونه¬ها که ترجیحاً نویزی و بی¬اهمیت باشند را از آن کم کند، در نتیجه، یک زیرمجموعه¬ی کوچک¬تر و خالص¬تر با اسم S را به عنوان خروجی فراهم نموده است که مقدار زیادی داده از آن کم شده و نمونه های نویزی و اضافی نیز در آن به حداقل رسیده است,الگوریتم انتخاب نمونه مقدار زیادی نمونه ترجیحاً نویزی و بی‌اهمیت را از مجموعه T کم می‌کند
8,از این رو، قبل از پردازش برروی داده¬ها نیازمند به یک پیش¬پردازش جهت آماده¬سازی داده¬ها خواهیم داشت. کاهش نمونه یا الگوریتم انتخاب نمونه یکی از پرکاربرد ترین روش های پیش پردازش داده در زمینه¬ی داده کاوی است که به عنوان صافی یا فیلتر داده در مرحله¬ی پیش پردازش عمل می¬نماید، و مجموعه¬ی یادگیری را قبل از اجرای فرایند یادگیری ماشین جهت پیشگویی، هرس می¬کند [10]. در اکثر روش¬های کاهش داده، اولویت حذف با نمونه¬های نویزی، تکراری و بی¬اهمیت است، به این صورت که یک مجموعه¬داده با اسم T داریم که روی آن الگوریتم انتخاب نمونه اعمال شده تا مقدار زیادی نمونه¬ها که ترجیحاً نویزی و بی¬اهمیت باشند را از آن کم کند، در نتیجه، یک زیرمجموعه¬ی کوچک¬تر و خالص¬تر با اسم S را به عنوان خروجی فراهم نموده است که مقدار زیادی داده از آن کم شده و نمونه های نویزی و اضافی نیز در آن به حداقل رسیده است,یک زیرمجموعه کوچک‌تر و خالص‌تر با نام S به عنوان خروجی فراهم می‌شود
9,از این رو، قبل از پردازش برروی داده¬ها نیازمند به یک پیش¬پردازش جهت آماده¬سازی داده¬ها خواهیم داشت. کاهش نمونه یا الگوریتم انتخاب نمونه یکی از پرکاربرد ترین روش های پیش پردازش داده در زمینه¬ی داده کاوی است که به عنوان صافی یا فیلتر داده در مرحله¬ی پیش پردازش عمل می¬نماید، و مجموعه¬ی یادگیری را قبل از اجرای فرایند یادگیری ماشین جهت پیشگویی، هرس می¬کند [10]. در اکثر روش¬های کاهش داده، اولویت حذف با نمونه¬های نویزی، تکراری و بی¬اهمیت است، به این صورت که یک مجموعه¬داده با اسم T داریم که روی آن الگوریتم انتخاب نمونه اعمال شده تا مقدار زیادی نمونه¬ها که ترجیحاً نویزی و بی¬اهمیت باشند را از آن کم کند، در نتیجه، یک زیرمجموعه¬ی کوچک¬تر و خالص¬تر با اسم S را به عنوان خروجی فراهم نموده است که مقدار زیادی داده از آن کم شده و نمونه های نویزی و اضافی نیز در آن به حداقل رسیده است,در خروجی S مقدار زیادی داده از مجموعه اولیه کم شده است
10,از این رو، قبل از پردازش برروی داده¬ها نیازمند به یک پیش¬پردازش جهت آماده¬سازی داده¬ها خواهیم داشت. کاهش نمونه یا الگوریتم انتخاب نمونه یکی از پرکاربرد ترین روش های پیش پردازش داده در زمینه¬ی داده کاوی است که به عنوان صافی یا فیلتر داده در مرحله¬ی پیش پردازش عمل می¬نماید، و مجموعه¬ی یادگیری را قبل از اجرای فرایند یادگیری ماشین جهت پیشگویی، هرس می¬کند [10]. در اکثر روش¬های کاهش داده، اولویت حذف با نمونه¬های نویزی، تکراری و بی¬اهمیت است، به این صورت که یک مجموعه¬داده با اسم T داریم که روی آن الگوریتم انتخاب نمونه اعمال شده تا مقدار زیادی نمونه¬ها که ترجیحاً نویزی و بی¬اهمیت باشند را از آن کم کند، در نتیجه، یک زیرمجموعه¬ی کوچک¬تر و خالص¬تر با اسم S را به عنوان خروجی فراهم نموده است که مقدار زیادی داده از آن کم شده و نمونه های نویزی و اضافی نیز در آن به حداقل رسیده است,در خروجی S نمونه‌های نویزی و اضافی به حداقل رسیده است
1 proposition_id sentence proposition_text
2 1 از این رو، قبل از پردازش برروی داده¬ها نیازمند به یک پیش¬پردازش جهت آماده¬سازی داده¬ها خواهیم داشت. کاهش نمونه یا الگوریتم انتخاب نمونه یکی از پرکاربرد ترین روش های پیش پردازش داده در زمینه¬ی داده کاوی است که به عنوان صافی یا فیلتر داده در مرحله¬ی پیش پردازش عمل می¬نماید، و مجموعه¬ی یادگیری را قبل از اجرای فرایند یادگیری ماشین جهت پیشگویی، هرس می¬کند [10]. در اکثر روش¬های کاهش داده، اولویت حذف با نمونه¬های نویزی، تکراری و بی¬اهمیت است، به این صورت که یک مجموعه¬داده با اسم T داریم که روی آن الگوریتم انتخاب نمونه اعمال شده تا مقدار زیادی نمونه¬ها که ترجیحاً نویزی و بی¬اهمیت باشند را از آن کم کند، در نتیجه، یک زیرمجموعه¬ی کوچک¬تر و خالص¬تر با اسم S را به عنوان خروجی فراهم نموده است که مقدار زیادی داده از آن کم شده و نمونه های نویزی و اضافی نیز در آن به حداقل رسیده است قبل از پردازش داده‌ها نیاز به پیش‌پردازش برای آماده‌سازی آن‌ها است
3 2 از این رو، قبل از پردازش برروی داده¬ها نیازمند به یک پیش¬پردازش جهت آماده¬سازی داده¬ها خواهیم داشت. کاهش نمونه یا الگوریتم انتخاب نمونه یکی از پرکاربرد ترین روش های پیش پردازش داده در زمینه¬ی داده کاوی است که به عنوان صافی یا فیلتر داده در مرحله¬ی پیش پردازش عمل می¬نماید، و مجموعه¬ی یادگیری را قبل از اجرای فرایند یادگیری ماشین جهت پیشگویی، هرس می¬کند [10]. در اکثر روش¬های کاهش داده، اولویت حذف با نمونه¬های نویزی، تکراری و بی¬اهمیت است، به این صورت که یک مجموعه¬داده با اسم T داریم که روی آن الگوریتم انتخاب نمونه اعمال شده تا مقدار زیادی نمونه¬ها که ترجیحاً نویزی و بی¬اهمیت باشند را از آن کم کند، در نتیجه، یک زیرمجموعه¬ی کوچک¬تر و خالص¬تر با اسم S را به عنوان خروجی فراهم نموده است که مقدار زیادی داده از آن کم شده و نمونه های نویزی و اضافی نیز در آن به حداقل رسیده است کاهش نمونه یا الگوریتم انتخاب نمونه یکی از پرکاربردترین روش‌های پیش‌پردازش داده در زمینه داده‌کاوی است
4 3 از این رو، قبل از پردازش برروی داده¬ها نیازمند به یک پیش¬پردازش جهت آماده¬سازی داده¬ها خواهیم داشت. کاهش نمونه یا الگوریتم انتخاب نمونه یکی از پرکاربرد ترین روش های پیش پردازش داده در زمینه¬ی داده کاوی است که به عنوان صافی یا فیلتر داده در مرحله¬ی پیش پردازش عمل می¬نماید، و مجموعه¬ی یادگیری را قبل از اجرای فرایند یادگیری ماشین جهت پیشگویی، هرس می¬کند [10]. در اکثر روش¬های کاهش داده، اولویت حذف با نمونه¬های نویزی، تکراری و بی¬اهمیت است، به این صورت که یک مجموعه¬داده با اسم T داریم که روی آن الگوریتم انتخاب نمونه اعمال شده تا مقدار زیادی نمونه¬ها که ترجیحاً نویزی و بی¬اهمیت باشند را از آن کم کند، در نتیجه، یک زیرمجموعه¬ی کوچک¬تر و خالص¬تر با اسم S را به عنوان خروجی فراهم نموده است که مقدار زیادی داده از آن کم شده و نمونه های نویزی و اضافی نیز در آن به حداقل رسیده است این روش به عنوان صافی یا فیلتر داده در مرحله پیش‌پردازش عمل می‌کند
5 4 از این رو، قبل از پردازش برروی داده¬ها نیازمند به یک پیش¬پردازش جهت آماده¬سازی داده¬ها خواهیم داشت. کاهش نمونه یا الگوریتم انتخاب نمونه یکی از پرکاربرد ترین روش های پیش پردازش داده در زمینه¬ی داده کاوی است که به عنوان صافی یا فیلتر داده در مرحله¬ی پیش پردازش عمل می¬نماید، و مجموعه¬ی یادگیری را قبل از اجرای فرایند یادگیری ماشین جهت پیشگویی، هرس می¬کند [10]. در اکثر روش¬های کاهش داده، اولویت حذف با نمونه¬های نویزی، تکراری و بی¬اهمیت است، به این صورت که یک مجموعه¬داده با اسم T داریم که روی آن الگوریتم انتخاب نمونه اعمال شده تا مقدار زیادی نمونه¬ها که ترجیحاً نویزی و بی¬اهمیت باشند را از آن کم کند، در نتیجه، یک زیرمجموعه¬ی کوچک¬تر و خالص¬تر با اسم S را به عنوان خروجی فراهم نموده است که مقدار زیادی داده از آن کم شده و نمونه های نویزی و اضافی نیز در آن به حداقل رسیده است این روش مجموعه یادگیری را قبل از اجرای فرایند یادگیری ماشین جهت پیشگویی هرس می‌کند
6 5 از این رو، قبل از پردازش برروی داده¬ها نیازمند به یک پیش¬پردازش جهت آماده¬سازی داده¬ها خواهیم داشت. کاهش نمونه یا الگوریتم انتخاب نمونه یکی از پرکاربرد ترین روش های پیش پردازش داده در زمینه¬ی داده کاوی است که به عنوان صافی یا فیلتر داده در مرحله¬ی پیش پردازش عمل می¬نماید، و مجموعه¬ی یادگیری را قبل از اجرای فرایند یادگیری ماشین جهت پیشگویی، هرس می¬کند [10]. در اکثر روش¬های کاهش داده، اولویت حذف با نمونه¬های نویزی، تکراری و بی¬اهمیت است، به این صورت که یک مجموعه¬داده با اسم T داریم که روی آن الگوریتم انتخاب نمونه اعمال شده تا مقدار زیادی نمونه¬ها که ترجیحاً نویزی و بی¬اهمیت باشند را از آن کم کند، در نتیجه، یک زیرمجموعه¬ی کوچک¬تر و خالص¬تر با اسم S را به عنوان خروجی فراهم نموده است که مقدار زیادی داده از آن کم شده و نمونه های نویزی و اضافی نیز در آن به حداقل رسیده است در اکثر روش‌های کاهش داده، اولویت حذف با نمونه‌های نویزی، تکراری و بی‌اهمیت است
7 6 از این رو، قبل از پردازش برروی داده¬ها نیازمند به یک پیش¬پردازش جهت آماده¬سازی داده¬ها خواهیم داشت. کاهش نمونه یا الگوریتم انتخاب نمونه یکی از پرکاربرد ترین روش های پیش پردازش داده در زمینه¬ی داده کاوی است که به عنوان صافی یا فیلتر داده در مرحله¬ی پیش پردازش عمل می¬نماید، و مجموعه¬ی یادگیری را قبل از اجرای فرایند یادگیری ماشین جهت پیشگویی، هرس می¬کند [10]. در اکثر روش¬های کاهش داده، اولویت حذف با نمونه¬های نویزی، تکراری و بی¬اهمیت است، به این صورت که یک مجموعه¬داده با اسم T داریم که روی آن الگوریتم انتخاب نمونه اعمال شده تا مقدار زیادی نمونه¬ها که ترجیحاً نویزی و بی¬اهمیت باشند را از آن کم کند، در نتیجه، یک زیرمجموعه¬ی کوچک¬تر و خالص¬تر با اسم S را به عنوان خروجی فراهم نموده است که مقدار زیادی داده از آن کم شده و نمونه های نویزی و اضافی نیز در آن به حداقل رسیده است یک مجموعه‌داده با نام T داریم که روی آن الگوریتم انتخاب نمونه اعمال شده است
8 7 از این رو، قبل از پردازش برروی داده¬ها نیازمند به یک پیش¬پردازش جهت آماده¬سازی داده¬ها خواهیم داشت. کاهش نمونه یا الگوریتم انتخاب نمونه یکی از پرکاربرد ترین روش های پیش پردازش داده در زمینه¬ی داده کاوی است که به عنوان صافی یا فیلتر داده در مرحله¬ی پیش پردازش عمل می¬نماید، و مجموعه¬ی یادگیری را قبل از اجرای فرایند یادگیری ماشین جهت پیشگویی، هرس می¬کند [10]. در اکثر روش¬های کاهش داده، اولویت حذف با نمونه¬های نویزی، تکراری و بی¬اهمیت است، به این صورت که یک مجموعه¬داده با اسم T داریم که روی آن الگوریتم انتخاب نمونه اعمال شده تا مقدار زیادی نمونه¬ها که ترجیحاً نویزی و بی¬اهمیت باشند را از آن کم کند، در نتیجه، یک زیرمجموعه¬ی کوچک¬تر و خالص¬تر با اسم S را به عنوان خروجی فراهم نموده است که مقدار زیادی داده از آن کم شده و نمونه های نویزی و اضافی نیز در آن به حداقل رسیده است الگوریتم انتخاب نمونه مقدار زیادی نمونه ترجیحاً نویزی و بی‌اهمیت را از مجموعه T کم می‌کند
9 8 از این رو، قبل از پردازش برروی داده¬ها نیازمند به یک پیش¬پردازش جهت آماده¬سازی داده¬ها خواهیم داشت. کاهش نمونه یا الگوریتم انتخاب نمونه یکی از پرکاربرد ترین روش های پیش پردازش داده در زمینه¬ی داده کاوی است که به عنوان صافی یا فیلتر داده در مرحله¬ی پیش پردازش عمل می¬نماید، و مجموعه¬ی یادگیری را قبل از اجرای فرایند یادگیری ماشین جهت پیشگویی، هرس می¬کند [10]. در اکثر روش¬های کاهش داده، اولویت حذف با نمونه¬های نویزی، تکراری و بی¬اهمیت است، به این صورت که یک مجموعه¬داده با اسم T داریم که روی آن الگوریتم انتخاب نمونه اعمال شده تا مقدار زیادی نمونه¬ها که ترجیحاً نویزی و بی¬اهمیت باشند را از آن کم کند، در نتیجه، یک زیرمجموعه¬ی کوچک¬تر و خالص¬تر با اسم S را به عنوان خروجی فراهم نموده است که مقدار زیادی داده از آن کم شده و نمونه های نویزی و اضافی نیز در آن به حداقل رسیده است یک زیرمجموعه کوچک‌تر و خالص‌تر با نام S به عنوان خروجی فراهم می‌شود
10 9 از این رو، قبل از پردازش برروی داده¬ها نیازمند به یک پیش¬پردازش جهت آماده¬سازی داده¬ها خواهیم داشت. کاهش نمونه یا الگوریتم انتخاب نمونه یکی از پرکاربرد ترین روش های پیش پردازش داده در زمینه¬ی داده کاوی است که به عنوان صافی یا فیلتر داده در مرحله¬ی پیش پردازش عمل می¬نماید، و مجموعه¬ی یادگیری را قبل از اجرای فرایند یادگیری ماشین جهت پیشگویی، هرس می¬کند [10]. در اکثر روش¬های کاهش داده، اولویت حذف با نمونه¬های نویزی، تکراری و بی¬اهمیت است، به این صورت که یک مجموعه¬داده با اسم T داریم که روی آن الگوریتم انتخاب نمونه اعمال شده تا مقدار زیادی نمونه¬ها که ترجیحاً نویزی و بی¬اهمیت باشند را از آن کم کند، در نتیجه، یک زیرمجموعه¬ی کوچک¬تر و خالص¬تر با اسم S را به عنوان خروجی فراهم نموده است که مقدار زیادی داده از آن کم شده و نمونه های نویزی و اضافی نیز در آن به حداقل رسیده است در خروجی S مقدار زیادی داده از مجموعه اولیه کم شده است
11 10 از این رو، قبل از پردازش برروی داده¬ها نیازمند به یک پیش¬پردازش جهت آماده¬سازی داده¬ها خواهیم داشت. کاهش نمونه یا الگوریتم انتخاب نمونه یکی از پرکاربرد ترین روش های پیش پردازش داده در زمینه¬ی داده کاوی است که به عنوان صافی یا فیلتر داده در مرحله¬ی پیش پردازش عمل می¬نماید، و مجموعه¬ی یادگیری را قبل از اجرای فرایند یادگیری ماشین جهت پیشگویی، هرس می¬کند [10]. در اکثر روش¬های کاهش داده، اولویت حذف با نمونه¬های نویزی، تکراری و بی¬اهمیت است، به این صورت که یک مجموعه¬داده با اسم T داریم که روی آن الگوریتم انتخاب نمونه اعمال شده تا مقدار زیادی نمونه¬ها که ترجیحاً نویزی و بی¬اهمیت باشند را از آن کم کند، در نتیجه، یک زیرمجموعه¬ی کوچک¬تر و خالص¬تر با اسم S را به عنوان خروجی فراهم نموده است که مقدار زیادی داده از آن کم شده و نمونه های نویزی و اضافی نیز در آن به حداقل رسیده است در خروجی S نمونه‌های نویزی و اضافی به حداقل رسیده است