هوش مصنوعی و خطر خودخواری

پژوهشگران فناوری های نوین هشدار می دهند اینکه مدل های هوش مصنوعی به طور مکرر با دادههایی که خودشان تولید کردهاند آموزش ببینند یا به اصطلاح «خودخواری» کنند، به تولید محتوای به شدت نامنسجم منجر خواهد شد و این در آینده چالش برانگیز خواهد بود.
به گزارش اقتصاد ما به نقل از خبرگزاری فرانسه از پاریس، مدلهایی که زیربنای ابزارهای هوش مصنوعی مولد مانند ChatGPT هستند و میتوانند انواع مختلف محتوا را با یک درخواست ساده به زبان طبیعی تولید کنند، نیاز به آموزش روی حجم عظیمی از دادهها دارند. دادههایی که اغلب از وب جمعآوری میشوند و وب پر از تصاویر و متنهایی است که توسط هوش مصنوعی ایجاد شدهاند.
این به اصطلاح «خودخواری»، یعنی جایی که هوش مصنوعی از هوش مصنوعی تغذیه میکند، منجر به فروپاشی مدلها میشود. مدلها ابتدا پاسخهایی کمتر و کمتر اصیل و مرتبط تولید میکنند و در نهایت به پاسخهایی بیمعنی میرسند. این نتیجهای است که در اواخر ماه ژوئیه در مجله علمی نیچر Nature منتشر شده است.
به طور مشخص، با استفاده از این نوع دادهها که به دلیل تولید شدن توسط ماشینها، «دادههای مصنوعی» نامیده میشوند، نمونهای که مدلهای هوش مصنوعی برای ارائه پاسخهای خود از آن استفاده میکنند، از نظر غنا کاهش مییابد. این مانند کپی کردن یک تصویر اسکنشده و سپس چاپ مجدد آن است. با هر بار چاپ، کیفیت نتیجه کاهش مییابد تا جایی که غیرقابل خواندن میشود.
محققان دانشگاههای رایس و استنفورد آمریکا نیز با مطالعه مدلهای تولیدکننده تصویر از جمله Midjourney، Dall-E و Stable Diffusion به همین نتیجه رسیدهاند. آنها نشان دادند که تصاویر تولیدشده به مرور زمان رایجتر میشوند و به تدریج پر از عناصر نامتناسب میشوند، بهخصوص هر چه دادههای «مصنوعی» بیشتری به مدل اضافه کنند. آنها این پدیده را با بیماری «جنون گاوی» مقایسه کردند.
این بیماری که در انگلیس ظاهر شد، منشا آن استفاده از آرد حیوانی برای تغذیه گاوها بود که از قسمتهای مصرف نشده لاشه گاوها و لاشه حیوانات آلوده به دست میآمد.
شرکتهای فعال در حوزه هوش مصنوعی با این حال اغلب از «دادههای مصنوعی» برای آموزش برنامههای خود استفاده میکنند؛ زیرا به راحتی در دسترس هستند، فراواناند و نسبت به دادههای تولید شده توسط انسان هزینه کمتری دارند.
جثان سادوسکی، محقق فناوریهای نوین در دانشگاه موناش استرالیا، به خبرگزاری فرانسه گفت: «منابع دادههای انسانی دست نخورده، باکیفیت و قابل خوانش توسط ماشینها به شدت کاهشیافته است.»
ریچارد بارانیوک، یکی از نویسندگان مقاله دانشگاه رایس، در بیانیهای هشدار داد: «بدون هیچ کنترلی در طول چندین نسل، یک سناریوی فاجعهآمیز این است که سندرم فروپاشی مدلها، کیفیت و تنوع دادهها را برای کل اینترنت مسموم کند.»
به گفته این دانشمندان، درست همانطور که بحران جنون گاوی در دهه 1990 صنعت گوشت را فلج کرد، اینترنت پر از محتوای تولید شده توسط هوش مصنوعی و مدلهایی که «دیوانه» شدهاند، میتواند آینده صنعت هوش مصنوعی رو به رشدی را که میلیاردها دلار ارزش دارد، تهدید کند.
جثان سادوسکی میگوید: «سؤال اصلی برای محققان و شرکتهایی که سیستمهای هوش مصنوعی را میسازند این است که از چه زمانی استفاده از دادههای مصنوعی بیش از حد میشود؟»
اما برخی دیگر از متخصصان این مشکل را اغراقآمیز و دور از ذهن میدانند.
مسئولان و مدیران شرکت های Anthropic و Hugging Face، دو شرکت پیشرو در زمینه هوش مصنوعی، در مصاحبه با خبرگزاری فرانسه تایید کردند که از دادههای تولید شده توسط هوش مصنوعی استفاده میکنند.
آنتون لوژکوف، مهندس یادگیری ماشین در Hugging Face، میگوید مقاله مجله نیچر یک دیدگاه نظری جالب است؛ اما برای او چندان واقعبینانه نیست.