HPR4722: نمایش و گفتگو: کلیشه‌های هوش مصنوعی

به قلم Trollercoaster08/09/2026 às 00:00602 بازدید
Foto: CC BY-SA / Hacker Public Radio
🎙 Trollercoaster · Hacker Public Radio

این نمایش به عنوان محتوای صریح توسط میزبان علامت‌گذاری شده است.

به وضوح، من باید توضیح دهم که چرا بهترین شخص برای توضیح این مفهوم هستم و چگونه تحقیقاتم را انجام داده‌ام.

بعد از آن، به هسته اصلی قسمت می‌پردازم: تحقیقات.

راهنمای نهایی برای تشخیص متن تولید شده توسط هوش مصنوعی که هر نویسنده‌ای باید آن را بخواند.

آن عنوان دو نشانه دارد:

  • حالت عنوانهر کلمه با حروف بزرگ نوشته شده است، که به طور مناسب نمی‌توان آن را به صورت شفاهی خواند.
  • اغراقوعده نهایی بودن، برای یک پادکست ده دقیقه‌ای

برای بیشتر این قسمت، من خودم نیستم، من ماشین هستم، و هر جمله‌ای که می‌گویم نمونه‌ای از چیزی است که توصیف می‌کند. این صفحه کلید آن بخش از برنامه است: نشانه‌ها به ترتیب که می‌شنوید، با آنچه که در ضبط به نظر می‌رسند.

اکثر نام‌ها از tropes.fyi آمده‌اند، بنابراین می‌توانید آنها را آنجا جستجو کنید و توضیح طولانی‌تری بگیرید.

همانطور که در پادکست نیز ذکر شد: این خطاها نیستند. آنها عبارات معمولی زبانی هستند که نویسندگان انسانی قرن‌هاست از آنها استفاده می‌کنند. نشانه، چگالی است.

بخش اول: واژگان

  • واژگان اعتبارکلماتی که هیچ‌کس به‌صدا در نمی‌آورد. مثلاً: کاوش، بهره‌گیری، قوی، پرورش
  • اسم‌های بزرگ برای چیزهای عادیمثلاً: بافت، مناظر، قلمرو، اکوسیستم، الگو
  • حروف ربط جادوییمثلاً: به‌صورت پنهان، به‌طور اساسی، به‌طور بحث‌برانگیز، به‌طور شگفت‌انگیز
  • اجتناب از فعل "بودن"مثلاً: به‌عنوان خدمت‌کننده، به‌عنوان نمادی، به‌عنوان نشانه‌ای، به‌عنوان تعیین‌کننده
  • برچسب‌های مفهومی اختراع‌شدهیک مشکل انتزاعی (دام، نفوذ، پارادوکس، معکوس) که به یک کلمه دامنه متصل شده و سپس گویی که تثبیت شده است، استفاده می‌شود. مثلاً: "دام روان‌نمایی"، "نفوذ اعتبار".
  • نسبت‌های مبهمقدرت بدون نام. مثلاً: "کارشناسان موافقت می‌کنند"، "گزارش‌های صنعت نشان می‌دهد"، "ناظران متوجه شده‌اند".
  • استدلال به آشناییتوافق مدعی به جای اثبات شده. مثلاً: "کلاسیک"، "مشهوراً"، "همان‌طور که همه می‌دانیم".
  • ثبت تبلیغاتیتوصیف به فروش تبدیل می‌شود. مثلاً: "باز می‌کند"، "بی‌نقص"، "بی‌سابقه".

بخش دوم: شکل‌های جمله

  • موازی منفیالگوی "نه X، بلکه Y" و رایج‌ترین نوع آن. مثلاً: "این یک عادت سبک‌شناختی نیست، بلکه امضای ساختاری است."
  • نه X. نه Y. فقط Z.تکرار یک حرکت سه‌گانه، تنش را برای آشکاری‌ای که نیازی به آن نداشت، می‌سازد. مثلاً: "نه یک عادت. نه یک تیک. یک نشانه."
  • مجموعه‌های سه‌گانهیک مثلث سه‌گانه زیبا است، اما سه مثلث در کنار هم مثل سوزن گیر کرده است. مثلاً: "سه‌گانه می‌آید، سه‌گانه می‌نشیند، سه‌گانه خسته‌کننده است."
  • تکه‌های کوتاه و پرتنشتأکید ساختاری با نقطه‌گذاری کامل به جای کسب آن از محتوا. مثلاً: "کوتاه. موازی. بی‌امان."
  • سوالات خودپاسخ داده شده: سؤالی می‌پرسد که هیچ‌کس پرسیده نیست، بلافاصله به آن پاسخ می‌دهد. مثلاً "مشکل؟ هیچ‌کس پرسیده نیست."
  • آنافورا:: جمله‌ای مشابه را تکرار می‌کند تا به نوعی مبلمان شود. مثلاً "آنها جملات را به همان شیوه باز می‌کنند. آنها جمله بعدی را به همان شیوه باز می‌کنند."
  • تحلیل "-ing" پایی: معنا سطحی که به یک جمله کامل وصل شده است. مثلاً "تاکید بر اهمیت پایدار آن"، "بازتاب روندهای گسترده‌تر"
  • محدوده‌های نادرست: "از X تا Y" که مقیاسی وجود ندارد و میانه‌ای هم نیست. مثلاً "از زباله‌دان تا نقل قول"
  • پرکننده‌های انتقال: هیچ چیز را به هیچ چیز متصل نکنید. مثلاً "یادآوری می‌شود"، "مهم است"، "به طور قابل توجهی"
  • انعکاس تعجب: هر جمله در نیمه شکسته، صرف نظر از علامت نقطه‌گذاری. مثلاً دو نقطه، خط تیره دوگانه، جفت کاما، دو نقطه
  • دم بریده با کاما: یک عبارت کوتاه که به جای تکمیل موضوع، بر روی یک کاما آویزان شده است. مثلاً "بالای محتوا، و ذخیره کنید."

بخش سوم: لحن

  • هیجان مصنوعیرسانه‌ها در حال افزایش هستند، اما افشاگری نیست.
  • استعاره‌های تحقیرآمیزحالت معلمی، بدون دعوت.
  • زبان استعاری اجبارییک استعاره انتخاب شده برای هوشمندی به جای وضوح.
  • تورم اهمیتهمه چیز تاریخی است.
  • آسیب‌پذیری ساختگیصداقت اجرا شده، ریسک نشده.
  • ادعای جایگزین شواهدتاریخ در این نکته بی‌تفاوت نیست، شواهد واضح است
  • تصور کنید جهانی که...سخنرانی آینده‌نگرانه، نتایج خوشایند اگر فرضیه را بپذیرید.
  • جملات قابل نقلطعمه اسلاید که حتی وقتی خارج از متن اصلی گرفته می‌شود، باقی می‌ماند زیرا اصلاً در متن اصلی نداشت.
  • "ما" همکاری‌کنندهما هر کدام را به نوبت بررسی خواهیم کرد.
  • مدح و ستایشیک عبارت زبانی نیست، بلکه یک اثر آموزشی است و سریع‌ترین راه برای تشخیص خروجی خام چت‌بات.

بخش چهارم: قالب‌بندی

  • عناوین با حالت عنوانمراجعه به بالای این صفحه
  • لیست‌های نقطه‌ای جایی که متن نویسی مناسب است.این سند به یک مجموعه اسلاید تبدیل می‌شود.
  • **اخبار فوری:** یک زمین‌لرزه با شدت ۶.۵ ریشتر شهر تهران را لرزاند.**گزارش ویژه:** دولت ایران برنامه‌های خود را برای توسعه انرژی‌های تجدیدپذیر اعلام کرد.
  • **🚀 پیشرفت علمی:** محققان ایرانی در زمینه فناوری نانو دستاوردهای چشمگیری داشته‌اند.**🌟 رویداد فرهنگی:** جشنواره بین‌المللی فیلم تهران با حضور مهمانان بین‌المللی آغاز شد.
  • **— نقل قول —:** "این جشنواره فرصتی برای تبادل فرهنگی و هنری است." - وزیر فرهنگ و ارشاد اسلامی**🗣 مصاحبه:** در گفتگو با ما، یک کارشناس اقتصادی چشم‌انداز اقتصاد ایران را بررسی کرد.
  • **💡 نوآوری:** استارت‌آپ‌های ایرانی راه‌حل‌های خلاقانه‌ای برای مشکلات زیست‌محیطی ارائه می‌دهند.**📝 گزارش:** رسانه‌های محلی از افزایش گردشگری در مناطق روستایی خبر دادند.
  • تزئین یونیکدفلش و نقل قول‌های خمیده‌ای که کسی روی صفحه‌کلید تایپ نکرده است. مثلاً: ورودی → پردازش → خروجی
  • یک فکر در هر خطپاراگراف‌ها لغو شده‌اند. مثلاً: "این اتفاق افتاد. تنها. در یک سه‌شنبه."

بخش پنجم: ترکیب

  • اعلام و پاسخمی‌گوید که متن قرار است چه کاری انجام دهد به جای اینکه آن را انجام دهد. مثلاً: "این راهنما آنچه که آن علائم به نظر می‌رسند را بررسی خواهد کرد."
  • استعاره‌های تاریخی سریع‌السیرقدرت گرفته از لیستی، بدون استدلال زیرین. مثلاً "مارکونی. سونی. اپل. چاپ، رادیو، وب، موبایل."
  • استعاره‌ای که پایان نمی‌یابدمثلاً باغی که برای شش جمله باغ باقی می‌ماند، سپس به یک قطب شمال تبدیل می‌شود که سوزن را حرکت می‌دهد
  • خود انعکاسکلمه‌ای از قبل بازگشته به گونه‌ای که گویی پرداخت شده است، در حالی که همان واژگان تنگ محدوده دوباره ظاهر می‌شود
  • یک نقطه رقیق شدههمان ایده در پنج لایه، به گونه‌ای که شبیه پیشرفت است. مثلاً "به طور متفاوت بیان کنیم"، "بازگویی کنیم"، "به عبارت دیگر"
  • خلاصه‌های فراکتالهر بخش خود را خلاصه می‌کند، از جمله بخش فعلی که شما در آن هستید. مثلاً: "در این بخش ما درباره ترکیب بحث کردیم."
  • بند بازگشتیبا بازگشت به سوال اصلی، بسیار بعد از اینکه نکته مطرح شده، پایان می‌یابد. مثلاً: "بنابراین، برای پاسخ دادن به سوال شما..."
  • پذیرش و نادیده گرفتنبا وجود روان بودن، با چالش‌هایی که معمولاً در سیستم‌های خودکار وجود دارد مواجه است. با وجود آن چالش‌ها، آن دوام می‌آورد.
  • نتیجه‌گیری علامت‌گذاری شدهنوشتن توانا نیازی به اعلام پایان ندارد. مثلاً: "در نتیجه"، "به طور خلاصه"، "به طور خلاصه بیان کنم"
  • نتیجه‌گیری که تمایلی به پایان نیافتن نداردمتن هوش مصنوعی واقعی، در هر بار مرور، آرام‌تر و معنادارتر بود. مثلاً: "متن تولید شده توسط هوش مصنوعی واقعی، پاراگراف‌هایی بود که در طول راه از آن‌ها عبور کردیم."
  • قلاده‌های تعاملمثلاً: "آیا موافقید؟" همراه با یک اِموجی نشانگر.

مواردی از لیست که در قسمت این اپیزود جا نشدند.

ضبط می‌توانست تا چهل دقیقه طول بکشد. این‌ها به هر حال ارزش دانستن را دارند.

  • نشت منطقمتنی که تصمیمات خود را روایت می‌کند به جای اینکه فقط آن‌ها را بگیرد. مثلاً: "می‌خواهم در مورد نقش خودم در اینجا دقیق باشم."
  • انباشت فرضیهیک پاراگراف از شواهد در مقابل موضوع، بنابراین موضوع دو بار قبل از رسیدن آن بیان شده است.
  • شمارش اجباریبیان تعداد اقلام قبل از فهرست کردن آنها. مثلاً "پنج چیزی که می‌خواهیم بحث کنیم"
  • شمارش بیش از حدیک لیستیکل به شکل متن. مثلاً "دیوار اول... دیوار دوم..."
  • تأکید بر غیرضروریدفاع از یک نقطه کوچک در برابر اعتراض‌ای که هیچ‌کس قرار نبود مطرح کند
  • چرخاندن هم‌معنی‌ها: از تکرار یک اسم خودداری کردن. مثلاً داشبورد، سپس رابط کاربری، سپس دروازه، سپس مرکز آنالیتیکس.
  • سرصفحه‌ها: شکل پیش‌فرض‌ای که یک مدل هنگام نام‌گذاری یک بخش از آن استفاده می‌کند. مثلاً "معنای این چیست"، "چرا مهم است"
  • تکرار محتوا: همان پاراگراف دو بار تکرار می‌شود، زیرا مدل از آنچه نوشته بود، دنباله‌روی نکرد.

چرا این یک راهنمای تشخیصی نیست

لیانگ، یوکسه‌گونول، مائو، وو و زو، استنفورد، در ۱۰ ژوئیه ۲۰۲۳ در مجله «الگوها» (Cell Press) منتشر شد. هفت تشخیص‌دهنده تجاری GPT بر روی ۹۱ مقاله TOEFL نوشته شده توسط غیر بومی‌های انگلیسی و ۸۸ مقاله کلاس هشتم آمریکا اجرا شد.

  • نرخ متوسط اشتباهات مثبت در مقالات آزمون TOEFL: 61.3 درصد.
  • ۸۹ از ۹۱ مقاله به عنوان تولید شده توسط هوش مصنوعی توسط حداقل یک تشخیص دهنده علامت گذاری شدند. همه هفت در مورد ۱۸ مورد توافق داشتند.
  • مقالات کلاس هشتم آمریکا تقریباً کامل بودند. انتخاب کلمات ساده تر، پیچیدگی کمتر، شبیه ماشین به نظر می رسند.
  • ارسال مقالات TOEFL از طریق ChatGPT با پرسش "انتخاب کلمات را بهبود دهید تا شبیه یک گوینده بومی باشد" نرخ مثبت نادرست را به ۱۱.۶ درصد کاهش داد.

بنابراین راه جلوگیری از متهم شدن به نوشتن مانند یک ماشین، بازنویسی توسط یک ماشین بود. کلماتم را برای این نگیرید، مقاله دسترسی باز است:

اشاره کنندگان، برای واقعیت

  • با چیزهایی بنویسید: نام‌ها، تاریخ‌ها، قیمت‌ها، شماره مدل درایوی که خراب شده است.
  • چیزی بگویید که ماشینی راه دیگری برای دانستن آن ندارد، چون به شما اتفاق افتاده است.
  • آماده باشید تا اشتباه خود را به صدای بلند بگویید.
  • یک جمله عجیب نگه دارید که ویراستار شما آن را حذف می‌کند.

لینک‌ها و ارجاعات

  • فهرستی که این قسمت بر آن تکیه داشت: tropes.fyi توسط اسامه.است
  • مطالعه تشخیص‌دهنده: لیانگ و همکاران، «تشخیص‌دهنده‌های GPT علیه نویسندگان غیر بومی انگلیسی تعصب دارند»، الگوها، ۲۰۲۳
  • «نه معتاد»، انتخاب کِی، ۱۹۹۵. این یک عادت نیست، خنک است، زنده احساس می‌کنم.
  • دوستان، رومی‌ها، هم‌وطنان: «من می‌آیم تا سزار را دفن کنم، نه این که او را ستایش کنم»: شکسپیر، ژولیوس سزار، عمل ۳، صحنه ۲
  • «آمد، دید، فاتح شد»، عبارتی که به ژولیوس سزار از سوی سوتونیوس و پلوتارچ نسبت داده شده است.

به شما سپرده می‌شود.

بخش نظرات زیر این قسمت قرار دارد. به من بگویید کدام روایت را از دست داده‌اید و کدام یکی را مرتکب شده‌اید. بهتر است آن را ضبط کنید. پاراگراف بدترین و بیشترین صدای ماشینی خود را بلند کنید و آن را در رادیو عمومی هکرها ارسال کنید. صف همیشه گرسنه است.

Provide بازخورددر مورد این قسمت.

منبع
Hacker Public Radio
گشودن نسخه اصلی ↗

محتوا به‌صورت خودکار ماشینی ترجمه شده است.

این خبر مفید بود؟

بحث‌ها 0

نخستین مشارکت‌کننده در بحث باشید.

اطلاعات خود را به اشتراک بگذارید و استدلال خود را مطرح کنید

در انتشار اطلاعات یا داده‌های مفید تردید نکنید.

برای شرکت در بحث، وارد شوید یا حساب رایگان بسازید.