message-test English

افزونهٔ Claude Code · سه ابزار سنجش

آزمون پیام: خواننده در عمل چه چیزی برداشت می‌کند؟

نمرهٔ خوانایی می‌گوید خواندن یک متن چقدر سخت است. اینکه خواننده سرِ آخر همان چیزی را برداشته که منظور شما بوده، حرف دیگری است. وقتی قرار است سندی پای یک تصمیم بایستد، فقط همین دومی مهم است.

اجرای ۲۳ تیر ۱۴۰۵، ساعت ۱۴:۰۲ فایل board-deck.pptx به pdf تبدیل شد خواننده: عضو هیئت‌مدیره، ۱۱ دقیقه وقت، سند اصلی را نخوانده

شاخص شفافیت زیر حد قبولی

۷۸ از ۱۰۰

۱۸ گویه نمره خورد، ۲ گویه چون موردی نداشت کنار گذاشته شد.

آزمون خواننده یک مورد غلط

۳ رسیده

۱ نرسیده، ۱ غلط، از کلید پنج‌بندی که از سند منبع درآمده بود.

غلط: تصور کرده پایلوت هر پنج کشور را می‌گیرد.
ساخته: «هر ایرادی خودکار رفع می‌شود.» چنین چیزی در سند نیست؛ اسلاید ۲ با نگفتنِ محدودیت همین را القا می‌کند.

آزمون کلوز اجرا نشد

تا وقتی شاخص شفافیت قبول نشود کنار می‌ماند. خوانندهٔ واقعی گران‌ترین ابزار این مجموعه است و این پیش‌نویس وقتشان را هدر می‌دهد.

گزارش یک اجرا، تقریباً همان‌طور که برمی‌گردد. نمره کم‌اهمیت‌ترین سطر آن است.

ابزارها

سه آزمون، به ترتیب هزینه‌ای که برایتان دارند

هر کدام سؤالی باریک‌تر از قبلی می‌پرسد و گران‌تر تمام می‌شود. از بالا شروع کنید و هر جا جواب گفت برو بازنویسی کن، همان‌جا بایستید.

  • شاخص شفافیت

    یک مدل · حدود ۱۵ دقیقه · رایگان

    بیست گویه، هر کدام یک نمره، تبدیل‌شده به ۱۰۰. پیام اصلی هست و بدون گشتن پیدا می‌شود؟ گفته شده خواننده باید چه کار کند؟ عددها به درد استفاده می‌خورند؟ کنار هر ریسک، احتمالش هم آمده؟

    قبولی از ۹۰ به بالا.

    هر جا شک دارید صفر بدهید. مدلی که سندِ خودش را نمره می‌دهد دست‌ودل‌باز می‌شود، پس برای هر نمره‌ای که می‌دهید باید همان جمله‌ای را بیاورید که آن نمره را گرفته است.

    قبولی یعنی موانع شناخته‌شده سرِ راه نیستند. یعنی کسی چیزی فهمیده باشد، نه.

  • آزمون خواننده

    یک مدل، در انزوا · چند دقیقه · تقریباً رایگان

    اول بنویسید خواننده باید با چه چیزی از این سند بیرون بیاید. بعد سند را، و هیچ چیز دیگری را، به کسی بدهید که تا حالا ندیده‌اش. جوابش را مقابل کلید بگذارید: رسیده، نرسیده، غلط.

    حد قبولی ندارد. غلط از نرسیده بدتر است.

    نرسیده یعنی جای خالی. غلط یعنی خرابی، چون سند به‌جای اینکه فقط کم بیاورد، خواننده را به بیراهه برده.

    بعد چیزی که هیچ سنجه‌ای درنمی‌آورد: ساخته‌ها، باورهایی که خواننده با آن‌ها بیرون آمده و سند هیچ‌وقت نگفته بوده. هر کدام آدرس مشخصی دارد و اصلاح همان‌جا انجام می‌شود.

    این آزمون برداشت را می‌سنجد، نه اقناع را. هنوز کسی با چیزی موافقت نکرده.

  • آزمون کلوز

    چهار تا شش خوانندهٔ واقعی · یک بعدازظهرشان

    ۲۵۰ تا ۳۰۰ کلمه نثر پیوسته از همان بخشی که پیام را حمل می‌کند بردارید. هر کلمهٔ ششم را حذف کنید. خواننده‌ها تنها، بدون متن اصلی و بدون ساعت، جاهای خالی را پر می‌کنند.

    قبولی از ۶۰ درصد بازسازی به بالا.

    بین ۴۰ تا ۶۰ یعنی متن به‌تنهایی نمی‌ایستد و باید کنارش توضیح بدهید. زیر ۴۰ یعنی این مخاطب از پس متن برنمی‌آید؛ بازنویسی لازم است، نه ویرایش. دامنه را هم گزارش کنید: یک خوانندهٔ قوی میانگین را از ۶۰ رد می‌کند در حالی که بقیهٔ اتاق گم شده‌اند.

    نمره مال همان قطعه و همان خواننده‌هاست. به بقیهٔ سند تعمیم پیدا نمی‌کند.

قفل ایمنی · چه کسی مجاز است

هیچ مدل زبانی نباید آزمون کلوز را بدهد

مدل، کلمهٔ حذف‌شده را از روی بافت جمله خیلی بهتر از هر آدمی بازسازی می‌کند. متنی جلویش بگذارید که هیچ‌کس در اتاق سر در نمی‌آورد؛ باز هم جاهای خالی را پر می‌کند و نمرهٔ خوبی می‌گیرد. پس نتیجهٔ کلوزِ یک مدل شاهد ضعیف نیست. اصلاً شاهد نیست.

اگر از این افزونه بخواهید کلوز را خودکار اجرا کند، قبول نمی‌کند، دلیلش را می‌گوید و شما را به آزمون خواننده می‌فرستد که با یک مدل تازه درست کار می‌کند. همین نه گفتن است که باعث می‌شود عددِ کلوز، وقتی بالاخره درمی‌آید، ارزشی داشته باشد.

  • مدل برگه و کلید پاسخ را می‌سازد
  • مدل برگه‌های برگشتی را تصحیح می‌کند و خوشه‌های خطا را می‌خواند
  • مدل هیچ جای خالی‌ای را پر نمی‌کند
  • انسان چهار تا شش نفر، از همان مخاطب واقعی

اعتبار

دو راهی که آزمون خواننده بی‌سروصدا همه‌چیز را قبول می‌کند

هر دو گزارشی تمیز تحویل می‌دهند و هیچ‌کدام در عدد پیدا نیست. پس هر اجرا باید بگوید سرِ این دو قاعده کجا ایستاده است.

  • خواننده در واقع تازه‌وارد نبوده

    زیرعامل (subagent) فایل CLAUDE.md و حافظهٔ پروژه را با خودش می‌برد. اگر آن‌ها موضوع را توضیح داده باشند، خواننده نیمی از دستورها جواب می‌دهد و نیمی از سند، و شما نمی‌فهمید کدام نیمه کدام است. چنین خواننده‌ای سندی را که هیچ پیام مستقلی ندارد هم تأیید می‌کند. خواننده را در نشستی جدا و بیرون از پروژه اجرا کنید و آخرش از او بپرسید از قبل چه می‌دانست. هر چه در آن فهرست بیاید نتیجه را آلوده می‌کند.

  • کلید پاسخ از روی همان سندِ زیر آزمون نوشته شده

    کلیدی که از روی خود سند برداشته شده فقط می‌پرسد آیا سند تیترهای خودش را تکرار می‌کند. همیشه می‌کند. چنین آزمونی شکست نمی‌خورد و مهم‌تر اینکه واگرایی میان سند منبع و فایلی که از رویش ساخته شده را نمی‌گیرد. کلید را پیش از آزمون از منبع بگیرید یا از نویسنده، و کنار خود سند در کنترل نسخه نگهش دارید: کلیدی که بعد از یک نتیجهٔ بد عوض شود، آزمون نیست.

یک اجرا

یک اجرا چطور پیش می‌رود

یک دستور، چهار قدم، و توقف سرِ اولین قدمی که آن‌قدر بد باشد که ادامه را بی‌معنی کند.

  1. آماده کردن فایل

    فایل PPTX، DOCX، ODP یا ODT اول به PDF تبدیل می‌شود. ترتیب اسلایدها، اینکه چه چیزی کنار چه چیزی نشسته و چه چیزی به پانویس تبعید شده، همه بخشی از پیام است و بیرون کشیدن متن آن را دور می‌ریزد.

  2. خواننده را مشخص کنید، کلید را بنویسید

    نه «مدیران ارشد»، بلکه «عضو هیئت‌مدیره‌ای که سند اصلی را نخوانده و یازده دقیقه وقت دارد». بعد سه تا پنج چیزی که باید با آن‌ها بیرون بیاید، هر کدام طوری که بشود درست یا غلطش را علامت زد. اگر این فهرست را نمی‌توانید بنویسید، سند هنوز پیامی ندارد.

  3. به شاخص شفافیت نمره بدهید

    ایرادها از بدترین به پایین، هر کدام با کوچک‌ترین تغییری که قبولش می‌کند. زیر ۷۰ کار همین‌جا تمام می‌شود: مشکل ساختاری صدای هر خواننده‌ای را خفه می‌کند و درست کردنش از دو بار اندازه‌گیری ارزان‌تر است.

  4. خواننده را بفرستید، بعد دربارهٔ کلوز تصمیم بگیرید

    آنچه برمی‌گردد را مقابل کلید قدم ۲ بگذارید. آزمون کلوز فقط وقتی به هزینه‌اش می‌ارزد که مخاطب امکان پرسیدن ندارد و بدفهمی گران تمام می‌شود.

ترتیب آرگومان‌ها: فایل، خوانندهٔ مورد نظر، و سند منبعی که فایل از رویش ساخته شده.

/message-test:run board-deck.pptx \
    "a board member with 11 minutes" \
    governance/the-source-document.md

نصب

نصب

دو خط در Claude Code. افزونه سه مهارت و یک دستور می‌آورد.

/plugin marketplace add cocodedk/message-test
/plugin install message-test@message-test

مجوز Apache-2.0. سازندهٔ برگهٔ کلوز و استخراج‌کنندهٔ متن هر دو با پایتون ساده نوشته شده‌اند و وابستگی خارجی ندارند.

خاستگاه

این ابزارها از کجا آمده‌اند

هیچ‌کدام اینجا اختراع نشده. دو تا از این سه، ابزارهای منتشرشده‌ای با آستانهٔ اعلام‌شده‌اند و همین تنها دلیلی است که می‌شود عددها را با چیزی مقایسه کرد.

  • ISO 24495-1:2023

    استاندارد زبان ساده. هدف را با نتیجهٔ خواننده تعریف می‌کند: خواننده آنچه را لازم دارد بگیرد، پیدا کند، بفهمد و به کار ببرد. و صراحتاً فرمول‌های خوانایی را به عنوان معیار موفقیت رد می‌کند.

  • شاخص ارتباط شفاف CDC

    بیست گویهٔ نمره‌دار از ۱۰۰، حد قبولی ۹۰، حدود پانزده دقیقه. مهارت clarity-index هفت حوزهٔ منتشرشدهٔ آن را برای سندهای عمومی بازنویسی کرده. اگر نمره باید رسماً جایی بایستد، از خود برگهٔ نمرهٔ CDC استفاده کنید و بگویید کدام را به کار برده‌اید.

  • روش کلوز · تیلور ۱۹۵۳

    هنوز مبنایی است که چند فرمول خوانایی روی آن واسنجی شده‌اند. آستانهٔ ۶۰ درصد و فاصلهٔ هر کلمهٔ ششم، همان روشی است که گروه نیلسن نورمن شرح می‌دهد.

این‌ها چه چیزی را ثابت نمی‌کنند

اینکه پیام درست است. اینکه مخاطب قبولش می‌کند، یا اینکه فلان‌کس بر اساسش کاری می‌کند.

کاری که می‌کنند گرفتن سندی است که چیزی غیر از منظور شما می‌گوید، و این همان خرابی‌ای است که از همه دیرتر لو می‌رود.