افزونهٔ Claude Code · سه ابزار سنجش
آزمون پیام: خواننده در عمل چه چیزی برداشت میکند؟
نمرهٔ خوانایی میگوید خواندن یک متن چقدر سخت است. اینکه خواننده سرِ آخر همان چیزی را برداشته که منظور شما بوده، حرف دیگری است. وقتی قرار است سندی پای یک تصمیم بایستد، فقط همین دومی مهم است.
۷۸ از ۱۰۰
۰حد قبولی ۹۰۱۰۰
۱۸ گویه نمره خورد، ۲ گویه چون موردی نداشت کنار گذاشته شد.
۳ رسیده
۱ نرسیده، ۱ غلط، از کلید پنجبندی که از سند منبع درآمده بود.
غلط: تصور کرده پایلوت هر پنج کشور را میگیرد.
ساخته: «هر ایرادی خودکار رفع میشود.» چنین چیزی در سند نیست؛ اسلاید ۲ با
نگفتنِ محدودیت همین را القا میکند.
تا وقتی شاخص شفافیت قبول نشود کنار میماند. خوانندهٔ واقعی گرانترین ابزار این مجموعه است و این پیشنویس وقتشان را هدر میدهد.
گزارش یک اجرا، تقریباً همانطور که برمیگردد. نمره کماهمیتترین سطر آن است.
ابزارها
سه آزمون، به ترتیب هزینهای که برایتان دارند
هر کدام سؤالی باریکتر از قبلی میپرسد و گرانتر تمام میشود. از بالا شروع کنید و هر جا جواب گفت برو بازنویسی کن، همانجا بایستید.
-
شاخص شفافیت
یک مدل · حدود ۱۵ دقیقه · رایگان
بیست گویه، هر کدام یک نمره، تبدیلشده به ۱۰۰. پیام اصلی هست و بدون گشتن پیدا میشود؟ گفته شده خواننده باید چه کار کند؟ عددها به درد استفاده میخورند؟ کنار هر ریسک، احتمالش هم آمده؟
قبولی از ۹۰ به بالا.
۰بازهٔ قبولی۱۰۰
هر جا شک دارید صفر بدهید. مدلی که سندِ خودش را نمره میدهد دستودلباز میشود، پس برای هر نمرهای که میدهید باید همان جملهای را بیاورید که آن نمره را گرفته است.
قبولی یعنی موانع شناختهشده سرِ راه نیستند. یعنی کسی چیزی فهمیده باشد، نه.
-
آزمون خواننده
یک مدل، در انزوا · چند دقیقه · تقریباً رایگان
اول بنویسید خواننده باید با چه چیزی از این سند بیرون بیاید. بعد سند را، و هیچ چیز دیگری را، به کسی بدهید که تا حالا ندیدهاش. جوابش را مقابل کلید بگذارید: رسیده، نرسیده، غلط.
حد قبولی ندارد. غلط از نرسیده بدتر است.
نرسیده یعنی جای خالی. غلط یعنی خرابی، چون سند بهجای اینکه فقط کم بیاورد، خواننده را به بیراهه برده.
بعد چیزی که هیچ سنجهای درنمیآورد: ساختهها، باورهایی که خواننده با آنها بیرون آمده و سند هیچوقت نگفته بوده. هر کدام آدرس مشخصی دارد و اصلاح همانجا انجام میشود.
این آزمون برداشت را میسنجد، نه اقناع را. هنوز کسی با چیزی موافقت نکرده.
-
آزمون کلوز
چهار تا شش خوانندهٔ واقعی · یک بعدازظهرشان
۲۵۰ تا ۳۰۰ کلمه نثر پیوسته از همان بخشی که پیام را حمل میکند بردارید. هر کلمهٔ ششم را حذف کنید. خوانندهها تنها، بدون متن اصلی و بدون ساعت، جاهای خالی را پر میکنند.
قبولی از ۶۰ درصد بازسازی به بالا.
۰٪بازهٔ قبولی۱۰۰٪
بین ۴۰ تا ۶۰ یعنی متن بهتنهایی نمیایستد و باید کنارش توضیح بدهید. زیر ۴۰ یعنی این مخاطب از پس متن برنمیآید؛ بازنویسی لازم است، نه ویرایش. دامنه را هم گزارش کنید: یک خوانندهٔ قوی میانگین را از ۶۰ رد میکند در حالی که بقیهٔ اتاق گم شدهاند.
نمره مال همان قطعه و همان خوانندههاست. به بقیهٔ سند تعمیم پیدا نمیکند.
قفل ایمنی · چه کسی مجاز است
هیچ مدل زبانی نباید آزمون کلوز را بدهد
مدل، کلمهٔ حذفشده را از روی بافت جمله خیلی بهتر از هر آدمی بازسازی میکند. متنی جلویش بگذارید که هیچکس در اتاق سر در نمیآورد؛ باز هم جاهای خالی را پر میکند و نمرهٔ خوبی میگیرد. پس نتیجهٔ کلوزِ یک مدل شاهد ضعیف نیست. اصلاً شاهد نیست.
اگر از این افزونه بخواهید کلوز را خودکار اجرا کند، قبول نمیکند، دلیلش را میگوید و شما را به آزمون خواننده میفرستد که با یک مدل تازه درست کار میکند. همین نه گفتن است که باعث میشود عددِ کلوز، وقتی بالاخره درمیآید، ارزشی داشته باشد.
- مدل برگه و کلید پاسخ را میسازد
- مدل برگههای برگشتی را تصحیح میکند و خوشههای خطا را میخواند
- مدل هیچ جای خالیای را پر نمیکند
- انسان چهار تا شش نفر، از همان مخاطب واقعی
اعتبار
دو راهی که آزمون خواننده بیسروصدا همهچیز را قبول میکند
هر دو گزارشی تمیز تحویل میدهند و هیچکدام در عدد پیدا نیست. پس هر اجرا باید بگوید سرِ این دو قاعده کجا ایستاده است.
-
خواننده در واقع تازهوارد نبوده
زیرعامل (subagent) فایل
CLAUDE.mdو حافظهٔ پروژه را با خودش میبرد. اگر آنها موضوع را توضیح داده باشند، خواننده نیمی از دستورها جواب میدهد و نیمی از سند، و شما نمیفهمید کدام نیمه کدام است. چنین خوانندهای سندی را که هیچ پیام مستقلی ندارد هم تأیید میکند. خواننده را در نشستی جدا و بیرون از پروژه اجرا کنید و آخرش از او بپرسید از قبل چه میدانست. هر چه در آن فهرست بیاید نتیجه را آلوده میکند. -
کلید پاسخ از روی همان سندِ زیر آزمون نوشته شده
کلیدی که از روی خود سند برداشته شده فقط میپرسد آیا سند تیترهای خودش را تکرار میکند. همیشه میکند. چنین آزمونی شکست نمیخورد و مهمتر اینکه واگرایی میان سند منبع و فایلی که از رویش ساخته شده را نمیگیرد. کلید را پیش از آزمون از منبع بگیرید یا از نویسنده، و کنار خود سند در کنترل نسخه نگهش دارید: کلیدی که بعد از یک نتیجهٔ بد عوض شود، آزمون نیست.
یک اجرا
یک اجرا چطور پیش میرود
یک دستور، چهار قدم، و توقف سرِ اولین قدمی که آنقدر بد باشد که ادامه را بیمعنی کند.
-
آماده کردن فایل
فایل PPTX، DOCX، ODP یا ODT اول به PDF تبدیل میشود. ترتیب اسلایدها، اینکه چه چیزی کنار چه چیزی نشسته و چه چیزی به پانویس تبعید شده، همه بخشی از پیام است و بیرون کشیدن متن آن را دور میریزد.
-
خواننده را مشخص کنید، کلید را بنویسید
نه «مدیران ارشد»، بلکه «عضو هیئتمدیرهای که سند اصلی را نخوانده و یازده دقیقه وقت دارد». بعد سه تا پنج چیزی که باید با آنها بیرون بیاید، هر کدام طوری که بشود درست یا غلطش را علامت زد. اگر این فهرست را نمیتوانید بنویسید، سند هنوز پیامی ندارد.
-
به شاخص شفافیت نمره بدهید
ایرادها از بدترین به پایین، هر کدام با کوچکترین تغییری که قبولش میکند. زیر ۷۰ کار همینجا تمام میشود: مشکل ساختاری صدای هر خوانندهای را خفه میکند و درست کردنش از دو بار اندازهگیری ارزانتر است.
-
خواننده را بفرستید، بعد دربارهٔ کلوز تصمیم بگیرید
آنچه برمیگردد را مقابل کلید قدم ۲ بگذارید. آزمون کلوز فقط وقتی به هزینهاش میارزد که مخاطب امکان پرسیدن ندارد و بدفهمی گران تمام میشود.
ترتیب آرگومانها: فایل، خوانندهٔ مورد نظر، و سند منبعی که فایل از رویش ساخته شده.
/message-test:run board-deck.pptx \
"a board member with 11 minutes" \
governance/the-source-document.md
نصب
نصب
دو خط در Claude Code. افزونه سه مهارت و یک دستور میآورد.
/plugin marketplace add cocodedk/message-test
/plugin install message-test@message-test
مجوز Apache-2.0. سازندهٔ برگهٔ کلوز و استخراجکنندهٔ متن هر دو با پایتون ساده نوشته شدهاند و وابستگی خارجی ندارند.
خاستگاه
این ابزارها از کجا آمدهاند
هیچکدام اینجا اختراع نشده. دو تا از این سه، ابزارهای منتشرشدهای با آستانهٔ اعلامشدهاند و همین تنها دلیلی است که میشود عددها را با چیزی مقایسه کرد.
-
ISO 24495-1:2023
استاندارد زبان ساده. هدف را با نتیجهٔ خواننده تعریف میکند: خواننده آنچه را لازم دارد بگیرد، پیدا کند، بفهمد و به کار ببرد. و صراحتاً فرمولهای خوانایی را به عنوان معیار موفقیت رد میکند.
-
شاخص ارتباط شفاف CDC
بیست گویهٔ نمرهدار از ۱۰۰، حد قبولی ۹۰، حدود پانزده دقیقه. مهارت
clarity-indexهفت حوزهٔ منتشرشدهٔ آن را برای سندهای عمومی بازنویسی کرده. اگر نمره باید رسماً جایی بایستد، از خود برگهٔ نمرهٔ CDC استفاده کنید و بگویید کدام را به کار بردهاید. -
روش کلوز · تیلور ۱۹۵۳
هنوز مبنایی است که چند فرمول خوانایی روی آن واسنجی شدهاند. آستانهٔ ۶۰ درصد و فاصلهٔ هر کلمهٔ ششم، همان روشی است که گروه نیلسن نورمن شرح میدهد.
اینها چه چیزی را ثابت نمیکنند
اینکه پیام درست است. اینکه مخاطب قبولش میکند، یا اینکه فلانکس بر اساسش کاری میکند.
کاری که میکنند گرفتن سندی است که چیزی غیر از منظور شما میگوید، و این همان خرابیای است که از همه دیرتر لو میرود.