PlayPendium
WordChess · خوراک اندیشه

ریاضیات یک حرف

Q ده امتیاز ارزش دارد و E یک امتیاز. همین یک واقعیت نظریه‌ای کوچک دربارهٔ زبان، استدلالی دربارهٔ اطلاعات، و دلیلی را پنهان می‌کند که مجموعهٔ مهره‌های بازی در اسپانیایی با انگلیسی متفاوت به نظر می‌رسد.

E · یک امتیاز 12 مهره در کیسه
در برابر
Q · ده امتیاز 1 مهره در کیسه

به انگلیسی نوشته و ویرایش شده است. این نسخهٔ فارسی با ترجمهٔ ماشینی تهیه شده است؛ هر جا دقت اهمیت دارد، متن اصلی انگلیسی معتبر است. خواندن متن اصلی به انگلیسی ←

01 · معماری صفحهٔ اول را می‌شمارد

ارزش، سنجه‌ای از کمیابی است

قاعدهٔ امتیازدهی که در نخستین نوبت با آن روبه‌رو می‌شوید انتخابی زیبایی‌شناختی نیست. یک اندازه‌گیری است. در اوایل دههٔ 1930، معماری بیکار به نام آلفرد ماشر باتس بر آن شد بازی‌ای واژه‌ای بسازد که نه بخت محض باشد و نه واژگان محض، و به راهی اصولی برای قیمت‌گذاری هر حرف نیاز داشت. پس همان کاری را کرد که یک مهندس می‌کند: شمرد. باتس بسامد هر حرف را در منابع چاپی روزگار خود برشمرد، که در رأس آن‌ها صفحهٔ اول The New York Times بود، و همراه آن Herald Tribune و The Saturday Evening Post. 1

از این شمارش‌ها هم‌زمان دو عدد را استخراج کرد. تعداد، یعنی اینکه از هر مهره چند عدد در کیسه قرار می‌گیرد، از رایج بودن آن حرف در نوشتار واقعی پیروی می‌کند. ارزش در جهت عکس حرکت می‌کند: هرچه حرف کمیاب‌تر باشد، حرکتی که از آن استفاده می‌کند باید پاداش بیشتری بدهد. واکه‌های رایج تنها یک امتیاز می‌گیرند؛ حرف‌هایی که فقط در واژه‌های وام‌گرفته و گوشه‌های ناهموار فرهنگ لغت پیدا می‌شوند بیشینهٔ امتیاز بازی را می‌گیرند. در نسخهٔ انگلیسی این بیشینه ده امتیاز است و تنها Q و Z آن را دارند؛ به تعبیری که زمانی BBC به کار برد، باتس «ارزش هر مهره را با اندازه‌گیری اینکه هر حرف چند بار در صفحهٔ اول نیویورک تایمز ظاهر می‌شد محاسبه کرد». 2

02 · دفتر حساب

بسامد، در سه ستون

حرف‌ها را کنار هم بچینید تا طراحی خود را آشکار کند. ارزش امتیازی تقریباً به‌طور یکنواخت با کاهش بسامد در جهان واقعی بالا می‌رود. E همه‌جا هست و ارزان است؛ Z و Q تقریباً هیچ‌جا نیستند و گران‌اند.

مجموعهٔ مهره‌های انگلیسی: تعداد، ارزش، و بسامد حرف در متن عادی
حرفمهره در کیسهارزش امتیازیبسامد در انگلیسی
E121≈ 12.7%
A91≈ 8.2%
N61≈ 6.7%
D42≈ 4.3%
B23≈ 1.5%
K15≈ 0.8%
X18≈ 0.15%
Q110≈ 0.12%
Z110≈ 0.07%

تعدادها و ارزش‌ها همان مجموعهٔ استاندارد انگلیسی‌اند؛ 3 ارقام بسامد برآوردهای مرسوم برای متن عادی انگلیسی‌اند. 4 WordChess در همین سنت از مهره‌های دارای امتیاز و مجموعه‌مهره‌ای با وزن‌دهی بر پایهٔ بسامد استفاده می‌کند (در انگلیسی 100 مهره: 98 حرف و 2 مهرهٔ سفید)، هرچند هر بازیکن به جای کشیدن مهره از کیسه، یک مجموعهٔ کامل در دست دارد، برگرفته از اسناد طراحی بازی.

03 · کشمکش درون طراحی

به‌قدر کافی کمیاب برای پاداش، به‌قدر کافی رایج برای بازی

اینجاست که اندیشه‌ای پاکیزه با قیدی سخت روبه‌رو می‌شود. اگر ارزش صرفاً به کمیابی پاداش می‌داد، کیسهٔ آرمانی از Q و Z انباشته می‌شد، امتیازهای عظیمی که در انتظار برداشته شدن‌اند. اما کیسه همچنین دستی است که باید واقعاً از آن بازی کنید. هفت حرف پرارزش و غریب بکشید و خشکتان می‌زند، ناتوان از ساختن یک واژهٔ مجاز. پس تعداد در برابر ارزش می‌کشد: کیسه باید حروف را تقریباً به همان نسبتی در خود داشته باشد که زبان به کارشان می‌برد، وگرنه بازی از حرکت می‌ایستد.

به همین دلیل است که دقیقاً یک Q وجود دارد، و همراه تقریباً جدانشدنی‌اش، U، چهار مهرهٔ مخصوص به خود دارد: یک Q، و چهار U در کیسه تا بختی برای یافتن یکی داشته باشد. تک Q گران‌بهاست چون تقریباً بازی‌نشدنی است، و تنها از آن رو اصلاً بازی‌شدنی است که دیگر مهره‌های کیسه به همان نسبت‌های خود زندگی پخش شده‌اند. کمیابی پاداش را تعیین می‌کند؛ بسامد بازی را در جریان نگاه می‌دارد.

قیمت یک مهره را اینکه حرف چقدر به‌ندرت ظاهر می‌شود تعیین می‌کند، اما محتوای کیسه را اینکه چقدر به‌کثرت ظاهر می‌شود. این دو نیرو یک واقعیت‌اند، یک بار از جلو خوانده شده و یک بار از پشت.

04 · بیست‌ودو زبان، بیست‌ودو مجموعهٔ مهره

چرا اسپانیایی K را کنار می‌گذارد

اگر یک مجموعهٔ مهرهٔ منصفانه عکسی از بسامد حروف یک زبان باشد، پس تغییر زبان باید عکس را تغییر دهد. و به‌روشنی چنین می‌کند. WordChess به 22 زبان اجرا می‌شود و مجموعهٔ مهره‌هایش برای هر یک از نو ساخته می‌شود، چون توزیعی که برای انگلیسی تنظیم شده در جای دیگر به‌سادگی نادرست است. 3

مجموعه‌های اسپانیایی که بیرون از آمریکای شمالی فروخته می‌شوند K و W را به‌کلی حذف می‌کنند؛ این حروف در اسپانیایی فقط در واژه‌های وارداتی می‌آیند، پس کیسه‌ای وفادار هیچ مهره‌ای به آن‌ها نمی‌دهد. 5 ایتالیایی فراتر می‌رود و J، K، W، X و Y را کنار می‌گذارد، حروفی که به املای بومی ایتالیایی تعلق ندارند و فقط در واژه‌های وام‌گرفته پیدا می‌شوند. 5 حروفی که کیسهٔ انگلیسی به هر کدام یک یا دو مهره سهمیه می‌دهد، در زبانی دیگر نه کمیاب، بلکه غایب‌اند. کمیابی ویژگی یک حرف نیست. ویژگی یک حرف در یک زبان است.

05 · اندیشهٔ ژرف

کمیابی یک حرف، اطلاعات آن است

باتس، بی‌آنکه واژگانش را داشته باشد، چیزی را می‌سنجید که یک ریاضی‌دان حدود پانزده سال بعد صورت‌بندی کرد. در 1948، کلود شانون نظریهٔ اطلاعات را بر ادعایی دقیق بنا نهاد: هرچه یک نماد پیش‌بینی‌ناپذیرتر باشد، اطلاعات بیشتری حمل می‌کند. حرفی که می‌توانستید حدسش بزنید چیز کمی به شما می‌گوید؛ حرفی غافلگیرکننده چیز زیادی می‌گوید. کمیابی همان اطلاعات است، و اطلاعات با بیت سنجیده می‌شود. 6

شانون در مقالهٔ 1951 خود، Prediction and Entropy of Printed English (پیش‌بینی و آنتروپی انگلیسی چاپی)، بر آن شد این کمیت را بسنجد. اگر حروف را جدا از یکدیگر در نظر بگیریم، انگلیسی به حدود چهار بیت برای هر حرف می‌رسد؛ اما اگر بگذاریم خواننده از بافت استفاده کند، از این واقعیت که q تقریباً وعدهٔ یک u را می‌دهد، که واژه‌های کمی به v ختم می‌شوند، نرخ واقعی فرو می‌ریزد. آزمایش‌های پیش‌بینی شانون آنتروپی انگلیسی عادی را جایی میان 0.6 و 1.3 بیت برای هر حرف برآورد کردند. 6 بیشتر آنچه می‌نویسیم زائد است؛ حروف غافلگیرکننده کار اصلی را انجام می‌دهند.

همین حسابرسی پیش‌تر رمزی قدیمی‌تر را شکل داده بود. وقتی ساموئل مورس و آلفرد ویل در دههٔ 1840 الفبای خود را ساختند، گفته می‌شود ویل جعبه‌های حروف یک چاپخانه را بررسی کرد تا ببیند کدام حروف بیشتر به کار می‌روند، و سپس کوتاه‌ترین علامت‌ها را به آن حروف داد: یک نقطهٔ تنها برای E، یک خط تنها برای T. 7 رمزهای کوتاه برای حروف پرکاربرد؛ امتیازهای ارزان برای مهره‌های رایج؛ بیت‌های اندک برای پیش‌بینی‌پذیرها. مورس زمان را روی سیم به کمینه رساند، باتس یک بازی را متوازن کرد، شانون عدد زیربنایی را نام نهاد، اما هر سه همان دفتر حساب را می‌خواندند. معلوم می‌شود ارزش یک حرف همواره سنجه‌ای بوده است از اینکه چقدر می‌تواند شما را غافلگیر کند.

Sources & notes
  1. Wikipedia, "Alfred Butts", on Butts deriving his letter counts and values from printed frequency counts: "Butts studied the front page of The New York Times to calculate how frequently each letter of the alphabet is used." Cites Bruce Lambert, "Alfred M. Butts, 93, Is Dead; Inventor of SCRABBLE", The New York Times, 7 April 1993. en.wikipedia.org/wiki/Alfred_Butts. The wider set of sources is from Wikipedia, "Scrabble" (History): Butts tabulated letters from a dictionary, the Saturday Evening Post, the New York Herald Tribune and The New York Times, citing John Tierney, "Humankind Battles for Scrabble Supremacy", The New York Times Magazine, 24 May 1998. en.wikipedia.org/wiki/Scrabble
  2. "Scrabble: Should letter values change?" BBC News Magazine (2013), on Q and Z as the English game’s ten-point tiles and on Butts, who “calculated a value for each tile by measuring how frequently each letter appeared on the front page of the New York Times.” bbc.com/news/magazine-20984707
  3. "Scrabble letter distributions." Wikipedia, the standard English tile counts and point values. en.wikipedia.org/wiki/Scrabble_letter_distributions
  4. Letter-frequency estimates for ordinary English text (E ≈ 12.7%, T ≈ 9.1%, …), as compiled in standard references. See "Letter frequency," Wikipedia. en.wikipedia.org/wiki/Letter_frequency
  5. "Scrabble letter distributions." Wikipedia, Spanish sets outside North America omit K and W; Italian sets omit J, K, W, X and Y, as these occur only in loanwords. en.wikipedia.org/wiki/Scrabble_letter_distributions
  6. Shannon, C. E. "Prediction and Entropy of Printed English." Bell System Technical Journal 30 (1951): 50–64. Estimates the entropy of English at roughly 0.6–1.3 bits per letter with context. princeton.edu/~wbialek/rome/refs/shannon_51.pdf
  7. Cook, J. D. "How efficient is Morse code?", on Morse and Vail assigning the shortest codes to the most frequent letters (E, T). johndcook.com/blog/2017/02/08/how-efficient-is-morse-code
  8. Further reading on Scrabble letter distributions, Scrabble as a tool for Haitian Creole literacy. doi.org.
  9. Further reading on Letter frequency, [1103.2950] Fitting Ranked English and Spanish Letter Frequency Distribution in U.S. and Mexican Presidential Speeches. arxiv.org.
Was this worth reading?
Play WordChess
PlayPendium · About · Contact · Privacy · Terms · Cookies · Accessibility · Copyright · Browse all games · Classic arcade games · © 2026