شمارشگر بخش‌های کلمه

شمارش بخش‌های کلمات به تفکیک کلمه و خط، همراه با علامت‌گذاری نتایج نامشخص جهت بررسی.

تلفظ استاندارد English را تخمین می‌زند و ریسک‌های شناخته‌شده لهجه یا املا را علامت‌گذاری می‌کند.

کاراکترها0

تحلیل بخش‌های کلمه

0بخش‌ها
کلمات
0
خطوط
0
بررسی
0
متن نشانه‌گذاری‌شده شما در اینجا ظاهر خواهد شد

برای مشاهده تک‌تک کلمات، مجموع هر خط و تخمین‌های نامشخص، متنی اضافه کنید یا نمونه را بارگذاری کنید.

آماده. برای تخمین بخش‌های کلمات، متنی اضافه کنید.

متن شما در مرورگر خودتان تحلیل می‌شود. هیچ داده‌ای به BroBroGo ارسال نمی‌شود.

سوالات متداول

آیا تعداد بخش‌های کلمات دقیق است؟

هیچ قاعده املایی خودکاری نمی‌تواند تمام تلفظ‌ها را به طور قطعی تعیین کند. نتایج English تخمینی هستند، اسپانیایی از یک قاعده نوشتاری پیروی می‌کند و کلمات علامت‌گذاری‌شده باید بر اساس نحوه تلفظ شما بررسی شوند.

چه قواعدی برای شمارش در دسترس است؟

یکی از گزینه‌های تخمین تلفظ English، قاعده املایی اسپانیایی، یا یک قاعده شفاف که هر گروه مصوت متوالی را یک بخش می‌شمارد انتخاب کنید. سایر زبان‌ها توسط این قواعد پشتیبانی نمی‌شوند.

چرا برخی از کلمات برای بررسی علامت‌گذاری شده‌اند؟

کلمات حساس به اکسنت، اختصارات، خطوط ترکیبی، املای غیرمعمول و الگوهای مصوت مبهم می‌توانند یک قاعده نوشتاری را با مشکل مواجه کنند. لیست بررسی این کلمات را بدون پنهان کردن تخمین فعلی آن‌ها در معرض دید قرار می‌دهد.

چالش‌های شمارش خودکار بخش‌های کلمه

شمارش بخش‌های کلمات (هجاها) در زبان‌های مختلف با چالش‌های ساختاری و آوایی متعددی همراه است. در زبان انگلیسی، به دلیل وجود املای نامنظم و تفاوت‌های گسترده در لهجه‌های محلی، یک قاعده املایی ثابت و خودکار نمی‌تواند تلفظ دقیق تمام کلمات را به طور قطعی تعیین کند. تلفظ یک واژه ممکن است بر اساس لهجه یا سبک گفتار افراد تغییر کند و در نتیجه تعداد بخش‌های آن در محیط‌های واقعی متفاوت باشد.

در زبان اسپانیایی، اگرچه قوانین نوشتاری مشخصی برای ترکیب مصوت‌ها وجود دارد، اما گفتار واقعی در مناطق گوناگون همچنان می‌تواند با استاندارد نوشتاری تفاوت داشته باشد. ابزارهای خودکار برای حل این مشکل از الگوهای تخمینی و قواعد املایی استفاده می‌کنند، اما همواره مواردی مانند اختصارات، کلمات دخیل از زبان‌های دیگر، یا الگوهای مصوت مبهم وجود دارند که فرآیند محاسبات ریاضی و الگوریتمی را با محدودیت مواجه می‌کنند. به همین دلیل، شناسایی و علامت‌گذاری کلمات مشکوک به کاربر اجازه می‌دهد تا بخش‌های مبهم را به صورت دستی بازبینی کند.

قواعد شمارش و نحوه عملکرد آن‌ها

این ابزار از سه قاعده مجزا برای تحلیل متن و تخمین تعداد بخش‌ها استفاده می‌کند که کاربر می‌تواند بر اساس نیاز خود یکی از آن‌ها را انتخاب کند:

  1. تخمین English: این قاعده تلفظ استاندارد زبان انگلیسی را تخمین می‌زند. از آنجا که زبان انگلیسی دارای پیچیدگی‌های آوایی زیادی است، این سیستم ریسک‌های شناخته‌شده مربوط به لهجه یا املا را شناسایی کرده و کلمات مشکوک را جهت بازبینی علامت‌گذاری می‌کند.
  2. Español · املایی: این قاعده قوانین مربوط به مصوت‌ها، مصوت‌های مرکب (diphthongs) و گسست (hiatus) را در اسپانیایی نوشتاری اعمال می‌کند. با این حال، باید توجه داشت که گفتار واقعی در گویش‌های مختلف اسپانیایی ممکن است با این استاندارد نوشتاری متفاوت باشد.
  3. گروه‌های مصوت · قاعده شفاف: یک روش ساده و ساختاری است که هر گروه مصوت متوالی از حروف A–Z را به عنوان یک بخش واحد محاسبه می‌کند. در این حالت، به دلیل ماهیت تقریبی فرمول، تمام نتایج بدون استثنا به عنوان تخمین علامت‌گذاری می‌شوند.

این قواعد صرفاً برای زبان‌های انگلیسی و اسپانیایی طراحی شده‌اند و سایر زبان‌ها توسط این سیستم پشتیبانی نمی‌شوند.

ورودی‌ها و محدودیت‌های فنی ابزار

برای استفاده از ابزار، کاربر باید متن خود را در بخش ورودی وارد کند. این ورودی‌ها و ابزارهای کنترلی شامل موارد زیر هستند:

  • متن برای تحلیل: کاربر می‌تواند کلمات، جملات، متن ترانه یا یک شعر را در کادر مربوطه تایپ کرده یا جای‌گذاری کند.
  • محدودیت کاراکتر: متن واردشده باید حداکثر ۵۰,۰۰۰ کاراکتر باشد. در صورت فراتر رفتن از این مقدار، پیام خطای متن بسیار طولانی است. آن را زیر ‹max› کاراکتر نگه دارید. نمایش داده می‌شود.
  • محدودیت کلمات: متن ورودی باید حداکثر ۵,۰۰۰ کلمه باشد. در صورت عبور از این حد، سیستم خطای تعداد کلمات متن برای نمایش بسیار زیاد است. آن را زیر ‹max› کلمه نگه دارید. را نشان می‌دهد.
  • انتخاب قاعده شمارش: منوی انتخاب قاعده که به کاربر اجازه می‌دهد یکی از سه روش ذکرشده را فعال کند.
  • نمونه: دکمه‌ای برای بارگذاری یک متن نمونه جهت تست سریع عملکرد ابزار.
  • پاک کردن: دکمه‌ای برای حذف کامل متن ورودی و نتایج تحلیل‌شده. با فشردن این دکمه، وضعیت سیستم به پیام متن و نتایج پاک شدند. تغییر می‌کند.

در صورتی که متن واردشده فاقد هرگونه کلمه قابل شمارش (مانند متون بدون حروف الفبا) باشد، سیستم خطای هیچ کلمه قابل شمارشی یافت نشد. یک قاعده منطبق انتخاب کنید یا متنی بر پایه حروف اضافه کنید. را صادر می‌کند.

خروجی‌ها و جزئیات تحلیل متن

پس از پردازش متن، نتایج در بخش نتایج با جزئیات زیر نمایش داده می‌شوند:

  • کاراکترها: تعداد کل کاراکترهای موجود در متن ورودی.
  • بخش‌ها: مجموع تعداد بخش‌های تخمین‌زده‌شده در کل متن.
  • کلمات: تعداد کل کلمات قابل شمارش شناسایی‌شده.
  • خطوط: تعداد کل خطوط متن.
  • بررسی: تعداد کلماتی که به دلیل ریسک‌های تلفظی یا املایی علامت‌گذاری شده‌اند.
  • تفکیک خطوط: برای هر خط از متن، مجموع بخش‌های آن با برچسب خط ‹number› نمایش داده می‌شود که این ویژگی برای بررسی وزن و هجای اشعار بسیار کاربردی است.
  • تحلیل بخش‌های کلمه: هر کلمه به همراه تعداد بخش‌های آن به صورت ‹word›: ‹count› بخش نمایش داده می‌شود. اگر کلمه‌ای مشکوک تشخیص داده شود، خروجی آن به صورت ‹word›: ‹count› بخش؛ بررسی: ‹reason› خواهد بود.

کاربران می‌توانند با استفاده از دکمه کپی جزئیات، یک ساختار سازمان‌یافته از نتایج شامل برچسب‌های زیر را کپی کنند:

  • قاعده
  • مجموع
  • بررسی این کلمات

پیام‌های وضعیت سیستم

  • در حالت آماده‌به‌کار: آماده. برای تخمین بخش‌های کلمات، متنی اضافه کنید.
  • پس از تحلیل موفق متن: تعداد تخمینی ‹total› بخش در ‹words› کلمه؛ ‹review› مورد برای بررسی علامت‌گذاری شده است.
  • در صورت خالی بودن بخش نتایج: عنوان متن نشانه‌گذاری‌شده شما در اینجا ظاهر خواهد شد به همراه توضیح برای مشاهده تک‌تک کلمات، مجموع هر خط و تخمین‌های نامشخص، متنی اضافه کنید یا نمونه را بارگذاری کنید. نمایش داده می‌شود.

دلایل علامت‌گذاری کلمات برای بررسی

سیستم به طور خودکار کلماتی را که ممکن است باعث خطا در محاسبه شوند شناسایی کرده و در بخش کلمات نیازمند بررسی قرار می‌دهد. اگر هیچ کلمه‌ای علامت‌گذاری نشود، پیام هیچ نشانگر ریسک اضافی برای این متن وجود ندارد. قاعده انتخاب‌شده همچنان یک تخمین است. نمایش داده می‌شود. دلایل علامت‌گذاری کلمات شامل موارد زیر است:

علت علامت‌گذاری پیام خطا / دلیل در سیستم توضیح فنی
تفاوت‌های لهجه‌ای تلفظ ممکن است بر اساس لهجه یا سبک گفتار متفاوت باشد کلماتی که تعداد بخش‌های آن‌ها در گویش‌های مختلف تغییر می‌کند.
اختصارات این مورد ممکن است به صورت حروف جداگانه یا یک کلمه تلفظ شود کلماتی که مشخص نیست باید به صورت مخفف خوانده شوند یا یکپارچه.
خطوط ترکیبی املای کلمه با زبان انتخاب‌شده مطابقت ندارد استفاده از نویسه‌ها یا کلماتی خارج از زبان قاعده انتخاب‌شده.
نمادها و اعداد وجود اعداد یا نمادهای غیرمعمول باعث نامشخص شدن کلمه شده است وجود کاراکترهای غیر الفبایی که تلفظ کلمه را مبهم می‌کنند.
الگوهای مصوت نامشخص این الگوی مصوت تحت قاعده انتخاب‌شده قابل اطمینان نیست ترکیب‌های مصوتی که فرمول‌های استاندارد قادر به پردازش قطعی آن‌ها نیستند.

حریم خصوصی و پردازش محلی داده‌ها

تحلیل متون واردشده در این ابزار به طور کامل در مرورگر وب خود کاربر انجام می‌شود. هیچ‌گونه داده، متن یا اطلاعاتی به سرورهای BroBroGo ارسال یا در آن ذخیره نمی‌شود. این شیوه پردازش محلی، امنیت اطلاعات متون شما را در سطح دستگاه خودتان حفظ می‌کند.

سوالات متداول

آیا تعداد بخش‌های کلمات دقیق است؟
هیچ قاعده املایی خودکاری نمی‌تواند تمام تلفظ‌ها را به طور قطعی تعیین کند. نتایج English تخمینی هستند، اسپانیایی از یک قاعده نوشتاری پیروی می‌کند و کلمات علامت‌گذاری‌شده باید بر اساس نحوه تلفظ شما بررسی شوند.

چه قواعدی برای شمارش در دسترس است؟
یکی از گزینه‌های تخمین تلفظ English، قاعده املایی اسپانیایی، یا یک قاعده شفاف که هر گروه مصوت متوالی را یک بخش می‌شمارد انتخاب کنید. سایر زبان‌ها توسط این قواعد پشتیبانی نمی‌شوند.

چرا برخی از کلمات برای بررسی علامت‌گذاری شده‌اند؟
کلمات حساس به اکسنت، اختصارات، خطوط ترکیبی، املای غیرمعمول و الگوهای مصوت مبهم می‌توانند یک قاعده نوشتاری را با مشکل مواجه کنند. لیست بررسی این کلمات را بدون پنهان کردن تخمین فعلی آن‌ها در معرض دید قرار می‌دهد.