අන්තර්ගතයට යන්න
මෙය ඉංග්‍රීසි මුල් ලේඛනයේ පරිවර්තනයකි. දෙකෙහි වෙනසක් ඇත්නම් ඉංග්‍රීසි පිටපත නිවැරදි යැයි සලකන්න.

05: ශබ්ද සංයෝජන නීති, අක්ෂර වින්‍යාස සම්මුති සහ සන්ධි ​

විෂය පථය: ලිඛිත සිංහලයේ වලංගු අකුරු අනුක්‍රම මොනවාද, ඒවා වලංගු වන්නේ ඇයි. මෙම ගොනුව අක්ෂර ව්‍යුහය (syllable structure) සහ ස්ථානය අනුව ඇති සීමා, සන්ධි (රූපිම එක් වන විට අක්ෂර වින්‍යාසයේ සිදු වන වෙනස්කම්), අකුරෙන් ශබ්දයට යන නීති (ලිඛිත ආවේණික a [ə] ලෙස උච්චාරණය වන්නේ කවදාද), නියාමක අක්ෂර වින්‍යාස නීති සහ ඒවා පිළිබඳ මතභේද, ණය වචන සම්මුති, විරාම ලකුණු, හිස්තැන් සහ ඉලක්කම් ආවරණය කරයි. යුනිකේත කේතනය පිළිබඳ විස්තර සහ සම්පූර්ණ අකුරු ලැයිස්තුව මෙම ගබඩාවේ වෙනත් ලේඛනවල ඇත. අවසාන කොටස රෝමානුකරණයට සහ අක්ෂර පරිවර්තනයට (transliteration) මේවායින් ඇති වන ප්‍රතිඵල පෙන්වයි.

සම්පාදනය: 2026 ඔක්තෝබර්.

මෙම ගොනුවේ භාවිත සම්මුති ​

අයිතමයසම්මුතිය
නීති හැඳුනුම්PH-0xx ශබ්ද සංයෝජන නීති, SN-0xx සන්ධි, G2P-0xx අකුරෙන් ශබ්දයට, SP-0xx අක්ෂර වින්‍යාස සම්මුති, LW-0xx ණය වචන, TY-0xx මුද්‍රණ ශිල්පය / විරාම ලකුණු / ඉලක්කම්
අකුරු හැඳුනුම්අකුරු හැඳුනුම් (මෙම ගබඩාව පුරා භාවිත වේ): ව්‍යඤ්ජන ka kha ga gha nga nnga(ඟ) ca cha ja jha nya(ඤ) jnya(ඥ) nyja(ඦ) tta ttha dda ddha nna nndda(ඬ) ta tha da dha na nda(ඳ) pa pha ba bha ma mba(ඹ) ya ra la va sha(ශ) ssa(ෂ) sa ha lla(ළ) fa; ස්වර a aa ae aee i ii u uu ru ruu ilu iluu e ee ai o oo au; hal. මෙහි භාවිත අමතර හැඳුනුම්: anusvara (ං), visarga (ඃ), ZWJ (U+200D). සටහන: nga = ඞ (කණ්ඨජ නාසික අකුර), nnga = ඟ (සඤ්ඤක g).
රෝමානුකරණයබොහෝ විට ලිහිල් ISO 15919 ආකාරයේ රූපයකි. ə = අවධාරණය නොවන [ə] ස්වරය (schwa), æ = ඇ, ŋ = කණ්ඨජ නාසිකය, ṇ = ණ, ḷ = ළ, ṣ = ෂ, ś = ශ, ⁿd/ᵐb/ⁿḍ/ᵑg = සඤ්ඤක ස්පර්ශ (prenasalized stops). /.../ යනු ස්වනිමික (phonemic) ලිවීමයි.
විශ්වාසයඉහළ: ස්වාධීන මූලාශ්‍ර දෙකක් හෝ වැඩි ගණනක්, නැතහොත් එක් ප්‍රාමාණික මූලාශ්‍රයක් සහ පොදු එකඟතාව. මධ්‍යම: එක් මූලාශ්‍රයක්, කියවීමට අපහසු මූලාශ්‍රයක් (විකෘති PDF), හෝ පුළුල්ව පැවසෙන නමුත් උපුටා දැක්වූ කිසිදු මූලාශ්‍රයකින් තහවුරු නොවන කරුණක්. අඩු: අනුමානයක්, හෝ සහාය දක්වන මූලාශ්‍රයක් හමු නොවූ කරුණක්.
[විසඳා නැත]උපුටා දැක්වූ කිසිදු මූලාශ්‍රයක් මෙම කරුණ තහවුරු නොකරයි. එය මුද්‍රිත ව්‍යාකරණ ග්‍රන්ථයකින් (NIE පෙළපොත, Disanayaka, Karunatillake) පරීක්ෂා කළ යුතු අතර, මෙම ගොනුවේ අවසානයේ ඇති විසඳා නැති ප්‍රශ්න අතර ලැයිස්තුගත කර ඇත.
පෙළ සංග්‍රහ ගණන්"NLPC n" යනු NLPC වචන සංඛ්‍යාත ලැයිස්තුවේ (වචන වර්ග 2,138,021; reports/corpus-counts.md හි සවි කර ඇත) එම නිශ්චිත වචන රූපයේ ටෝකන ගණනයි. "ප්‍රත්‍ය සහිතව" යන ගණනට එම රූපයෙන් ආරම්භ වන සියලු වචන එක් වේ. ගණන් ලිඛිත අකුරු පෙළවල් සඳහා වන අතර සමරූපී වචන (homographs) වෙන් නොකරයි.

ප්‍රධාන මූලාශ්‍ර (පහත භාවිත කෙටි නම්) ​

කෙටි නමමූලාශ්‍රය
WWG-G2P 2006Wasala, Weerasinghe & Gamage, "Sinhala Grapheme-to-Phoneme Conversion and Rules for Schwa Epenthesis", COLING/ACL 2006 Poster: https://aclanthology.org/P06-2114.pdf
WWG-SYL 2005Weerasinghe, Wasala & Gamage, "A Rule Based Syllabification Algorithm for Sinhala", IJCNLP 2005: https://aclanthology.org/I05-1039.pdf
WASALA-SPELL 2010Wasala, Weerasinghe, Pushpananda, Liyanage & Jayalatharachchi, "A Data-Driven Approach to Checking and Correcting Spelling Errors in Sinhala", ICTer 3(1) 2010: https://distantreader.org/stacks/journals/icter/icter-72.pdf. එහි Appendix A හි Disanayaka (2007) සහ වෙනත් අයගෙන් ගත් ණ/න, ළ/ල, ෂ/ශ නියාමක නීති ඇත. PDF හි සිංහල පෙළ උපුටා ගන්නා විට පැරණි අකුරු මුහුණත් සිතියම්කරණ දෝෂයක් ඇති වේ. එබැවින් උදාහරණ නැවත ගොඩනඟා ඇත (උදා: උපුටාගත් ශ ඇත්තෙන්ම ළ වන අතර ඿ ඇත්තෙන්ම ස වේ).
SINSPELL 2021Liyanapathirana, Gunasinghe & Dias, "SinSpell: A Comprehensive Spelling Checker for Sinhala", https://arxiv.org/abs/2107.02983
SI-WP-SANDHIසිංහල විකිපීඩියාව, සිංහල සන්ධි (https://si.wikipedia.org/wiki/සිංහල_සන්ධි, සහ සන්ධි) https://si.wikipedia.org/wiki/සන්ධි
PIRIVEN-SANDHIPiriven Sinhala Piyasa, "සන්ධි 10 සරලව": http://piriven.blogspot.com/2021/05/10.html (අධ්‍යාපන බ්ලොග් අඩවියකි; පාසල් විෂය නිර්දේශයේ සන්ධි 10 ලැයිස්තුවට ගැළපේ)
SI-WP-AVසිංහල විකිපීඩියාව, සිංහල අක්ෂර වින්‍යාසය: https://si.wikipedia.org/wiki/සිංහල_අක්ෂර_වින්‍යාසය
LETSLEARN"අපි නිවරදිව සිංහල ලියමු - අක්ෂර වින්‍යාසය": http://letslearnsinhala.blogspot.com/2012/03/blog-post.html
EN-WP-SINඉංග්‍රීසි විකිපීඩියාව, Sinhala language (ශබ්ද විද්‍යා කොටස): https://en.wikipedia.org/wiki/Sinhala_language සහ https://en.wikipedia.org/wiki/Sinhala_phonology (හැඳින්වීම පමණි)
EN-WP-SCRIPTඉංග්‍රීසි විකිපීඩියාව, Sinhala script: https://en.wikipedia.org/wiki/Sinhala_script
ZYGIS 2010Żygis, "Typology of Consonantal Insertions", ZASPiL 52 (සිංහල සඳහා Smith 2001 උපුටා දක්වයි): https://zaspil.leibniz-zas.de/article/download/385/386
KNAB 1989Institute of the Estonian Language, KNAB romanization of Sinhalese: https://arhiiv.eki.ee/knab/lat/kblsi2.pdf
UNICODE-ML 2016SLS 1134 නම් කළ අනුක්‍රම (named sequences) පිළිබඳ යුනිකේත තැපැල් ලැයිස්තු සාකච්ඡාව: https://unicode.org/mail-arch/unicode-ml/y2016-m10/0218.html
EN-WP-LOANඉංග්‍රීසි විකිපීඩියාව, List of Sinhala words of English origin: https://en.wikipedia.org/wiki/List_of_Sinhala_words_of_English_origin

පරිශීලනය නොකළ මූලාශ්‍ර: e-Thaksalawa 10 ශ්‍රේණියේ PDF "අක්ෂර හා අක්ෂර වින්‍යාසය" (https://e-thaksalawa.moe.gov.lk/moodle/pluginfile.php/10785/mod_resource/content/1/SG10_Sin_Act_Akshara_vinyasaya.pdf) කියවීමට පිවිසුමක් (login) අවශ්‍ය වේ. NIE පෙළපොතක සන්ධි පරිච්ඡේදයක් හෝ රාජ්‍ය භාෂා දෙපාර්තමේන්තුවේ අක්ෂර වින්‍යාස සම්මතයක් අන්තර්ජාලයෙන් ලබාගත නොහැකි විය. මෙවැනි මූලාශ්‍ර අවශ්‍ය වන ප්‍රකාශ [විසඳා නැත] ලෙස සලකුණු කර ඇත.


1. අක්ෂර ව්‍යුහය සහ ස්ථානය අනුව ඇති සීමා ​

PH-001: ස්වදේශීය අක්ෂර ආකෘතිය (C)V(C) වේ ​

  • ප්‍රකාශය: ස්වදේශීය (nishpanna) වචනවල ඇත්තේ V, CV, VC සහ CVC අක්ෂර පමණි. දීර්ඝ ස්වර යෙදිය හැකිය (V̄, CV̄(C)). ස්වදේශීය වචනවල අක්ෂරයක මුලට ව්‍යඤ්ජන පොකුරු නොයෙදේ.
  • උදාහරණ: අම්මා am.maː; ගස් gas; පොත po.tə; මල්ලී mal.liː.
  • ව්‍යතිරේක: සංස්කෘත සහ පාලි (tatsama/tadbhava) වචනවල සහ ඉංග්‍රීසි ණය වචනවල (C)(C)(C)V(C)(C)(C) දක්වා වූ අක්ෂර ආකෘති යෙදිය හැකිය: ප්‍රශ්නය praś.nə.yə; ස්ත්‍රී strī; ශාස්ත්‍රය.
  • අදාළ වන්නේ: සියලු ව්‍යඤ්ජන; hal.
  • විශ්වාසය: ඉහළ.
  • මූලාශ්‍ර: WWG-SYL 2005 §3.2.2–3.2.3; EN-WP-SIN.

PH-002: වචන මැද පොකුරු VC.CV ලෙස බෙදේ; ව්‍යඤ්ජන තුනේ පොකුරු නීතියක් අනුව බෙදේ ​

  • ප්‍රකාශය: ස්වදේශීය වචනවල VCCV අනුක්‍රමයක් VC.CV ලෙස අක්ෂරවලට බෙදේ. ණය වචනවල C+C+r/y පොකුර, ස්පර්ශ + ද්‍රව/අර්ධ ස්වර කොටසට පෙර බෙදේ (sam.prēk.ṣə.nə). පළමු ව්‍යඤ්ජන දෙකම ස්පර්ශ වන C+C+C පොකුරක් පළමු ව්‍යඤ්ජනයෙන් පසු බෙදේ. වෙනත් ඕනෑම C+C+C පොකුරක් දෙවන ව්‍යඤ්ජනයෙන් පසු බෙදේ.
  • උදාහරණ: මල්ලී mal.liː; සම්ප්‍රේෂණ sam.prē.kṣa.ṇa / samp.rē… (අක්ෂර බෙදීම් දෙකම පිළිගත හැකිය); මත්ස්‍ය mat.syə ~ mats.yə.
  • ව්‍යතිරේක: සමහර සංස්කෘත වචනවල C+r පොකුර ද්විත්වයක් සහිතව උච්චාරණය කළ හැකිය: ක්‍රමක්‍රමයෙන් kramak.kra…; අප්‍රමාණ ap.pramāṇa ~ ap.ramāṇa.
  • අදාළ වන්නේ: ra, ya (පොකුරේ දෙවන ව්‍යඤ්ජනය ලෙස); hal; ZWJ සංයුක්ත අකුරු.
  • විශ්වාසය: ඇල්ගොරිතමය සඳහා ඉහළ. අක්ෂර වින්‍යාසයට එහි අදාළත්වය වක්‍ර වේ.
  • මූලාශ්‍ර: WWG-SYL 2005 §3.2.3–3.2.4.

PH-003: සඤ්ඤක අකුරු වචන මුලට හෝ අක්ෂර අගට කිසි විටෙක නොයෙදේ ​

  • ප්‍රකාශය: ඟ ඬ ඳ ඹ (සහ භාවිතයෙන් ඉවත් වූ ඦ) යෙදෙන්නේ ස්වර දෙකක් අතර (intervocalically) පමණි. ඒවා වචන මුලට හෝ අගට නොයෙදේ, hal නොගනී, ද්විත්ව ද නොවේ.
  • උදාහරණ: කඳ kaⁿdə "ගසේ හෝ ශරීරයේ කඳ" සහ කන්ද kandə "පර්වතය" සහ කද kadə "බර උසුලන පොල්ල"; අඹ aᵐbə; ගඟ gaᵑgə; කොළඹ koḷaᵐbə.
  • ව්‍යතිරේක: සම්මත වචන මාලාවේ කිසිවක් නැත. සමාසවල ව්‍යඤ්ජනයකට පෙර සඤ්ඤක අකුර වෙනුවට ං හෝ හල් කළ නාසිකයක් යෙදේ: ගඟ + වතුර → ගංවතුර; කොළඹ + තොට → කොළොම්තොට (SN-007 බලන්න).
  • අදාළ වන්නේ: nnga, nndda, nda, mba, nyja.
  • විශ්වාසය: ඉහළ.
  • මූලාශ්‍ර: EN-WP-SIN (සඤ්ඤක අකුරු ස්වර අතර පමණි); WWG-SYL 2005; SI-WP-SANDHI (ගාත්‍රාක්ෂර ලෝප උදාහරණ).

PH-004: ඞ (nga) සහ ං වචන මුලට නොයෙදේ ​

  • ප්‍රකාශය: කණ්ඨජ නාසිකය /ŋ/ වචන මුලට නොයෙදේ. ඞ ස්වාධීන අකුරක් ලෙස ලියන්නේ ඉතා කලාතුරකිනි. /ŋ/ ලියන්නේ ං (anusvara) මගිනි. ස්වදේශීය වචනවල එය යෙදෙන්නේ වචන අගට සහ කණ්ඨජ අකුරුවලට පෙරය.
  • උදාහරණ: ගං gaŋ "ගංගා (බහු.)"; අං aŋ "සතුන්ගේ අං"; සිංහල siŋhələ; වාඞ්මය (කලාතුරකින් හමු වන සංස්කෘත අක්ෂර වින්‍යාසය).
  • ව්‍යතිරේක: ඞ හමු වන්නේ වාඞ්මය සහ පැරණි සඞ්ඝ (දැන් බොහෝ විට සංඝ) වැනි සංස්කෘත අක්ෂර වින්‍යාස කිහිපයක පමණි.
  • අදාළ වන්නේ: nga, anusvara.
  • විශ්වාසය: ඉහළ.
  • මූලාශ්‍ර: WWG-G2P 2006 §2.2 (Disanayaka 1995 උපුටා දක්වයි); EN-WP-SIN; KNAB 1989 සටහන 1 (ං සාමාන්‍යයෙන් ඞ වෙනුවට යෙදේ).

PH-005: අනෙක් ව්‍යඤ්ජන: වචන මුලට යෙදිය හැක්කේ කුමන ඒවාද ​

  • ප්‍රකාශය: /ŋ/ සහ සඤ්ඤක අකුරු හැර අනෙක් සියලු ව්‍යඤ්ජන අකුරු වචන මුලට යෙදිය හැකිය. අකුරු දෙකක් ගැන විශේෂ සටහනක් අවශ්‍ය වේ:
    • ණ (nna) වචන මුලට යෙදෙන්නේ වචන කිහිපයක පමණි: ණය ṇayə "ආපසු ගෙවිය යුතු මුදල", සහ සමහර සංස්කෘත වචන.
    • ළ (lla) ස්වදේශීය වචන මුලට යෙදේ: ළමයා, ළඟ, ළිඳ, ළපටි, ළය, ළද, ළසෝ, ළහිරු. වචනයක් ආරම්භ කරන විට එය කිසි විටෙක hal නොගනී.
  • උදාහරණ: ඉහත කරුණු දෙක බලන්න.
  • ව්‍යතිරේක: WWG-G2P, Disanayaka උපුටා දක්වමින් කියන්නේ /ŋ/ "සහ නාසික" හැර සියලු ව්‍යඤ්ජන වචන මුලට යෙදෙන බවයි. /n/ සහ /m/ පැහැදිලිවම වචන මුලට යෙදෙන නිසා, මෙහි අදහස බොහෝ විට සඤ්ඤක අකුරු (PH-003) විය යුතුය. "නාසික" යන්න වචනානුසාරයෙන් ගතහොත් ණ-ආරම්භක වචන වැරදියට බැහැර වේ.
  • අදාළ වන්නේ: nna, lla, nya (ඤ ඉතා දුර්ලභ වේ; ඥ-ආරම්භක වචන සුලබ වේ: ඥාති, ඥානය).
  • විශ්වාසය: ළ සඳහා ඉහළ; ණ සඳහා මධ්‍යම (වචන කිහිපයක් පමණි).
  • මූලාශ්‍ර: SI-WP-AV (ළ-ආරම්භක ලැයිස්තුව); WWG-G2P 2006 §2.2; ණය පෙළ සංග්‍රහයේ සුලබය (NLPC 22,276).

PH-006: ස්වර: වචන මුලට කිසි විටෙක නොයෙදෙන්නේ ඎ පමණි; ඏ ඐ භාවිතයෙන් ඉවත් වී ඇත ​

  • ප්‍රකාශය: ඎ (ruu) හැර අනෙක් සියලු ස්වතන්ත්‍ර ස්වර අකුරු වචන මුලට යෙදිය හැකිය. ඌ, ඍ, ඓ, ඖ වචන මුලට යෙදෙන්නේ සංස්කෘත ණය වචනවල පමණි. ඏ සහ ඐ (ilu, iluu) වර්තමාන සිංහලයේ නොයෙදේ.
  • උදාහරණ: ඍතුව rituvə "වසරේ කාල පරිච්ඡේදය"; ඍණ riṇə "අඩු (ගණිතයේ)"; ඓතිහාසික aitihāsika; ඖෂධ auṣadha.
  • ව්‍යතිරේක: වචනයක් තුළ ස්වතන්ත්‍ර ස්වර අකුරක් යෙදෙන්නේ සමාස සීමාවක හෝ ස්ථාන නාමයක පමණි (PH-009).
  • අදාළ වන්නේ: ru, ruu, ilu, iluu, ai, au.
  • විශ්වාසය: ඉහළ.
  • මූලාශ්‍ර: WWG-G2P 2006 §2.2; EN-WP-SCRIPT; SI-WP (සිංහල හෝඩිය).

PH-007: වචන අග: ස්වරය, හල් ව්‍යඤ්ජනය හෝ ං ​

  • ප්‍රකාශය: ලිඛිත ස්වදේශීය වචනයක් අවසන් වන්නේ ක්‍රම තුනෙන් එකකිනි:
    • ස්වරයකින්: [ə] ලෙස උච්චාරණය වන ආවේණික a (පොත), හෝ පැහැදිලි ස්වර ලකුණක් (පොතේ, ගුරු);
    • හල් ව්‍යඤ්ජනයකින්, සුලබ ලෙස ත් ක් ස් ල් න් ම් (පොත්, මලක්, ගස්, මල්, ගම්, කන්); ට් සහ ර් බොහෝ විට යෙදෙන්නේ ණය වචනවලය (කාර්, නෝට්);
    • ං මගින්: ගං, අං, ළිං. සඤ්ඤක අකුරකින් වචනයක් කිසි විටෙක අවසන් නොවේ.
  • කථන සටහන: කථනයේදී වචන අගට එන හල් නාසිකය (න්, ම්) [ŋ] ලෙස උච්චාරණය වේ (EN-WP-SIN: අවසාන නාසික "/ŋ/ බවට හැකිලේ"). සිංහල ලතින් අකුරින් කනට ඇසෙන ලෙස ලියන අය ලිඛිත -න් සඳහා -ng ලිවිය හැකිය (උදා: මිනිසුන් සඳහා minisuŋ).
  • උදාහරණ: මිනිසුන් minisun [minisuŋ]; ගමන් gaman [gamaŋ]; කරනවා.
  • ව්‍යතිරේක: ණය වචනවල අවසාන ෆ්, ජ්, ච් ආදිය ද යෙදේ: ෆෝන් fōn, ගරාජ් garāj, ස්විච්. ඉංග්‍රීසි ණය වචනවල අවසාන ලිඛිත -ම් [m] ලෙසම පවතී.
  • අදාළ වන්නේ: hal, anusvara, na, ma.
  • විශ්වාසය: ඉහළ ([ŋ] උච්චාරණය); මධ්‍යම (ස්වදේශීය අවසාන හල් ව්‍යඤ්ජනවල නිශ්චිත කට්ටලය).
  • මූලාශ්‍ර: EN-WP-SIN; WWG-G2P 2006 Rule #5; KNAB 1989.

PH-008: ද්විත්වය: ස්වර අතර පමණි; සඤ්ඤක, ŋ, f, h, ś සමඟ කිසි විටෙක නැත ​

  • ප්‍රකාශය: සඤ්ඤක අකුරු, /ŋ/, /f/, /h/ සහ /ʃ/ හැර ඕනෑම ව්‍යඤ්ජනයක් ස්වර අතර දෙගුණ කළ හැකිය (C්C). ද්විත්ව ව්‍යඤ්ජන සුලබ වන අතර ඒවා අර්ථ භේදයක් ද දක්වයි: ස්වදේශීය බහුවචන සහ ඒකවචන නිශ්චිත රූප අතර වෙනස, අතීත කාල රූප, සහ ණය වචන සිංහලයට අනුගත කිරීම.
  • උදාහරණ: අම්මා, අක්කා, ගත්තා gattā, මල්ලී, ගින්න (ගිනි යන්නෙන්), නෝට්ටුව, කෝච්චිය.
  • ව්‍යතිරේක: විද්වත් සංස්කෘත අක්ෂර වින්‍යාසයේ ශ්ශ යෙදේ: නිශ්ශබ්ද, නිශ්ශංක. මෙහි අක්ෂර වින්‍යාසය අනුගමනය කරන්නේ කථනයේ ශබ්ද සංයෝජන නීති නොව සංස්කෘත සන්ධියයි.
  • අදාළ වන්නේ: nnga nndda nda mba nga fa ha sha හැර සියල්ල.
  • විශ්වාසය: ඉහළ (කථන නීතිය); මධ්‍යම (ශ්ශ ව්‍යතිරේක).
  • මූලාශ්‍ර: EN-WP-SIN; SI-WP-AV (නිශ්ශබ්ද).

PH-009: ස්වර දෙකක් එක ළඟ යෙදීම (hiatus) වළක්වයි; වචනයක් තුළ VV ඉතා දුර්ලභයි ​

  • ප්‍රකාශය: ස්වදේශීය වචනවල එක ළඟ ස්වර දෙකක් ඇත්තේ ඉතා කලාතුරකිනි. ප්‍රකෘතිය සහ ප්‍රත්‍යය හමු වන තැන ස්වර දෙකක් එක ළඟ ඇති වුවහොත් එය සැමවිටම නිරාකරණය වේ:
    • නාම පද අර්ධ ස්වරයක් ඇතුළු කරයි (SN-010).
    • ක්‍රියා පද සාමාන්‍යයෙන් එක් ස්වරයක් ඉවත් කරයි. අර්ධ ස්වරයක් ඇතුළු කරන්නේ අවසාන විසඳුම ලෙස පමණි. එකම වචනයක් තුළ ව්‍යඤ්ජනයකට පසු ස්වතන්ත්‍ර ස්වර අකුරක් යෙදෙන්නේ ප්‍රායෝගිකව සමාස හෝ ස්ථාන නාම සීමාවලදී පමණි.
  • උදාහරණ: ගිරිඋල්ල giri-ulla (ස්ථාන නාමය); රෑ + අ → රෑය rǣyə; තොප්පි + අ → තොප්පිය toppiyə.
  • අදාළ වන්නේ: සියලු ස්වර; ya, va.
  • විශ්වාසය: ඉහළ.
  • මූලාශ්‍ර: WWG-SYL 2005 Rule #3 (පෙළ සංග්‍රහයේ අක්ෂර 78,775 න් 71 ක් පමණි); ZYGIS 2010 (Smith 2001 උපුටා දක්වයි).

PH-010: ස්වදේශීය වචනවල ද්විස්වර V + ය / V + ව ලෙස ලියැවේ ​

  • ප්‍රකාශය: උච්චාරණයේ ද්විස්වර (diphthongs) [ai au ui ei æi oi iu eu æu ou] ලියන්නේ ස්වරයකට පසු යි හෝ වු යෙදීමෙනි. ඓ/ෛ සහ ඖ/ෞ යොදන්නේ සංස්කෘත වචනවල පමණි.
  • උදාහරණ:
    • ස්වදේශීය: අයියා aiyā [ajjaː]; ළමයි [ḷamai]; අවුරුදු [auruḍu]; හයි, කැමතියි.
    • සංස්කෘත: දෛනික, වෛද්‍ය, පෞද්ගලික, ඖෂධ.
  • ව්‍යතිරේක: සමහර ඉංග්‍රීසි ණය වචනවල මේ ආකාර දෙකෙන් ඕනෑම එකක් යෙදේ, උදා: මයික්‍රෆෝනය (EN-WP-LOAN mayikrafōnaya).
  • අදාළ වන්නේ: ai, au, ya, va, i, u.
  • විශ්වාසය: ඉහළ.
  • මූලාශ්‍ර: WWG-G2P 2006 Table 5 (ද්විස්වර සිතියම්කරණය /a j i/ → /ai/, /a w u/ → /au/, ආදිය); EN-WP-LOAN.

PH-011: [ə] ස්වරය අක්ෂරයක මුලට නොයෙදේ (කර- රූප හැර) ​

  • ප්‍රකාශය: ස්වනිමික /ə/ අක්ෂර මුලට නොයෙදේ. ව්‍යතිරේක වන්නේ kərə "කරනවා" යන ක්‍රියා ප්‍රකෘතියේ වරනැඟූ රූප පමණි. වචන මුලට /ə, əː/ යෙදෙන්නේ ඉංග්‍රීසි ණය වචනවල පමණි. ඒවා ලියන්නේ අ මගිනි.
  • උදාහරණ: කරනවා kərənəwā. ඉංග්‍රීසි urgent → අ යොදා ලියයි (උදා: අර්ජන්ට්, දුර්ලභය: NLPC 5).
  • අදාළ වන්නේ: a.
  • විශ්වාසය: මධ්‍යම (මූලාශ්‍ර පෙළ තරමක් විකෘති වී ඇත).
  • මූලාශ්‍ර: WWG-G2P 2006 §2.1–2.2 (Karunatillake 2004 උපුටා දක්වයි).

PH-012: ලිඛිත ර + යංශයට ඉඩ නැත; rya ලියන්නේ රේඵය + ය ලෙසයි ​

  • ප්‍රකාශය: SLS 1134 අනුව ර ට පසු යංශය නොයෙදේ. /rya/ අනුක්‍රමය ලියන්නේ ර්‍ය (රේඵය + ය) ලෙසයි, යංශය සහිත ර්‍ය ලෙස නොවේ.
  • උදාහරණ: කාර්ය (SLS 1134 අනුව නිවැරදි), කාර‍්‍ය නොවේ; සූර්ය; වීර්ය; ආශ්චර්ය.
  • ව්‍යතිරේක: පැරණි මුද්‍රණවල rya ලියූයේ ය්‍ය ලෙසයි (උදා: කාය්‍ය, සූය්‍ය, ආචාය්‍ය). නූතන පෙළේ මෙම රූප දුර්ලභය: කාය්‍ය NLPC 0 (ප්‍රත්‍ය සහිතව 5), සූය්‍ය 3, ආචාය්‍ය 0 (ප්‍රත්‍ය සහිතව 11). ඊට සාපේක්ෂව කාර්ය 18,722, සූර්ය 3,193, ආචාර්ය 19,206 වේ. පැරණි මුද්‍රණ සම්මුතිය පිළිබඳ මූලාශ්‍රයක් පරිශීලනය කර නැත [විසඳා නැත].
  • අදාළ වන්නේ: ra, ya, ZWJ, hal.
  • විශ්වාසය: ඉහළ (SLS නීතිය); අඩු (ඓතිහාසික විකල්පය).
  • මූලාශ්‍ර: UNICODE-ML 2016 (SLS 1134:2011 උපුටා දක්වයි).

2. සන්ධි (sandhi): රූපිම එක් වන විට අක්ෂර වින්‍යාසය වෙනස් වීම ​

සිංහල පාසල් ව්‍යාකරණයේ ස්වදේශීය සන්ධි වර්ග දහයක් දැක්වේ (SI-WP-SANDHI; PIRIVEN-SANDHI). විද්වත් වචන මාලාවේ සංස්කෘත සන්ධි ද (දීර්ඝ, ගුණ, වෘද්ධි, යණ්, විසර්ග) ඇත. බොහෝ තත්සම වචනවල අක්ෂර වින්‍යාසය තුළ මේවා ස්ථිරව පිහිටා ඇත.

SN-001: ස්වර සන්ධිය (ස්වරයක් අවසාන හල් ව්‍යඤ්ජනයක් හා එක් වේ) ​

  • ප්‍රකාශය: පළමු පදයේ අවසාන ව්‍යඤ්ජනයේ hal ඉවත් වේ. දෙවන පදයේ මුල් ස්වරය එම ව්‍යඤ්ජනයට ස්වර ලකුණක් ලෙස එක් වේ.
  • උදාහරණය: මල් + අසුන → මලසුන mal + asuna → malasuna.
  • අදාළ වන්නේ: hal; සියලු ස්වර.
  • විශ්වාසය: ඉහළ.
  • මූලාශ්‍ර: SI-WP-SANDHI; PIRIVEN-SANDHI.

SN-002: පූර්වස්වර ලෝප සන්ධිය (පළමු පදයේ අවසාන ස්වරය ලොප් වේ) ​

  • උදාහරණ:
    • නැණ + ඇති → නැණැති
    • දකුණු + ඇස → දකුණැස
    • සුර + ඉඳු → සුරිඳු
    • නර + ඉඳු → නරිඳු
    • යන + එන → යනෙන
    • කර්ණ + ආභරණ → කර්ණාභරණ
    • දන්ත + ආලේප → දන්තාලේප
  • අදාළ වන්නේ: සියලු ස්වර.
  • විශ්වාසය: ඉහළ.
  • මූලාශ්‍ර: SI-WP-SANDHI; PIRIVEN-SANDHI.

SN-003: පරස්වර ලෝප සන්ධිය (දෙවන පදයේ මුල් ස්වරය ලොප් වේ) ​

  • උදාහරණ: ගුරු + උතුමා → ගුරුතුමා; මුනි + උතුමා → මුනිතුමා; යති + උතුමා → යතිතුමා.
  • අදාළ වන්නේ: u, i.
  • විශ්වාසය: ඉහළ.
  • මූලාශ්‍ර: SI-WP-SANDHI.

SN-004: ස්වරාදේශ සන්ධිය (ස්වර ආදේශය; බොහෝ දුරට සංස්කෘත guṇa/vṛddhi) ​

  • ප්‍රකාශය: ස්වර දෙකක් එක් වී තුන්වන ස්වරයක් සෑදේ:
    • අ/ආ + ඉ/ඊ → එ/ඒ
    • අ/ආ + උ/ඌ → ඔ/ඕ
    • අ/ආ + එ/ඓ → ඓ
    • අ/ආ + ඔ/ඖ → ඖ
  • උදාහරණ:
    • සහ + උදර → සහෝදර
    • වට + උර → වටොර
    • දේව + ඉන්ද්‍ර → දේවේන්ද්‍ර
    • මහා + උත්සව → මහෝත්සව
    • මහා + ඖෂධ → මහෞෂධ
    • ඒක + ඒක → ඒකෛක
    • ජාතික + අභිමානය → ජාතිකාභිමානය (විකිපීඩියාව මෙය ස්වරාදේශ යටතේ දක්වයි, නමුත් ඇත්තෙන්ම එය දීර්ඝ ආකාරයේ ප්‍රතිඵලයකි)
  • අදාළ වන්නේ: a aa i ii u uu e ee o oo ai au.
  • විශ්වාසය: ස්වදේශීය උදාහරණ සඳහා ඉහළ; සංස්කෘත guṇa/vṛddhi උදාහරණ සඳහා මධ්‍යම (සම්මත සංස්කෘත සන්ධියයි, සිංහල ව්‍යාකරණ ග්‍රන්ථයකින් පරීක්ෂා කර නැත) [විසඳා නැත].
  • මූලාශ්‍ර: SI-WP-SANDHI; PIRIVEN-SANDHI (අ+ඉ→එ, අ+උ→ඔ/ඕ, එ+අ→ඈ දක්වයි). සංස්කෘත නීති පොදු සංස්කෘත සන්ධියෙන් (dīrgha/guṇa/vṛddhi) ගත් ඒවාය.

SN-005: තත්සම වචනවල දීර්ඝ (savarṇa-dīrgha) සන්ධිය ​

  • ප්‍රකාශය: සමාන ස්වර දෙකක් එක් වී එම ස්වරයේ දීර්ඝ රූපය සෑදේ: අ+අ→ආ, ඉ+ඉ→ඊ, උ+උ→ඌ.
  • උදාහරණ: ධර්ම + අශෝක → ධර්මාශෝක; කවි + ඉන්ද්‍ර → කවීන්ද්‍ර; ගුරු + උපදේශ → ගුරූපදේශ; විද්‍යා + ආලය → විද්‍යාලය.
  • අදාළ වන්නේ: aa, ii, uu.
  • විශ්වාසය: මධ්‍යම (සිංහල ව්‍යාකරණ ග්‍රන්ථයකින් පරීක්ෂා කර නැත) [විසඳා නැත].
  • මූලාශ්‍ර: පොදු සංස්කෘත සන්ධිය (dīrgha සන්ධිය).

SN-006: යණ් සන්ධිය: අසමාන ස්වරයකට පෙර ඉ/උ → ්‍ය / ්ව ​

  • ප්‍රකාශය: වෙනත් ස්වරයකට පෙර අවසාන ඉ, ්‍ය (යංශය) බවටත්, අවසාන උ, ්ව බවටත් පත් වේ. විද්වත් වචනවල ඇති C + ්‍ය සහ C + ්ව පොකුරු බොහොමයක මූලය මෙයයි.
  • උදාහරණ:
    • ඉති + ආදි → ඉත්‍යාදි
    • අති + අන්ත → අත්‍යන්ත
    • ප්‍රති + උත්තර → ප්‍රත්‍යුත්තර
    • අනු + එෂණ → අන්වේෂණ
    • සු + ආගත → ස්වාගත
  • අදාළ වන්නේ: ya (යංශය), va, hal, ZWJ.
  • විශ්වාසය: මධ්‍යම (සිංහල ව්‍යාකරණ ග්‍රන්ථයකින් පරීක්ෂා කර නැත) [විසඳා නැත].
  • මූලාශ්‍ර: පොදු සංස්කෘත සන්ධිය.

SN-007: ගාත්‍රාක්ෂර ලෝප සන්ධිය (ව්‍යඤ්ජනයකට පෙර සඤ්ඤක අකුරේ ස්පර්ශ කොටස ලොප් වේ) ​

  • ප්‍රකාශය: පළමු පදය අගට ඇති සඤ්ඤක අකුර එහි ස්පර්ශ කොටස අත්හැර ං බවට හෝ එම උච්චාරණ ස්ථානයේම (homorganic) හල් නාසිකයක් බවට පත් වේ.
  • උදාහරණ: ගඟ + වතුර → ගංවතුර; කොළඹ + තොට → කොළොම්තොට (ස්වර වෙනස ද සලකන්න).
  • අදාළ වන්නේ: nnga nndda nda mba nyja → anusvara / ma+hal / na+hal.
  • විශ්වාසය: ඉහළ.
  • මූලාශ්‍ර: SI-WP-SANDHI; PIRIVEN-SANDHI.

SN-008: ගාත්‍රාදේශ සන්ධිය (ව්‍යඤ්ජන ආදේශය) ​

  • ප්‍රකාශය: එක් ව්‍යඤ්ජනයක් වෙනුවට තවත් ව්‍යඤ්ජනයක් යෙදේ. සුලබ ආදේශ: ක → ය/ව, බ් → ප්, ද් → ත්.
  • උදාහරණය: ගිනි + කම් → ගිනියම්.
  • අදාළ වන්නේ: ka, ya, va, ba, pa, da, ta.
  • විශ්වාසය: මධ්‍යම (ආදේශ කට්ටලය දක්වන්නේ එක් මූලාශ්‍රයක් පමණි).
  • මූලාශ්‍ර: PIRIVEN-SANDHI.

SN-009: පූර්වරූප / පරරූප / ද්විත්වරූප (සමීකරණය සහ ද්විත්වය) ​

  • ප්‍රකාශය: සන්ධි ස්ථානයේදී එක් ව්‍යඤ්ජනයක් අනෙකට සමාන වී ද්විත්ව ව්‍යඤ්ජනයක් සෑදේ.
    • Pūrvarūpa: පළමු ව්‍යඤ්ජනය දෙවන ව්‍යඤ්ජනයේ තැනට ද යෙදේ.
    • Pararūpa: දෙවන ව්‍යඤ්ජනය පළමු ව්‍යඤ්ජනයේ තැනට ද යෙදේ.
    • Dvitva: පළමු පදයේ අවසාන ස්වරය ලොප් වී එහි ව්‍යඤ්ජනය දෙගුණ වේ.
  • උදාහරණ:
    • පූර්වරූප: වත් + කම් → වත්තම්; අත් + කම් → අත්තම්; සිත් + කම් → සිත්තම්
    • පරරූප: අත් + සන → අස්සන; අත් + ලස් → අල්ලස්; ලක් + ගල → ලග්ගල
    • ද්විත්වරූප: වැදි + ආ → වැද්දා; වක් + අත්ත → වක්කත්ත
  • අදාළ වන්නේ: ද්විත්ව කළ හැකි ඕනෑම ව්‍යඤ්ජනයක් (PH-008); hal.
  • විශ්වාසය: ඉහළ.
  • මූලාශ්‍ර: SI-WP-SANDHI; PIRIVEN-SANDHI.

SN-010: ආගම සන්ධිය / අර්ධ ස්වර ඇතුළු කිරීම (යකාරාගම, වකාරාගම) ​

  • ප්‍රකාශය: ස්වර දෙකක් අතර නව ව්‍යඤ්ජනයක් (සාමාන්‍යයෙන් ය හෝ ව, සමහර විට ර) ඇතුළු වේ. නාම පද වරනැඟීමේදී මෙය ස්වයංක්‍රීයව සිදු වේ. යෙදෙන අර්ධ ස්වරය ප්‍රකෘතියේ අවසාන ස්වරය මත රඳා පවතී:
    • ය [j] ඉදිරි ස්වරවලට (front vowels) පසු: ඉ, ඊ, එ, ඒ, ඇ, ඈ.
    • ව [w] පශ්චාත් ස්වරවලට (back vowels) සහ ආ ට පසු: උ, ඌ, ඔ, ඕ, ආ.
    • අ ට පසු සාමාන්‍යයෙන් අර්ධ ස්වරයක් ඇතුළු වීම වෙනුවට ස්වරය ලොප් වේ (පොත + ඒ → පොතේ). මෙය උදාහරණවලින් කළ අනුමානයකි; මූලාශ්‍ර එය ප්‍රකාශ නොකරයි [විසඳා නැත].
  • උදාහරණ:
    • සන්ධි: පිරි + අත් → පිරියත්; කටු + අල → කටුවල; දැන් + දු → දැනුදු
    • ඒකවචන නිශ්චිත නාම පද: රෑ + අ → රෑය rǣyə; තොප්පි + අ → තොප්පිය toppiyə; අසු + අ → අසුව aśuwə; මාලිගා + අ → මාලිගාව māligāwə
    • වෙනත්: පුටුව, හාමු → හාමුවේ, ලෝකය
  • ව්‍යතිරේක: ක්‍රියා පද සාමාන්‍යයෙන් අර්ධ ස්වරයක් ඇතුළු කරනවා වෙනුවට ස්වරයක් ලොප් කරයි.
  • අදාළ වන්නේ: ya, va, ra.
  • විශ්වාසය: i/e/æ ට පසු y සහ u/o/aa ට පසු w යන බෙදීම සඳහා ඉහළ (ZYGIS හි උදාහරණ හතරක් සහ පෙළපොත් උදාහරණ); අ පිළිබඳ පොදු නිගමනය සඳහා මධ්‍යම.
  • මූලාශ්‍ර: SI-WP-SANDHI; PIRIVEN-SANDHI (ආගම මගින් ව, ය, ර ඇතුළු වේ); ZYGIS 2010, Smith 2001 උපුටා දක්වමින්.
  • සටහන: "යකාරාගම / වකාරාගම" යන පද පරිශීලනය කළ මූලාශ්‍රවල හමු නොවීය. ඒවා අවිධිමත් නම් ලෙස පෙනේ. පාසල් ව්‍යාකරණය "ආගම සන්ධිය" යන නම භාවිත කරයි.

SN-011: විසර්ග / s-අන්ත උපසර්ග සන්ධිය (නිස්-, දුස්-, මනස්-) ශ/ෂ/ර් අක්ෂර වින්‍යාසය තීරණය කරයි ​

  • ප්‍රකාශය: -s/-ḥ න් අවසන් වන සංස්කෘත උපසර්ග ඊළඟ ශබ්දය අනුව රූපය වෙනස් කරයි:
    • ක/ප ට පෙර → ෂ්
    • ච/ජ ට පෙර → ශ්
    • ඝෝෂ ශබ්ද (voiced) සහ ස්වරවලට පෙර → ර් (නිර්-, දුර්-)
    • ඝෝෂ ශබ්දවලට පෙර -අස් → ඕ
  • උදාහරණ:
    • දුස් + කර → දුෂ්කර; නිස් + පාදන → නිෂ්පාදන
    • නිස් + චල → නිශ්චල; දුස් + චරිත → දුශ්චරිත
    • නිස් + මාණ → නිර්මාණ; දුස් + වල → දුර්වල
    • මනස් + භාව → මනෝභාව; යසස් + ධරා → යශෝධරා
  • අදාළ වන්නේ: sha, ssa, ra+hal (රේඵය), oo, visarga.
  • විශ්වාසය: මධ්‍යම. ප්‍රතිඵලයක් ලෙස ලැබෙන අක්ෂර වින්‍යාසය SI-WP-AV මගින් තහවුරු වේ (ක/ප ට පෙර ෂ; ච ට පෙර ශ). ව්‍යුත්පත්ති සිංහල ව්‍යාකරණ ග්‍රන්ථයකින් පරීක්ෂා කර නැත [විසඳා නැත].
  • මූලාශ්‍ර: SI-WP-AV; LETSLEARN.

SN-012: -ika (තද්ධිත) ව්‍යුත්පත්තිය පළමු ස්වරය දීර්ඝ කරයි (vṛddhi) ​

  • ප්‍රකාශය: -ika (සහ ඒ හා සමාන ප්‍රත්‍යය) එක් කිරීමෙන් ප්‍රකෘතියේ පළමු ස්වරය දීර්ඝ හෝ ශක්තිමත් වේ: අ→ආ, ඉ/එ→ඓ, උ/ඔ→ඖ.
  • උදාහරණ: පරිසර → පාරිසරික; පුද්ගල → පෞද්ගලික; දිනය → දෛනික; ලෝකය → ලෞකික; සමාජ → සාමාජික; ඉතිහාස → ඓතිහාසික.
  • අදාළ වන්නේ: aa, ai, au.
  • විශ්වාසය: ඉහළ.
  • මූලාශ්‍ර: LETSLEARN (පරිසර→පාරිසරික, පුද්ගල→පෞද්ගලික).

SN-013: ක්‍රියා පදවල අතීත රූපවල ස්වර වෙනස (umlaut) (a→æ, o→e, u→i) ​

  • ප්‍රකාශය: සමහර ප්‍රත්‍යය ප්‍රකෘතියේ ස්වරය ඉදිරි ස්වරයක් බවට පත් කරයි: අ→ඇ, ඔ→එ, උ→ඉ.
  • උදාහරණ: බලනවා → බැලුවා; කපනවා → කැපුවා; අදිනවා → ඇද්දා; කොටනවා → කෙටුවා (NLPC 279).
  • අදාළ වන්නේ: ae, aee, e, i.
  • විශ්වාසය: ඉහළ (ක්‍රියාවලිය); මධ්‍යම (නිශ්චිත රූප).
  • මූලාශ්‍ර: EN-WP-SIN (ශබ්ද විද්‍යා හැඳින්වීම).

SN-014: නාම පදවල ඒකවචන/බහුවචන වෙනස්වීම් ද්විත්ව ව්‍යඤ්ජන සහ හල් අග සාදයි ​

  • ප්‍රකාශය:
    • අප්‍රාණවාචී නාම පද: බහුවචනය බොහෝ විට හල් කළ ප්‍රකෘතිය පමණි. ඒකවචන නිශ්චිත රූපයට -ය/-ව/-අ එක් වේ.
    • ඉ/උ න් අවසන් වන ප්‍රකෘතිවල ඒකවචනයේ අවසාන ව්‍යඤ්ජනය දෙගුණ වේ.
  • උදාහරණ: පොත් (බහු.) / පොත (ඒක.); ගස් / ගස; ගිනි → ගින්න; ඇඟිලි → ඇඟිල්ල; මහලු → මහල්ලා; ලෙලි → ලෙල්ල; කකුල් / කකුල.
  • අදාළ වන්නේ: hal; ද්විත්ව ව්‍යඤ්ජන (la, na…).
  • විශ්වාසය: ඉහළ.
  • මූලාශ්‍ර: WASALA-SPELL 2010 App. A §2.10, §4.3–4.4.

3. අකුරෙන් ශබ්දයට: ලිඛිත ආවේණික a [ə] ලෙස උච්චාරණය වන්නේ කවදාද ​

ලතින් අකුරින් ලියන අවිධිමත් සිංහලය උච්චාරණය අනුගමනය කරයි. [kərənəwaː] ලෙස උච්චාරණය වන වචනයක් අවිධිමත්ව ලියන්නේ karanawa හෝ keranawa ලෙසයි, kərənəwā ලෙස නොවේ. WWG-G2P 2006 මුලින්ම ලකුණු නොකළ සෑම ව්‍යඤ්ජනයකටම /ə/ ලබා දෙයි ([ə] පෙරනිමි ස්වරයයි). ඉන්පසු එය /a/ බවට වෙනස් කරන නීති නියමිත පිළිවෙළකට යොදයි. අවිධිමත් රෝමානුකරණයෙන් සිංහල අකුරුවලට පරිවර්තනය කරන පරිවර්තකයකට මෙම නීති ආපසු හැරවීමට සිදු වේ.

G2P-001: පෙරනිමිය: ලකුණු නොකළ ව්‍යඤ්ජනය [ə] දරයි ​

  • ප්‍රකාශය: ලකුණු නොකළ ව්‍යඤ්ජනයක් (ස්වර ලකුණක් නැති, hal නැති, ZWJ සංයුක්තයක පළමු අකුර නොවන) [ə] දරයි.
  • ව්‍යතිරේක: පහත G2P-002 සිට G2P-009 දක්වා නීති.
  • අදාළ වන්නේ: a.
  • විශ්වාසය: ඉහළ.
  • මූලාශ්‍ර: WWG-G2P 2006 §5.1.

G2P-002: නීතිය 1: පළමු අක්ෂරයේ ස්වරය [a] වේ ​

  • ප්‍රකාශය: පළමු අක්ෂරයේ ආවේණික ස්වරය [a] වේ. ව්‍යතිරේක:
    • (a) /sv/ ආරම්භයට පසු: ස්වර svərə;
    • (b) /kər/ න් ඇරඹෙන වචන, එනම් කර- ක්‍රියා පදයේ රූප: කරනවා kərənəwā;
    • (c) තනි අක්ෂර CV වචන: ද də, ය yə (නිපාත).
  • උදාහරණ: ගස gasə; මල malə; පහන pahanə.
  • අදාළ වන්නේ: a.
  • විශ්වාසය: ඉහළ. මෙම නීතිය පමණක් පරීක්ෂණ වචන 30,000 න් 22,766 ක් සඳහා නිවැරදි ප්‍රතිඵල දෙයි.
  • මූලාශ්‍ර: WWG-G2P 2006 Rule #1, §6.

G2P-003: නීතිය 2: C+ර පොකුරකට පසු ​

  • ප්‍රකාශය: Cr ට පසු [ə] ද [a] ද යන්න රඳා පවතින්නේ ඊළඟට එන දේ මතයි. දළ වශයෙන්:
    • හ ට පෙර, හෝ ව්‍යඤ්ජන පොකුරකට පෙර → [a]: ප්‍රහාර prahārə, ප්‍රශ්නය praśnəyə;
    • අනෙක් අවස්ථාවල → [ə]: ප්‍රකාශ prəkāśə, ක්‍රමය krəməyə, ප්‍රති prəti.
  • ව්‍යතිරේක: උපුටාගත් පෙළේ 2(b)/(c) උප නීති එකිනෙකට පරස්පර විරෝධී වේ (පෙළ විකෘති වී ඇත). නිශ්චිත කොන්දේසි අවිනිශ්චිත ලෙස සලකන්න.
  • අදාළ වන්නේ: ra (රකාරාංශය), ha.
  • විශ්වාසය: මධ්‍යම.
  • මූලාශ්‍ර: WWG-G2P 2006 Rule #2; WASALA-SPELL (ප්‍රකාශන /prəkāśənə/).

G2P-004: නීතිය 3: හ අසල [a] ​

  • ප්‍රකාශය: V+හ ට පසු එන [ə] ස්වරය [a] වේ. මෙසේ කියවන්න: {a, e, æ, o, ə} අතරින් ස්වරයක්, ඉන්පසු හ, ඉන්පසු [a] බවට පත් වන [ə] ස්වරයක්.
  • උදාහරණ: මහත mahatə; පහන pahanə; වහල wahalə.
  • අදාළ වන්නේ: ha.
  • විශ්වාසය: මධ්‍යම (PDF හි පාඨය අපැහැදිලි වේ).
  • මූලාශ්‍ර: WWG-G2P 2006 Rule #3.

G2P-005: නීතිය 4: ව්‍යඤ්ජන පොකුරකට පෙර [ə] ස්වරය [a] වේ ​

  • උදාහරණ: බලන්න balannə; කරන්න kərannə; ප්‍රශ්නය praśnəyə.
  • අදාළ වන්නේ: හල් පොකුරු, ද්විත්ව ව්‍යඤ්ජන.
  • විශ්වාසය: ඉහළ.
  • මූලාශ්‍ර: WWG-G2P 2006 Rule #4 (Karunatillake 2004 උපුටා දක්වයි).

G2P-006: නීතිය 5: වචන අගට එන ව්‍යඤ්ජනයකට පෙර [ə] ස්වරය [a] වේ ​

  • ප්‍රකාශය: වචන අගට එන (හල්) ව්‍යඤ්ජනයකට පෙර [ə] ස්වරය [a] වේ. ව්‍යතිරේක: අවසාන ව්‍යඤ්ජනය /r/, /b/ හෝ PDF හි කියවිය නොහැකි තවත් ව්‍යඤ්ජන දෙකෙන් එකක් (බොහෝ විට මූර්ධජ ස්පර්ශ) වන විට.
  • උදාහරණ: මලක් malak; ගමන් gaman.
  • අදාළ වන්නේ: hal.
  • විශ්වාසය: මධ්‍යම (ව්‍යතිරේක කියවිය නොහැකි වේ).
  • මූලාශ්‍ර: WWG-G2P 2006 Rule #5.

G2P-007: නීතිය 6: වචන අගට එන -yi ට පෙර [ə] ස්වරය [a] වේ ​

  • ප්‍රකාශය: ප්‍රතිඵලය [ai] ද්විස්වරය ලෙස උච්චාරණය වේ.
  • උදාහරණ: ළමයි ḷamayi [ḷamai]; කරයි kərayi.
  • අදාළ වන්නේ: ya, i.
  • විශ්වාසය: ඉහළ.
  • මූලාශ්‍ර: WWG-G2P 2006 Rule #6 සහ Table 5.

G2P-008: නීතිය 7: ru/lu ට පෙර /kə/, /ka/ වේ ​

  • උදාහරණ: කරුණාව karuṇāwə; කළු kaḷu.
  • අදාළ වන්නේ: ka, ra, la, lla, u.
  • විශ්වාසය: ඉහළ.
  • මූලාශ්‍ර: WWG-G2P 2006 Rule #7.

G2P-009: නීතිය 8: කල/කළ වචන කාණ්ඩයේ ස්වරය නැවත [kə] වේ ​

  • ප්‍රකාශය: /kalaːy/, /kaleː…/ වැනි රූපවල සහ /kalə/ වචනයේ පළමු [a] නැවත [ə] බවට හැරේ. කළ, කළා, කළේ kəḷə, kəḷā, kəḷē ("කළේය") ක්‍රියා රූප මෙයට අයත් වේ.
  • සටහන: මෙය සැබෑ සමලේඛ (homographs) ඇති කරයි: කල kalə "කාලය" සහ කළ kəḷə "කළේය". සමහර ලේඛනවල දෙකම කල ලෙස ලියැවේ. කර karə "උරහිස" සහ kərə "කරනවා", වන vanə සහ vənə ද එවැනිම යුගල වේ.
  • අදාළ වන්නේ: ka, la, lla.
  • විශ්වාසය: ඉහළ.
  • මූලාශ්‍ර: WWG-G2P 2006 Rule #8, §6.

G2P-010: නූතන කථනයේ එක ලෙස උච්චාරණය වන අකුරු ​

  • ප්‍රකාශය: නූතන කථනයේදී මෙම අකුරු එක ලෙසම උච්චාරණය වේ:
    • මහාප්‍රාණ අකුරු අල්පප්‍රාණ අකුර ලෙසම ඇසේ: ඛ=ක, ඝ=ග, ඡ=ච, ඣ=ජ, ඨ=ට, ඪ=ඩ, ථ=ත, ධ=ද, ඵ=ප, භ=බ;
    • ණ = න; ළ = ල;
    • ෂ = ශ (දෙකම [ʃ]; බොහෝ කථිකයන්ගේ උච්චාරණයේ ස [s] ද ඒ හා සමාන වේ);
    • ඤ ≈ ඥ (ඥ බොහෝ විට [gɲ] / "gn" ලෙස උච්චාරණය වේ).
  • ප්‍රතිඵලය: උච්චාරණයෙන්, එබැවින් ශබ්දය මත පදනම් වූ ඕනෑම රෝමානුකරණයකින්, මෙම අකුරු වෙන් කර හඳුනාගත නොහැකිය. අක්ෂර වින්‍යාසය දැනගත යුත්තේ වචන දැනුමෙනි.
  • අදාළ වන්නේ: kha gha cha jha ttha ddha tha dha pha bha nna lla ssa sha sa nya jnya.
  • විශ්වාසය: ඉහළ.
  • මූලාශ්‍ර: WWG-G2P 2006 §2.2 (Karunatillake 2004 උපුටා දක්වයි); WASALA-SPELL 2010 §III-A; KNAB 1989 (ඥ [gnʲ]).

G2P-011: ෘ (ru) සාමාන්‍යයෙන් [ru] වේ, නමුත් වචන මුලදී [ri] ද වචන කිහිපයක [ur] ද වේ ​

  • ප්‍රකාශය: ෘ ස්වර ලකුණ සාමාන්‍යයෙන් [ru] ලෙස උච්චාරණය වේ. වචන මුලට එන ස්වතන්ත්‍ර ස්වරය (ඍ) ලෙස එය [ri] වේ. වචන 13 ක් පමණ තුළ එය [ur] වේ.
  • උදාහරණ:
    • [ru]: කෘති kruti; පෘෂ්ඨය pruṣṭhəyə; උත්කෘෂ්ට utkruṣṭə
    • [ri] මුලදී: ඍණ riṇə
    • [ur]: ප්‍රවෘත්ති pravurtti; සමෘද්ධි samurddhi; විවෘත vivurtə
  • පටලැවීමේ අවදානම: රෝමානුකරණය කළ kru යන්නෙන් කෘ හෝ ක්‍රු අදහස් විය හැකිය. දෙකම [kru] ලෙස කියවේ. ව්‍යුත්පත්තියේ r + u ඇති තැන්වල පවා C + ෘ/ෲ සුලබ ලිඛිත රූපය වේ: krūra "නපුරු" බොහෝ විට කෲර ලෙස ලියැවේ, ක්‍රූර ලෙස ලියන්නේ කලාතුරකිනි (02:VS-035). කෘෂි kruṣi සමඟ සසඳන්න. ඇතැම් වචනවල [ru] අපේක්ෂා කරන තැන ු/ූ ලකුණු යෙදෙන බව ද පත්‍රිකාව කියයි. එහි උදාහරණ PDF හි කියවිය නොහැකි වේ.
  • අදාළ වන්නේ: ru, ruu, ra.
  • විශ්වාසය: ඉහළ.
  • මූලාශ්‍ර: WWG-G2P 2006 §6 (දෝෂ විශ්ලේෂණය, Disanayaka 2000 උපුටා දක්වයි).

G2P-012: දීර්ඝව උච්චාරණය වන ඥාති පදවල කෙටි අක්ෂර වින්‍යාසය ​

  • ප්‍රකාශය: සමහර වචන ා නැතිව ලියා ඇතත් [aː] ලෙස උච්චාරණය වේ. මේවා අවිධිමත් අක්ෂර වින්‍යාසයයි: අම්ම ammā, අක්ක akkā, ගත්ත gattā. සම්මත ලිඛිත රූප අම්මා, අක්කා, ගත්තා වේ.
  • අදාළ වන්නේ: aa.
  • විශ්වාසය: මධ්‍යම.
  • මූලාශ්‍ර: WWG-G2P 2006 §6.

G2P-013: වචන ආඝාතය (stress) ​

  • ප්‍රකාශය: ආඝාතය වැටෙන්නේ පළමු අක්ෂරය මතයි (කරනවා ආකාරයේ රූප හැර). දීර්ඝ ස්වර සැමවිටම ආඝාත සහිත වේ. ආඝාතය නැති කෙටි a [ə] බවට පත් වේ. බර අක්ෂරයකට පසු වචන අගට එන දීර්ඝ ස්වර කථනයේදී කෙටි විය හැකිය, නමුත් අක්ෂර වින්‍යාසයේ ඒවා දීර්ඝවම පවතී.
  • අදාළ වන්නේ: a, aa, දීර්ඝ ස්වර.
  • විශ්වාසය: මධ්‍යම.
  • මූලාශ්‍ර: EN-WP-SIN.

4. නිල අක්ෂර වින්‍යාස සම්මුති සහ මතභේද ​

SP-001: සම්මතය තීරණය කරන්නේ කවුද ​

  • ප්‍රකාශය: නීතියෙන් පිහිටුවූ, අන්තර්ජාලයේ ලබාගත හැකි තනි අක්ෂර වින්‍යාස සංග්‍රහයක් නැත.
    • ප්‍රායෝගික අධිකාරීන්: NIE / අධ්‍යාපන ප්‍රකාශන දෙපාර්තමේන්තුවේ පාසල් පෙළපොත්; Sinhala Shabdakoshaya (Sinhala Dictionary Office); රාජ්‍ය භාෂා දෙපාර්තමේන්තුවේ පාරිභාෂික ශබ්ද මාලා (මේවා සම්මත කරන්නේ අක්ෂර වින්‍යාස නීති නොව පාරිභාෂික පදයි); කේතනය සහ දර්ශනය සඳහා SLS 1134.
    • Hela Havula (Kumaratunga Munidasa, 1941 දී පිහිටුවන ලදී) "ශුද්ධ" සිංහල වචන මාලාව සහ සම්භාව්‍ය ව්‍යාකරණය ප්‍රවර්ධනය කරයි. එය සංස්කෘත තත්සම රූපවලට වඩා śuddha (Eḷu) හෝඩියට සහ ස්වදේශීය රූපවලට ප්‍රමුඛත්වය දෙයි. එහි නිශ්චිත අකුරු නීති පරිශීලනය කළ මූලාශ්‍රවල දක්වා නැත [විසඳා නැත]; ඉංග්‍රීසි විකිපීඩියා ලිපියේ ඒ ගැන විස්තර නැත.
  • විශ්වාසය: මධ්‍යම.
  • මූලාශ්‍ර: රාජ්‍ය භාෂා දෙපාර්තමේන්තුවේ කාර්ය සාධන වාර්තා (parliament.lk, උදා: https://www.parliament.lk/uploads/documents/paperspresented/performance-report-official-language-department-2015-si.pdf); https://en.wikipedia.org/wiki/Hela_Havula; EN-WP-SCRIPT (śuddha සහ miśra).

SP-002: Śuddha සහ miśra අකුරු ​

  • ප්‍රකාශය:
    • Śuddha (ස්වදේශීය, එළු) අකුරු ස්වදේශීය වචන ලිවීමට ප්‍රමාණවත් වේ: අල්පප්‍රාණ ස්පර්ශ, ණ, ළ, සඤ්ඤක අකුරු, ස, හ, ය, ර, ල, ව, ං.
    • Miśra අකුරු සංස්කෘත, පාලි සහ ඉංග්‍රීසි ණය වචන සඳහා යොදයි: මහාප්‍රාණ, ශ, ෂ, ඤ, ඥ, ඞ, ඦ, ෆ, ඃ, ඍ, ඎ, ඏ, ඐ, ඓ, ඖ.
    • ඦ ප්‍රායෝගිකව භාවිත නොවේ. ඥ සහ ෆ හමු වන්නේ සීමිත වචන ප්‍රමාණයක පමණි.
  • ඇඟවුම: ස්වදේශීය ලෙස පෙනෙන ප්‍රකෘතියක මහාප්‍රාණ, ශ හෝ ෂ ඇත්තේ කලාතුරකිනි. මහාප්‍රාණ හෝ ශ/ෂ ඇති වචනයක් තත්සම හෝ ණය වචනයකි.
  • අදාළ වන්නේ: සියලු miśra අකුරු හැඳුනුම්.
  • විශ්වාසය: ඉහළ.
  • මූලාශ්‍ර: EN-WP-SCRIPT; SI-WP (සිංහල හෝඩිය).

SP-003: ණ සහ න (මූර්ධජ / දන්තජ): "na-Ṇa-la-Ḷa" ගැටලුව ​

  • පසුබිම: සිංහලයේ වඩාත් සුලබ අක්ෂර වින්‍යාස දෝෂය මෙයයි. පැහැදිලි මාර්ගෝපදේශ 13 වන සියවස පමණ දක්වා පැවති බවත්, පසුව ඒවා නැති වූ බවත් කියැවේ.
  • ණ යොදන්න:
    1. නාම සහ නාම විශේෂණ පදවල ර, ෂ, ඍ/ෘ ට පසු (රකාරාංශය/රේඵය ද ඇතුළුව): තරුණ, වර්ණ, කාරණය, මරණය, දෙරණ, සරණ, ශ්‍රේණිය, ආමන්ත්‍රණ, විෂ්ණු, තෘෂ්ණා, ගවේෂණ, දක්ෂිණ;
    2. ට ඨ ඩ ඪ මූර්ධජ අකුරුවලට පෙර: කණ්ඩ, ඝණ්ටාර, පණ්ඩිත, දණ්ඩ, චණ්ඩාල;
    3. ගෞරව ප්‍රත්‍යය -ආණ/-අණු/-අණි තුළ: පියාණන්, තෙරණුවන්;
    4. අකර්මක අතීත ප්‍රත්‍යය -ණ/-ණි/-ණු තුළ: සිදුවිණි, ඉදුණු, වැටුණ, මැරුණි;
    5. සංස්කෘත/පාලියෙන් උරුම වූ ණ: රුහුණු, උණු.
  • න යොදන්න:
    1. ක්‍රියා පදවල, ර ට පසු වුවද: කරන, මරන, කරනවා, හදාරන, කරනු (විධි -නු), වර්තමාන කෘදන්ත -න;
    2. ත ථ ද ධ දන්තජ අකුරුවලට පෙර හල් නාසිකයක් ලෙස: චින්තන, ග්‍රන්ථ, කන්ද, සන්ධි;
    3. ද්විත්ව නාසිකයක: ආසන්න, වන්නම්;
    4. ස ට පෙර හල් නාසිකයක් ලෙස: පන්සල, කාන්සි, වහන්සේ;
    5. ස/ශ ට පසු: වාසනා, සේනා, දර්ශන, ප්‍රකාශන;
    6. හල් අගක් ඇති නාම ප්‍රකෘතිවල සහ බහුවචනවල: වදන්, කන්, පින්;
    7. සම්ප්‍රදාන විභක්ති රූපවල සහ -න්ට අන්ත ක්‍රියා රූපවල (infinitive) ට අකුරට පෙර: දරුවන්ට, මිනිසුන්ට, ලබන්ට;
    8. බටහිර ණය වචනවල මූර්ධජ ව්‍යඤ්ජනවලට පෙර: කවුන්ටරය, කැන්ටිම;
    9. සමාස නාම පදවල ර ට පසු: පිරිනිවන්.
  • අවම යුගල: කණ "ඇසීමේ අවයවය" / කන "අනුභව කරන"; වණ "තුවාලය" / වන "කැලෑව"; මරණ "මියයාම" / මරන "මරා දමන".
  • අදාළ වන්නේ: nna, na.
  • විශ්වාසය: ඉහළ (මූලාශ්‍ර දෙකම එකඟ වේ).
  • මූලාශ්‍ර: WASALA-SPELL 2010 App. A §1–2; SI-WP-AV; LETSLEARN.
  • ගැටුම: ස්වදේශීය වචනවල ර ට පසු "සැමවිටම" ණ යෙදෙන බව SI-WP-AV කියයි. WASALA බොහෝ ව්‍යතිරේක දක්වයි (ක්‍රියා පද, සමාස, ර-අන්ත ප්‍රකෘති). "සැමවිටම" යන්න නාම පදවලට පමණක් අදාළ ලෙස සලකන්න.

SP-004: ළ සහ ල ​

  • ළ යොදන්න:
    1. පිළි- උපසර්ගය (සංස්කෘත prati- යෙන්): පිළිතුර, පිළිබඳ, පිළිගන්නවා, පිළිවෙළ, පිළිමය;
    2. ර-අන්ත ක්‍රියා ප්‍රකෘතිවල අතීත සහ කෘදන්ත රූප: කර → කළ/කළේ; මර → මළ; හදාර → හදාළේය;
    3. සංස්කෘත/පාලි ට/ඨ/ඩ/ඪ/ණ/ළ වලින් පැවත එන රූප: කූට → කළ; දෘඪ → දළ; ක්‍රීඩා → කෙළි; වෙළඳ;
    4. ස්වදේශීය වචනවල වචන මුලදී: ළමයා, ළඟ, ළිඳ;
    5. බොහෝ විට ඟ ඳ ඹ සඤ්ඤක අකුරුවලට පෙර: ළඟ, ළඳ, කොළඹ (ල සහිත ව්‍යතිරේක: පොලඹ, සලඹ).
  • ල යොදන්න:
    1. නාම ප්‍රකෘතියක අගට එන හල් ල, වරනැඟීමේදී ද ල ලෙසම පවතී: කකුල්/කකුල, ගඩොල්, කරල්;
    2. ඉ/උ ප්‍රකෘතිවල ඒකවචනයේ ද්විත්වය: ඇඟිලි → ඇඟිල්ල, මහලු → මහල්ලා;
    3. සංස්කෘත/පාලි ල/ල්ල වලින් පැවත එන රූප: මහල්ලක → මහලු;
    4. බොහෝ ණය වචන.
  • අවම යුගල: කල "කාලය" / කළ "කළේය"; පල "ඵලය" / පළ "ප්‍රකාශ කළ" (පළාත, පළමු); වල "බහුවචනයේ 'තුළ', 'ගේ' අර්ථය" / වළ "ගැඹුරු සිදුර"; කලා "කලා ශිල්ප" / කළා "කළේය".
  • අදාළ වන්නේ: lla, la.
  • විශ්වාසය: ඉහළ.
  • මූලාශ්‍ර: WASALA-SPELL 2010 App. A §3–4; SI-WP-AV; LETSLEARN.

SP-005: ශ, ෂ සහ ස ​

  • ෂ යොදන්න:
    1. හල් ක ට පසු, එනම් ක්ෂ පොකුරේ: අක්ෂර, දක්ෂ, භික්ෂු, පරීක්ෂණ, තීක්ෂණ;
    2. ට/ඨ ට පෙර හල් ලෙස: දෘෂ්ටි, දුෂ්ට, ශිෂ්ට, අධිෂ්ඨාන, ජ්‍යෙෂ්ඨ, ශ්‍රේෂ්ඨ, කනිෂ්ඨ;
    3. ණ ට පෙර: විෂ්ණු, කෘෂ්ණ, තෘෂ්ණා;
    4. දුෂ්කර, නිෂ්පාදන හි ක/ප ට පෙර හල් ලෙස (SN-011).
  • ශ යොදන්න:
    1. තාලුජ ච/ජ සමඟ: දුශ්චරිත, ආශ්චර්ය, නිශ්චල;
    2. ව ට පෙර: විශ්වාස, ඊශ්වර, අශ්වයා;
    3. න ට පෙර: ප්‍රශ්න, දර්ශන, දේශනය;
    4. ශ ට පෙර: නිශ්ශබ්ද;
    5. ශ්‍රී;
    6. ශිෂ්‍ය, විශේෂ, ශාස්ත්‍ර හි පළමු ඌෂ්ම අකුර (sibilant) ලෙස.
  • ස යොදන්න: ස්වදේශීය වචන සහ බොහෝ තද්භව රූප: සිසු (තත්සම ශිෂ්‍ය සමඟ සසඳන්න), සත (ශත සමඟ සසඳන්න).
  • භාෂා මට්ටම්: එකම අර්ථය ඇති සංස්කෘත සහ ස්වදේශීය අක්ෂර වින්‍යාස බොහෝ විට එකට පවතී: ශිෂ්‍ය/සිසු (NLPC 12,255 / 6,714).
  • අදාළ වන්නේ: sha, ssa, sa.
  • විශ්වාසය: ඉහළ (නීති); මධ්‍යම (සම්පූර්ණත්වය: නීති සෑම වචනයක්ම ආවරණය නොකරයි).
  • මූලාශ්‍ර: SI-WP-AV; WASALA-SPELL 2010 App. A §5–6; LETSLEARN.

SP-006: මහාප්‍රාණ සහ අල්පප්‍රාණ අකුරු (aspirate / plain) ​

  • ප්‍රකාශය: මහාප්‍රාණ අකුරු යෙදෙන්නේ සංස්කෘත/පාලි වචනවල පමණි. ඒවා අල්පප්‍රාණ අකුරු ලෙසම උච්චාරණය වේ (G2P-010). ඣ, ඡ සහ ඵ දුර්ලභ වේ. මහාප්‍රාණ අකුරු වචනයක මුල, මැද හෝ අග යෙදිය හැකි බැවින් ඒවා සඳහා විශ්වාසදායක නීති නැත. ඒවා වචනයෙන් වචනය ඉගෙන ගත යුතුය.
  • උදාහරණ: ධර්ම, භාෂාව, ඛේදය, ඝෝෂා, ථේර, කථාව/කතාව.
  • විකල්ප රූප: සමහර වචනවලට මහාප්‍රාණ (තත්සම) සහ අල්පප්‍රාණ (තද්භව) අක්ෂර වින්‍යාස දෙකම ඇත. දෙකම පිළිගැනේ: කථා/කතා (NLPC 18,687 / 140,763), නාථ/නාත (NLPC 1,342 / 76).
  • අදාළ වන්නේ: kha gha cha jha ttha ddha tha dha pha bha.
  • විශ්වාසය: ඉහළ.
  • මූලාශ්‍ර: WASALA-SPELL 2010 §III-A-1.

SP-007: හ්‍රස්ව සහ දීර්ඝ ස්වර: වඩාත් සුලබ දෝෂ වර්ගය ​

  • ප්‍රකාශය: සැබෑ පෙළ සංග්‍රහයක වඩාත් සුලබ දෝෂ වූයේ ස්වර දිග දෝෂ සහ සමාන ලෙස ඇසෙන අකුරු පිළිබඳ දෝෂ බව SinSpell සොයාගත්තේය. නියාමක කරුණු:
    • ක්‍රියා නාම ප්‍රත්‍යය දීර්ඝ -ීම වේ: කිරීම, බැලීම, ලිවීම. කිරිම ලිවීම දෝෂයකි.
    • සංස්කෘත ප්‍රකෘතිවල දීර්ඝ ඊ/ඌ/ඒ/ඕ: ශ්‍රී, ගීතය, රූපය.
    • සමහර ගෞරව හෝ බහුවචන රූපවලට දීර්ඝ -ූ යෙදේද යන්න පරිශීලනය කළ මූලාශ්‍රවලින් තහවුරු නොවේ [විසඳා නැත].
  • අදාළ වන්නේ: i/ii, u/uu, e/ee, o/oo, ae/aee, a/aa.
  • විශ්වාසය: ඉහළ (ස්වර දිග ප්‍රධාන දෝෂය වීම); මධ්‍යම (නිශ්චිත ප්‍රත්‍යය නීති).
  • මූලාශ්‍ර: SINSPELL 2021; WASALA-SPELL 2010.

SP-008: පිළිගත් අක්ෂර වින්‍යාස දෙකක්: තත්ත්වය (ව්‍යාකරණානුකූල) සහ තත්වය (නූතන) ​

  • ප්‍රකාශය: වචනය සංස්කෘත tat + tva වන බැවින් ව්‍යාකරණානුකූල අක්ෂර වින්‍යාසය තත්ත්වය වේ. සත්ත්වයා ද එම රටාවම අනුගමනය කරයි. ගුරුවරු සහ විභාග මාර්ගෝපදේශ ව්‍යඤ්ජන තුනේ රූපය තබා ගනිති. කෙටි කළ තත්වය නූතන අක්ෂර වින්‍යාසය වන අතර එයද වලංගු ලෙස පිළිගැනේ. අක්ෂර වින්‍යාස දෙකම බහුලව භාවිත වේ: තත්ත්වය NLPC 25,852, තත්වය 21,484 (ප්‍රත්‍ය සහිතව 58,286 සහ 54,239); සත්ත්වයා 539, සත්වයා 1,451. මහත්ත්වය (NLPC 1) සහ මහත්වය (NLPC 11) දෙකම දුර්ලභය.
  • පවතින තත්ත්වය: රූප දෙකම පිළිගැනේ; එකක්වත් වැරදි අක්ෂර වින්‍යාසයක් නොවේ. පරිශීලනය කළ මූලාශ්‍රවල නිල තීන්දුවක් හමු නොවීය. Glosbe ශබ්දකෝෂයේ එක් ඇතුළත් කිරීමක තත්වය යොදා ඇත (https://glosbe.com/si/en/තත්වය).
  • අදාළ වන්නේ: ta, va, hal.
  • විශ්වාසය: අක්ෂර වින්‍යාස දෙකම සුලබ බවට ඉහළ (NLPC); ද්විත්ව t රූපය ව්‍යාකරණානුකූල රූපය බවට මධ්‍යම (S16, සංස්කෘත tattva).
  • නිර්දේශය: අක්ෂර වින්‍යාස දෙකම පිළිගන්න. එකක් අනෙකට කිසි විටෙක "නිවැරදි" නොකරන්න. ව්‍යාකරණානුකූල ලිවීමකට එක් රූපයක් අවශ්‍ය නම් තත්ත්වය යොදන්න.

SP-009: ව්‍යඤ්ජනයකට පෙර ං සහ හල් නාසිකය ​

  • ප්‍රකාශය:
    • හ, ල, ර, ස, ශ, ෂ, ව, ය ට පෙර ං යෙදේ (KNAB). කණ්ඨජ අකුරුවලට පෙර ඞ වෙනුවට ද එය යෙදේ: සිංහල, සංස්කෘත, සංවිධානය, හංසයා, අංකය, සංගීතය.
    • අනෙක් අවස්ථාවල විද්වත් වචනවල එම උච්චාරණ ස්ථානයේම හල් නාසිකය යෙදේ: ඕෂ්ඨජ අකුරුවලට පෙර ම් (සම්බන්ධ, කම්පනය), දන්තජ අකුරුවලට පෙර න් (සන්ධි, චින්තන), මූර්ධජ අකුරුවලට පෙර ණ් (කාණ්ඩ).
    • සංස්කෘත වචනවල එතැන ං යෙදුණත් (සංසාරය), ස්වදේශීය වචනවල ස ට පෙර න් යෙදේ (පන්සල, වහන්සේ).
  • ගැටුම: ස ට පෙර තේරීම රඳා පවතින්නේ වචනයේ ශබ්දය මත නොව එහි මූලය මතයි.
  • අදාළ වන්නේ: anusvara, na, nna, ma, nga.
  • විශ්වාසය: මධ්‍යම-ඉහළ.
  • මූලාශ්‍ර: KNAB 1989 සටහන් 1 සහ E; WASALA-SPELL App. A §2.7, §2.9.

SP-010: සඤ්ඤක අකුර සහ නාසික + ස්පර්ශ පොකුර අතර වෙනසට අර්ථයක් ඇත ​

  • ප්‍රකාශය: මේ දෙක ලියන්නේ වෙනස් ලෙසයි; ඒවායේ අර්ථ ද වෙනස් වේ. සඤ්ඤක අකුර තනි කෙටි ශබ්දයකි; පොකුර හල් නාසිකයක් සහ සම්පූර්ණ ස්පර්ශයකි.
  • උදාහරණ: කඳ kaⁿdə "ශරීරයේ කඳ" ≠ කන්ද kandə "පර්වතය"; අඹ aᵐbə "අඹ ගෙඩිය" සහ අම්බ (සුලබ වචනයක් නොවේ).
  • සටහන: සමහර අකුරු මුහුණත්වල බැඳි රූප (ඬ, ඳ) සහ ZWJ සංයුක්ත රූප (න්‍ද) එක සමාන ලෙස පෙනේ.
  • අදාළ වන්නේ: nnga, nndda, nda, mba සහ (nga|nna|na|ma)+hal+(ga|dda|da|ba).
  • විශ්වාසය: ඉහළ.
  • මූලාශ්‍ර: EN-WP-SIN (අවම කට්ටලය); KNAB 1989.

SP-011: ක්ෂ (ZWJ සහිතව හෝ රහිතව) එකම අක්ෂර වින්‍යාසයකි ​

  • ප්‍රකාශය: ක්ෂ සහ ක්‍ෂ (ZWJ සහිත) එකම අකුරු වේ: ka + hal + ssa. ZWJ කරන්නේ සම්බන්ධිත අක්ෂර රූපය ඉල්ලීම පමණි. අනෙක් ස්පර්ශ අකුරු හෝ බැඳි අකුරු සංයුක්තවලට ද (න්ද, ද්ධ…) මෙයම අදාළ වේ.
  • අදාළ වන්නේ: ka, ssa, ZWJ.
  • විශ්වාසය: ඉහළ.
  • මූලාශ්‍ර: KNAB 1989 සටහන 5; EN-WP-SCRIPT.

SP-012: යංශය / රකාරාංශය / රේඵය සැබෑ පොකුරු සලකුණු කරයි ​

  • ප්‍රකාශය:
    • යංශය (C + ් + ZWJ + ය) C+y පොකුරක් ලියයි: විද්‍යාව, ශිෂ්‍ය, ව්‍යාපාරය, ක්‍යා.
    • රකාරාංශය (C + ් + ZWJ + ර) C+r පොකුරක් ලියයි: ප්‍රශ්නය, ක්‍රමය, ශ්‍රී, ග්‍රාමය.
    • රේඵය (ර + ් + ZWJ) r+C ලියයි: කර්මය, ධර්මය, වර්ණ.
  • සුලබ වැරදි: ZWJ නොමැතිව ප්රශ්නය ලිවීම (එවිට එය පෙනෙන හල් ලකුණක් සමඟ දර්ශනය වේ); ර + යංශය ලිවීම (PH-012).
  • අදාළ වන්නේ: ya, ra, hal, ZWJ.
  • විශ්වාසය: ඉහළ.
  • මූලාශ්‍ර: UNICODE-ML 2016; EN-WP-SCRIPT.

SP-013: ඥ සහ ඤ ​

  • ප්‍රකාශය: ඥ (jña) සංස්කෘත වචනවල යෙදේ: ඥාති (NLPC 2,627), ඥානය (1,572), විඥාන (185), ප්‍රඥා (793), විශේෂඥ (6,066). ඤ පාලි සහ ස්වදේශීය වචනවල යෙදේ: ඤාණ (NLPC 200), පඤ්ච (321), සඤ්ඤා (157). කථනයේදී මේ දෙක එක ශබ්දයක් වන අතර ඥ බොහෝ විට "gny-" ලෙස උච්චාරණය වේ.
  • අදාළ වන්නේ: jnya, nya.
  • විශ්වාසය: මධ්‍යම.
  • මූලාශ්‍ර: KNAB 1989; WASALA-SPELL (සමාන ශබ්ද කාණ්ඩය {ඥ, ඤ}).

SP-014: කථන සහ ලිඛිත සිංහලය (ද්විරූපතාව, diglossia) ​

  • ප්‍රකාශය: ලිඛිත සහ කථන සිංහලය රූප විද්‍යාවෙන් වෙනස් වේ. බොහෝ කථන වචනවලට "සම්මත" සාහිත්‍ය අක්ෂර වින්‍යාසයක් නැත. එසේ වුවද කථන වචන ලිවීමේදී භාවිත වේ.
  • උදාහරණ: කථන kiyanawā / සාහිත්‍ය kiyayi; කථන eka (ඉංග්‍රීසි ණය වචන සමඟ යෙදෙන වර්ගීකාරකය: බස් එක, කාර් එක) සහ සාහිත්‍ය බසය.
  • ඇඟවුම: සිංහල පෙළ සකසන මෙවලම් (අක්ෂර පරිවර්තක, අක්ෂර වින්‍යාස පරීක්ෂක) භාෂා මට්ටම් දෙකම හැසිරවිය යුතුය.
  • අදාළ වන්නේ: කිසිවක් නැත
  • විශ්වාසය: ඉහළ.
  • මූලාශ්‍ර: WASALA-SPELL 2010 §III (සිංහලය ද්විරූපී භාෂාවකි); Gamage & Dilani 2024, TPLS 14(2) (https://doi.org/10.17507/tpls.1402.02).

5. ණය වචන සම්මුති ​

LW-001: ඉංග්‍රීසි /f/ → ෆ (නූතන); පැරණි ණය වචන → ප ​

  • ප්‍රකාශය: නූතන ණය වචනවල ෆ යොදයි. පැරණි ණය වචනවල ප යෙදුණු අතර සමහරක තවමත් ප යෙදේ.
  • උදාහරණ:
    • ෆ: ෆෝන් fōn, ෆයිල්, ෆැෂන්, ෆැක්ස්, ෆේස්බුක්, ෆෑන්
    • ප: ප්‍රංශය "ප්‍රංශ රට", කෝපි "කෝපි පානය" (පෘතුගීසි/ලන්දේසි හරහා); ග්‍රැමෆෝන් ~ EN-WP-LOAN gramanfōn
  • අදාළ වන්නේ: fa, pa.
  • විශ්වාසය: ඉහළ.
  • මූලාශ්‍ර: EN-WP-SCRIPT; EN-WP-SIN (කථනයේදී /f/ වෙනුවට බොහෝ විට /p/ හෝ /s/ යෙදේ).

LW-002: ඉංග්‍රීසි /v/ සහ /w/ → ව ​

  • ප්‍රකාශය: ශබ්ද දෙකම ව ලෙස ලියයි. එය [ʋ]/[w] ලෙස, හෝ i ට පෙර [v] ලෙස උච්චාරණය වේ (KNAB).
  • උදාහරණ: වෑන් vǣn "වෑන් රථය"; වෝටර් "ජලය"; වීඩියෝ "වීඩියෝ පටය".
  • අදාළ වන්නේ: va.
  • විශ්වාසය: ඉහළ.
  • මූලාශ්‍ර: KNAB 1989; EN-WP-LOAN.

LW-003: ඉංග්‍රීසි /æ/ → ඇ / ඈ ​

  • ප්‍රකාශය: ඉංග්‍රීසි /æ/ ලියන්නේ ඇ හෝ ඈ ලෙසයි. ඒකාක්ෂර වචනවල (සහ ආඝාත සහිත, විවෘතව ඇසෙන ස්වරවල) දීර්ඝ ඈ ද, බහු අක්ෂර වචනවල කෙටි ඇ ද යෙදීමේ නැඹුරුවක් ඇත.
  • උදාහරණ:
    • ඈ: ෆෑන්, බෑග්, වෑන්, පෑන "ලිවීමේ පෑන"
    • ඇ: බැංකුව, කැම්පස්, ටැක්සි, ඇල්බමය, කැබිනට්, ලැප්ටොප්
  • ව්‍යතිරේක: විකල්ප රූප බොහොමයක් ඇත, උදා: බෑග් / බැග්.
  • අදාළ වන්නේ: ae, aee.
  • විශ්වාසය: මධ්‍යම (නීතියක් නොව, පොදු ප්‍රවණතාවකි).
  • මූලාශ්‍ර: EN-WP-LOAN (pǣna, gæs, kæbinaṭ, læpṭop, blækmēl); EN-WP-SCRIPT.

LW-004: ඉංග්‍රීසි ස්වර /ɒ/, /əʊ/, /ɔː/ ​

  • ප්‍රකාශය: /ɒ/ → ඔ; /əʊ/ සහ /ɔː/ → ඕ.
  • උදාහරණ:
    • ඔ: ලොරිය, කොම්පියුටර්, ලැප්ටොප්
    • ඕ: ෆෝන්, පෝස්ටර්, නෝට්ටුව, හෝටලය, බෝලය, කෝච්චිය
  • අදාළ වන්නේ: o, oo.
  • විශ්වාසය: ඉහළ.
  • මූලාශ්‍ර: EN-WP-LOAN.

LW-005: ඉංග්‍රීසි [ə] ස්වරය සහ /ɜː/ → අ (බොහෝ විට ර් සමඟ) ​

  • ප්‍රකාශය: ඉංග්‍රීසි [ə] ස්වරය සහ /ɜː/ අ මගින් ලියයි; -er/-or අග -අර් (හල් ර) ලෙස ලියයි.
  • උදාහරණ: පෝස්ටර්, හෙලිකොප්ටර්, කොම්පියුටර්, බටර් baṭar; නර්ස්; ඇම්ප්ලිෆයර්.
  • අදාළ වන්නේ: a, ra+hal.
  • විශ්වාසය: ඉහළ.
  • මූලාශ්‍ර: EN-WP-LOAN; WWG-G2P §2.2 (ඉංග්‍රීසි ණය වචනවල /ə, əː/ අ ලෙස ලියයි).

LW-006: ඉංග්‍රීසි /z/ → ස; /ʒ/ → ජ ​

  • ප්‍රකාශය: ඉංග්‍රීසි /z/ ස ලෙසත්, ඉංග්‍රීසි /ʒ/ ජ ලෙසත් ලියයි.
  • උදාහරණ: සීරෝ "බිංදුව" (NLPC 104), සීබ්‍රා "zebra" (NLPC 122), ගැසට් "gazette" (NLPC 6,320); ගරාජ් "වාහන ගාල".
  • සටහන: /z/ සඳහා වෙනම අකුරක් නැත. /z/ ශ මගින් ලිවීම දුර්ලභය: ශීරෝ NLPC 2, සීරෝ 104; ගැශට් 0, ගැසට් 6,320.
  • අදාළ වන්නේ: sa, ja.
  • විශ්වාසය: මධ්‍යම.
  • මූලාශ්‍ර: EN-WP-LOAN (garāj); ඉහත NLPC ගණන්.

LW-007: ඉංග්‍රීසි /ʃ/ → ෂ (ජනප්‍රිය) හෝ ශ; පැරණි ණය වචන → ස ​

  • ප්‍රකාශය: ඉංග්‍රීසි /ʃ/ සඳහා නූතන ජනප්‍රිය අක්ෂර වින්‍යාසය බොහෝ විට ෂ වේ. විද්වත් අක්ෂර වින්‍යාසය සමහර විට ශ යොදයි. පැරණි ණය වචනවල ස යෙදිණි.
  • උදාහරණ:
    • ෂ: ෂර්ට් "කමිසය", ෆැෂන්, ස්ටේෂන් "දුම්රිය ස්ථානය" (-tion → -ෂන්), බ්‍රෂ්
    • ස (පැරණි): දීසිය "පිඟාන" (dīsiya)
  • අදාළ වන්නේ: ssa, sha, sa.
  • විශ්වාසය: මධ්‍යම. ජනප්‍රිය භාවිතය පැහැදිලි වේ; නියාමක නීතියක් හමු නොවීය.
  • මූලාශ්‍ර: EN-WP-LOAN (dīsiya).

LW-008: ඉංග්‍රීසි /θ/ → ත; /ð/ → ද ​

  • ප්‍රකාශය: නාමවල ඉංග්‍රීසි "th" ත ලෙස ලියයි.
  • උදාහරණ: තෝමස් "Thomas" (NLPC 1,815), එලිසබෙත් "Elizabeth" (493), තර්ස්ටන් "Thurstan" (383). ථ සහිත අක්ෂර වින්‍යාස හමු නොවේ (ථෝමස්, එලිසබෙථ්: NLPC 0).
  • අදාළ වන්නේ: ta, da (tha/dha නොවේ).
  • විශ්වාසය: මධ්‍යම.
  • මූලාශ්‍ර: ඉහත NLPC ගණන්; EN-WP-SIN (කථිකයන් ඒ වෙනුවට ස්පර්ශ ව්‍යඤ්ජන යොදයි).

LW-009: ඉංග්‍රීසි x → ක්ස් (කිසි විටෙක ක්ෂ නොවේ) ​

  • ප්‍රකාශය: ක්ෂ පොකුර වෙන් කර ඇත්තේ සංස්කෘත kṣ සඳහා පමණි.
  • උදාහරණ: ටැක්සි (NLPC 731), ෆැක්ස් (1,306), එක්ස්රේ (88), බොක්ස් (1,547). ක්ෂ සහිත අක්ෂර වින්‍යාස හමු නොවේ (ටැක්ෂි, ෆැක්ෂ්, බොක්ෂ්: NLPC 0).
  • අදාළ වන්නේ: ka, sa, hal.
  • විශ්වාසය: මධ්‍යම-ඉහළ.
  • මූලාශ්‍ර: ඉහත NLPC ගණන්.

LW-010: ඉංග්‍රීසි /tʃ/ → ච; /dʒ/ → ජ; /k/ (cheque) → ක ​

  • උදාහරණ: චොක්ලට්, ජූස්, ජූරිය, ජෙනරාල්; චෙක්/චැක් "චෙක්පත" (EN-WP-LOAN cæk ලෙස දක්වයි).
  • අදාළ වන්නේ: ca, ja.
  • විශ්වාසය: ඉහළ.
  • මූලාශ්‍ර: EN-WP-LOAN.

LW-011: අවසාන ව්‍යඤ්ජන සහ අනුගත කිරීමේ ප්‍රත්‍යය ​

  • ප්‍රකාශය: නූතන ණය වචන අවසාන හල් ව්‍යඤ්ජනය රඳවා ගනී: බස්, කාර්, ෆෝන්. සම්පූර්ණයෙන් අනුගත වූ සාහිත්‍ය රූපවලට -ය/-ව/-අ එක් වන අතර, බොහෝ විට ද්විත්වයක් ද සිදු වේ:
    • බෝලය "පන්දුව"; බයිබලය "ක්‍රිස්තියානි ධර්ම ග්‍රන්ථය"; කේතලය "වතුර රත් කරන භාජනය"; ලොරිය; ජූරිය; කොම්පැනිය; පාර්ලිමේන්තුව
    • නෝට්ටුව "මුදල් නෝට්ටුව"; කෝච්චිය "දුම්රිය"; බැංකුව කථන භාෂාවේ මූලික රූපයට "එක" යන්න එක් කර යොදයි: ෆෝන් එක.
  • පෘතුගීසි/ලන්දේසි ස්තරය: කමිසය, මේසය, ජනේලය, සපත්තුව, බොත්තම, කාමරය, පාන්, රෝදය (නිරුක්ති සඳහා මෙම ගොනුවේ මූලාශ්‍ර දක්වා නැත [විසඳා නැත]).
  • අදාළ වන්නේ: ya, va, hal, ද්විත්ව ව්‍යඤ්ජන.
  • විශ්වාසය: ඉහළ.
  • මූලාශ්‍ර: EN-WP-LOAN; Gamage & Dilani 2024.

LW-012: ඉංග්‍රීසි ණය වචනවල පොකුරු හල් හෝ ZWJ සහිතව රැඳේ ​

  • ප්‍රකාශය: බොහෝ පොකුරු ලිඛිත හල් අනුක්‍රම ලෙස රැඳේ. -ng ං ලෙස ලියයි (ඉංග්‍රීසි "ඉංග්‍රීසි භාෂාව", ෂොපිං).
  • උදාහරණ: ස්ටේෂන්, ස්කූල්, ප්‍රින්ටර්, බ්ලැක්මේල්, ඉංග්‍රීසි.
  • ව්‍යතිරේක: පැරණි ණය වචනවල පොකුරු ස්වර ඇතුළු කර බිඳ හරින ලදී: ඉස්කෝලය "පාසල" (NLPC 49), ඉස්තෝප්පුව (NLPC 120).
  • අදාළ වන්නේ: hal, anusvara, ra (රකාරාංශය).
  • විශ්වාසය: ඉහළ.
  • මූලාශ්‍ර: EN-WP-LOAN.

LW-013: දෙමළ සහ අරාබි ණය වචන/නාම ​

  • ප්‍රකාශය: මේවා ද එම ශබ්ද ආදේශම අනුගමනය කරයි:
    • අරාබි f → ෆ (ෆාතිමා); z → ස; q/k → ක; kh → ක හෝ ඛ.
    • දෙමළ මූර්ධජ අකුරු ට/ඩ/ණ/ළ ලෙස ලියැවේ. මුස්ලිම් සහ දෙමළ නාමවල අක්ෂර වින්‍යාසය බොහෝ සෙයින් වෙනස් වේ, උදා: මොහොමඩ් / මුහම්මද් (NLPC 4,109 / 2,015).
  • අදාළ වන්නේ: fa, sa, ka, tta, dda, nna, lla.
  • විශ්වාසය: අඩු. මෙම සම්මුති සඳහා මූලාශ්‍රයක් හමු නොවීය [විසඳා නැත].

6. මුද්‍රණ ශිල්පය: ලොකු/කුඩා අකුරු, විරාම ලකුණු, හිස්තැන්, ඉලක්කම් ​

TY-001: ලොකු/කුඩා අකුරු භේදයක් නැත ​

  • ප්‍රකාශය: සිංහලයේ ලොකු/කුඩා අකුරු (upper/lower case) භේදයක් නැත. රෝමානුකරණය කළ පෙළේ ලොකු අකුරු යෙදීම සිංහලයට කිසිදු අර්ථයක් එක් නොකරයි.
  • විශ්වාසය: ඉහළ.
  • මූලාශ්‍ර: EN-WP-SCRIPT.

TY-002: විරාම ලකුණු ​

  • ප්‍රකාශය: නූතන සිංහලයේ බටහිර විරාම ලකුණු භාවිත වේ: . , ? ! : ; " ' ( ) -. කුණ්ඩලිය ෴ (U+0DF4) ඓතිහාසිකව පූර්ණ විරාමය විය. දැන් එය සාමාන්‍ය භාවිතයේ නැත.
  • විශ්වාසය: ඉහළ.
  • මූලාශ්‍ර: EN-WP-SCRIPT.

TY-003: ඉලක්කම් ​

  • ප්‍රකාශය: හින්දු-අරාබි ඉලක්කම් 0–9 සම්මතයයි. සිංහල ලිත් ඉලක්කම් (U+0DE6–0DEF) සහ පුරාතන ඉලක්කම් (Sinhala Archaic Numbers block, U+111E1–111F4) ඇත්තේ ඓතිහාසික සහ ජ්‍යොතිෂ භාවිතය සඳහා පමණි.
  • විශ්වාසය: ඉහළ. කේත ලක්ෂ්‍ය පරාස යුනිකේත අක්ෂර දත්ත ගබඩාවට (Unicode Character Database, 16.0 අනුවාදය) ගැළපේ.
  • මූලාශ්‍ර: EN-WP-SCRIPT.

TY-004: වචන අතර හිස්තැන් ​

  • ප්‍රකාශය: වචන හිස්තැන්වලින් වෙන් වේ. විභක්ති ප්‍රත්‍යය, පසු නිපාත (clitics) සහ නිපාත වචනයට බැඳ ලියයි: ගෙදරට, ඔහුගේ, පොතෙන්, ඔහුත්, ඔහුද. ස්වාධීන නිපාත සහ සහායක ක්‍රියා වෙන් කර ලියයි: ගැන, සමඟ, විසින්, කතා කරනවා, බලා සිටියි. සමාස නාම පද එකට ලියයි: ගංවතුර, පිළිතුර.
  • සටහන: ප්‍රායෝගිකව සමාසවල සහ නම්/වත්/ද අසල හිස්තැන් යෙදීම ඒකාකාරී නොවේ.
  • විශ්වාසය: මධ්‍යම. හිස්තැන් පිළිබඳ නියාමක මූලාශ්‍රයක් හමු නොවීය [විසඳා නැත].
  • මූලාශ්‍ර: WWG-G2P 2006 §2.2 (වචන "සාමාන්‍යයෙන්" හිස්තැන්වලින් වෙන් වේ).

රෝමානුකරණයට සහ අක්ෂර පරිවර්තනයට ඇති ඇඟවුම් ​

ලතින් අකුරු රෝමානුකරණ සහ සිංහල අකුරු අතර පරිවර්තනය කරන, අක්ෂර වින්‍යාස පරීක්ෂකයක් ගොඩනඟන, හෝ සිංහල පෙළ වලංගු දැයි පරීක්ෂා කරන ඕනෑම අයෙකුට මෙම මාර්ගෝපදේශ ප්‍රයෝජනවත් වේ. මෙම කරුණු ඉහත නීතිවලින් පැන නගී; ඒවා නව නීති එක් නොකරයි.

  1. ⚠️ අකුරු කාණ්ඩ ~10 ක් සඳහා ශබ්දයෙන් අක්ෂර වින්‍යාසය තීරණය කළ නොහැක. මෙම එක් එක් කාණ්ඩය එක් ශබ්දයකට හැකිලේ (G2P-010): {ක ඛ}, {ග ඝ}, {ච ඡ}, {ජ ඣ}, {ට ඨ}, {ඩ ඪ}, {ත ථ}, {ද ධ}, {ප ඵ}, {බ භ}, {න ණ}, {ල ළ}, {ස ශ ෂ}, {ඤ ඥ}. එබැවින් ශබ්දය මත පදනම් වූ රෝමානුකරණයකින් පරිවර්තනය කිරීමට, මෙම වෙනස්කම් සලකුණු කරන රෝමානුකරණයක් (මෙම ගොනුවේ ṇ, ḷ, ṣ, ś ලකුණු මෙන්) හෝ හැකි අක්ෂර වින්‍යාස ශ්‍රේණිගත කරන ශබ්දකෝෂයක් (lexicon) අවශ්‍ය වේ. WASALA-SPELL යොදාගත්තේ හරියටම මෙම කාණ්ඩ, පෙළ සංග්‍රහ සංඛ්‍යාතය අනුව ශ්‍රේණිගත කරමිනි. ඔවුන්ගේ 82% නිරවද්‍යතාවෙන් පෙනෙන්නේ ශබ්දකෝෂයක් අත්‍යවශ්‍ය බවයි.

  2. ස්ථාන නීති අනිවාර්ය වලංගුතා පරීක්ෂා වේ. නිවැරදිව සැකසූ සිංහලයේ කිසි විටෙක මේවා නැත:

    • වචන මුලදී, වචන අගදී හෝ hal සමඟ සඤ්ඤක අකුරක් (PH-003);
    • වචන මුලදී ඞ/ං (PH-004);
    • වචන මුලදී ඎ;
    • ර + යංශය (PH-012);
    • ද්විත්ව ඟ ඬ ඳ ඹ ං හ ෆ (PH-008).

    රෝමානුකරණය කළ පෙළක, ව්‍යඤ්ජනයකට පසු එන ස්වරය ස්වතන්ත්‍ර ස්වරයකට නොව ස්වර ලකුණකට අනුරූප වේ (PH-009). ගිරිඋල්ල වැනි සමාස මෙයට ව්‍යතිරේක වේ. ඒවා නිරූපණය කිරීමට රෝමානුකරණයට පැහැදිලි වෙන් කිරීමේ ලකුණක් අවශ්‍ය වේ.

  3. [ə] ස්වරය සලකන ගැළපීම. අවිධිමත් රෝමානුකරණ [ə] ලියන්නේ a හෝ e ලෙසයි (karanawa / keranawa). පරිවර්තනයේදී, ආඝාතය නැති, මුල් නොවන අක්ෂරයක a ද, අවශ්‍ය නම් e/u ද, ආවේණික ස්වරයක් විය හැකි ලෙස සලකන්න. [ə] යෙදෙන තැන් G2P-002 සිට G2P-009 දක්වා නීති පුරෝකථනය කරයි; අවිධිමත් රෝමානුකරණ [ə] සඳහා සංකේතයක් භාවිත නොකරයි.

  4. නාසික.

    • ස්වරයකට පෙර රෝමානුකරණය කළ nd/mb/ng/nnd අපැහැදිලි වේ: එය සඤ්ඤක අකුරක් (ඳ ඹ ඟ ඬ) හෝ පොකුරක් (න්ද ම්බ ...) විය හැකිය (SP-010). ස්වදේශීය ලෙස පෙනෙන වචනවල සඤ්ඤක අකුර ද, සංස්කෘත ලෙස පෙනෙන වචනවල පොකුර ද වඩා සම්භාව්‍ය කියවීම වේ; දෙකම සලකා බැලිය යුතුය.
    • රෝමානුකරණය කළ වචන අග ng, ං හෝ අවසාන න්/ම් වලට අනුරූප විය හැකිය (PH-007).
    • h, s, ś, v, y, r, l ට පෙර රෝමානුකරණය කළ n/m, ං ට අනුරූප විය හැකිය (උදා: සිංහල; SP-009).
  5. පොකුරු.

    • රෝමානුකරණය කළ Cr → රකාරාංශය; rC → රේඵය; Cy → ZWJ සහිත යංශය. සංයුක්ත අකුරක් අදහස් කරන තැන පෙනෙන හල් ලකුණක් + ර ලිවීම දෝෂයකි (SP-012).
    • රෝමානුකරණය කළ x → ක්ස්, නමුත් ksh → ක්ෂ (LW-009).
    • රෝමානුකරණය කළ kru කෘ ද ක්‍රු ද යන්න අපැහැදිලි වේ (G2P-011).
  6. ද්විස්වර. රෝමානුකරණය කළ ai/au ස්වදේශීය වචනවල අයි/අවු (ව්‍යඤ්ජනයකට පසු -යි/-වු) ටත්, විද්වත් වචනවල ඓ/ඖ (ෛ/ෞ) ටත් අනුරූප වේ (PH-010, SN-012).

  7. රූප විද්‍යාව සලකන උත්පාදනය. සන්ධි සහ වරනැඟීම පුරෝකථනය කළ හැකි රූප සාදයි (SN-009, SN-010, SN-014). ප්‍රකෘතියකට පසු, i/e/æ ප්‍රකෘතිවලට -ය ද u/o/ā ප්‍රකෘතිවලට -ව ද එක් වේ. ඉ/උ ප්‍රකෘතිවල ඒකවචනයේ ද්විත්ව ව්‍යඤ්ජනයක් ඇත. ශබ්දකෝෂයක් හෝ අක්ෂර වින්‍යාස පරීක්ෂකයක් සඳහා වරනැඟූ රූප ජනනය කිරීමට මෙම රටා ප්‍රයෝජනවත් වේ.

  8. ශ්‍රේණිගත කිරීමේ ලක්ෂණ ලෙස ළ / ණ මාර්ගෝපදේශ:

    • නාම පදවල ර/ෂ/ෘ ට පසු සහ ට/ඩ ට පෙර ණ;
    • ක්‍රියා රූපවල, දන්තජ අකුරු සහ ස ට පෙර, සහ ද්විත්වවල න;
    • පිළි- තුළ සහ ර-ක්‍රියා පදවල අතීත රූපවල ළ;
    • හල්-අන්ත ප්‍රකෘති සඳහා ල. මේවා අනිවාර්ය නීති ලෙස නොව, සමාන විකල්ප අතරින් තෝරා ගැනීමට පමණක් යොදන්න (SP-003, SP-004).
  9. ණය වචන අනුරූපතා. රෝමානුකරණය කළ f → ෆ (පැරණි වචනවල ප තිබිය හැකිය). w/v → ව; z → ස; sh → ෂ (ශ ද යෙදේ); th → ත; ae → ඇ/ඈ (දෙකම යෙදේ); o → ඔ/ඕ. අවසාන හල් ව්‍යඤ්ජන රැඳේ (LW-001 සිට LW-012 දක්වා).

  10. සම්මත සහ විකල්ප අක්ෂර වින්‍යාස දෙකම පිළිගන්න, මූලාශ්‍ර එකඟ නොවන තැන්වල: තත්ත්වය/තත්වය, බෑග්/බැග්, කථා/කතා, කල/කළ. අක්ෂර වින්‍යාස පරීක්ෂකයක් හෝ සාමාන්‍යකාරකයක් හිතාමතා යෙදූ විකල්පයක් "නිවැරදි" නොකළ යුතුය.


විසඳා නැති ප්‍රශ්න / ගැටෙන මූලාශ්‍ර ​

#ප්‍රශ්නයගැටුම / අවිනිශ්චිතතාවතත්ත්වය
1වචන මුල ව්‍යඤ්ජන (PH-005)WWG-G2P, Disanayaka උපුටා දක්වයි: /ŋ/ "සහ නාසික" හැර සියල්ල. වචනානුසාරයෙන් ගතහොත් මෙය ණය වැනි ණ-ආරම්භක වචන බැහැර කරයි. බොහෝ විට අදහස වන්නේ සඤ්ඤක අකුරුය.Disanayaka 1995 මුද්‍රිත පිටපතින් පරීක්ෂා කරන්න
2ර ට පසු ණ (SP-003)ස්වදේශීය වචනවල "සැමවිටම" ණ බව SI-WP-AV කියයි. WASALA-SPELL බොහෝ න ව්‍යතිරේක දක්වයි (ක්‍රියා පද, සමාස).නාම පදවලට පමණක් අදාළ ප්‍රවණතාවක් ලෙස සලකන්න
3තත්ත්වය සහ තත්වය (SP-008)ව්‍යාකරණානුකූල (ව්‍යුත්පත්තිමය) රූපය සහ නූතන රූපය. දෙකම සුලබ වන අතර (NLPC තත්ත්වය 25,852, තත්වය 21,484) දෙකම පිළිගැනේ. නිල තීන්දුවක් හමු නොවීය.පිළිගත් අක්ෂර වින්‍යාස දෙකක් ලෙස විසඳිණි
4G2P නීතිය 2 සහ නීතිය 5 විස්තරPDF හි Rule 2(b)/(c) පෙළ පරස්පර විරෝධී වේ. Rule 5 හි ව්‍යතිරේක ව්‍යඤ්ජන දෙකක් කියවිය නොහැකි වේ.පැහැදිලි මුල් පත්‍රිකාව හෝ UCSC LTRL ක්‍රියාත්මක කිරීම අවශ්‍යයි
5අ-අන්ත ප්‍රකෘතිවලට පසු අර්ධ ස්වරය (SN-010)i/æ/u/ā ට පසු ය/ව ඇතුළු වන බව මූලාශ්‍රවල පෙනේ. කෙටි අ ට පසු හැසිරීම (ලොප් වීම ද ය ද) උදාහරණවලින් කළ අනුමානයක් මිස මූලාශ්‍රවල ප්‍රකාශ වී නැත.විසඳා නැත
6"යකාරාගම / වකාරාගම" පදපරිශීලනය කළ මූලාශ්‍රවල හමු නොවීය. පාසල් ව්‍යාකරණය මෙය "ආගම සන්ධිය" ලෙස හඳුන්වයි.පද විසඳා නැත
7සන්ධි වර්ග ගණනsi.wikipedia (සන්ධි) වර්ග 10 ක් දක්වයි. ඒවායේ නම් සහ උදාහරණ සිංහල සන්ධි පිටුවේ (9 ක් දක්වයි) සහ Piriven හි (10, ගාත්‍රාදේශ එක් කරයි) ඇති ඒවාට වඩා මඳක් වෙනස් වේ. ස්වරාදේශ උදාහරණ පිටුවෙන් පිටුවට වෙනස් වේ.සුළු කරුණකි; අන්තර්ගතය අනුකූල වේ
8ඉංග්‍රීසි /ʃ/: ෂ සහ ශ (LW-007)ජනප්‍රිය මාධ්‍ය බොහෝ විට ෂ යොදයි; විද්වත්/පැරණි රූපවල ශ හෝ ස ඇත. සම්මතයක් හමු නොවීය.දෙකම පිළිගන්න
9ඉංග්‍රීසි /æ/: ඇ සහ ඈ (LW-003)දිග තීරණය වචනය සහ ලේඛකයා අනුව වෙනස් වේ.දෙකම පිළිගන්න
10ස ට පෙර ං සහ න් (SP-009)ස්වදේශීය පන්සල සහ සංස්කෘත සංසාරය: තේරීම වචනයේ මූලය මත රඳා පවතී.ශබ්දකෝෂයක් අවශ්‍යයි
11rya සඳහා ඓතිහාසික ය්‍ය (PH-012)SLS 1134 ර + යංශය තහනම් කරයි. පැරණි මුද්‍රණවල ය්‍ය යෙදිණි (කාය්‍ය); දැන් එය දුර්ලභය (NLPC 0; ප්‍රත්‍ය සහිතව 5). පැරණි සම්මුතිය පිළිබඳ මූලාශ්‍රයක් පරිශීලනය කර නැත. නූතන පෙළේ පැරණි රූප වලංගු ලෙස සැලකිය යුතුද යන්න විසඳා නැත.විසඳා නැත
12Hela Havula අකුරු නීති (SP-001)Hela Havula නියම කරන අකුරු හෝ අක්ෂර වින්‍යාස මොනවාදැයි පරිශීලනය කළ කිසිදු මූලාශ්‍රයක විස්තර කර නැත.විසඳා නැත
13රාජ්‍ය භාෂා දෙපාර්තමේන්තුවප්‍රසිද්ධ අක්ෂර වින්‍යාස සම්මතයක් හමු නොවීය. දෙපාර්තමේන්තුව නිකුත් කරන්නේ පාරිභාෂික ශබ්ද මාලා පමණක් බව පෙනේ.විසඳා නැත
14විකිපීඩියා අර්ථ දැක්වීමේ දෝෂයEN-WP Sinhala phonology වගුව කන යන්නට "ඇසීමේ අවයවය" යන අර්ථය දෙයි. ඇසීමේ අවයවය කණ වේ; කන යනු "අනුභව කරන" යන්නයි. විකිපීඩියා උදාහරණ පරීක්ෂා කළ යුතු බව මෙයින් පෙනේ.සටහන් කර ඇත
15හිස්තැන් සම්මුති (TY-004)නියාමක මූලාශ්‍රයක් හමු නොවීය. සමාස සහ නිපාත සඳහා භාවිතය වෙනස් වේ.විසඳා නැත
16දෙමළ/අරාබි ණය වචන සම්මුති (LW-013)මූලාශ්‍ර හමු නොවීය.විසඳා නැත
17සිංහල ව්‍යාකරණයේ උගන්වන සංස්කෘත සන්ධි (SN-004, SN-005, SN-006, SN-011)ස්වර සහ විසර්ග සන්ධි නීති සම්මත සංස්කෘත සන්ධියයි. ඒවා තහවුරු කිරීමට සිංහල ව්‍යාකරණ ග්‍රන්ථයක් පරිශීලනය කර නැත.විසඳා නැත
18ගෞරව/බහුවචන රූපවල දීර්ඝ -ූ (SP-007)එය යෙදෙන්නේ කුමන රූපවලද යන්න පරිශීලනය කළ කිසිදු මූලාශ්‍රයක සඳහන් නොවේ.විසඳා නැත
19පෘතුගීසි/ලන්දේසි නිරුක්ති (LW-011)ලැයිස්තුගත වචනවල නිරුක්ති සඳහා මූලාශ්‍ර දක්වා නැත.විසඳා නැත

පෙළ සහ කේතය MIT බලපත්‍රය යටතේ නිකුත් කර ඇත. උපුටා දක්වන්න: doi:10.5281/zenodo.23244126.