අන්තර්ගතයට යන්න
මෙය ඉංග්‍රීසි මුල් ලේඛනයේ පරිවර්තනයකි. දෙකෙහි වෙනසක් ඇත්නම් ඉංග්‍රීසි පිටපත නිවැරදි යැයි සලකන්න.

02: ස්වර ලකුණු (පිලි) සහ ස්වර එකතු වීම ​

විෂය පථය: සිංහලයේ සියලු පරායත්ත ස්වර ලකුණු (U+0DCF–U+0DDF, U+0DF2, U+0DF3) සහ හල් ලකුණ (al-lakuna, U+0DCA). ඒවා ව්‍යඤ්ජනවලට එකතු වන ආකාරය, භාවිතයේ ඇති ව්‍යඤ්ජන + ලකුණු යුගල, ස්වතන්ත්‍ර සහ පරායත්ත ස්වර භාවිතය, ස්වර දෙකක් එක ළඟ යෙදීම (hiatus) සහ අර්ධ ස්වර, ස්වර දිග, සහ ලියන අනුපිළිවෙළ, ගබඩා කරන අනුපිළිවෙළ සහ දර්ශනය කිරීම අතර සම්බන්ධය මෙහි සාකච්ඡා වේ.

සම්පාදනය කළේ 2026 ඔක්තෝබර්.

සියලු පෙළ මූලාශ්‍රවල අදහස් අපේ වචනවලින් ලියා ඇත. සෑම නීතියකටම විශ්වාස මට්ටමක් ඇත. විමසූ කිසිදු මූලාශ්‍රයකින් තහවුරු නොවන ප්‍රකාශ [විසඳා නැත] ලෙස සලකුණු කර §10 හි ලැයිස්තුගත කර ඇත. "(NLPC 829)" වැනි සංඛ්‍යා NLPC වචන මිලියන 2.1 ලැයිස්තුවේ (S17) ටෝකන ගණන්ය; "දුර්ලභ" යනු ටෝකන 20 ට අඩු බවයි. "මෙහි කළ පරීක්ෂණය" (local test) යනු සම්පාදකයා තම පරිගණකයේ හැසිරීම පරීක්ෂා කළ බවයි: Python unicodedata (UCD 16.0), uharfbuzz 0.56.2 හරහා HarfBuzz සහ Windows Nirmala UI අකුරු මුහුණත, සහ ව්‍යඤ්ජන 41 × ලකුණු සියල්ල Chromium තුළ දර්ශනය කිරීම. දෙවන පරීක්ෂණයක් (2026 ඔක්තෝබර්) රකාරාංශය + u/uu අකුරු මුහුණත් හතක දර්ශනය කළේය: Noto Sans Sinhala, Noto Serif Sinhala, Abhaya Libre, Yaldevi, Gemunu Libre, Nirmala UI සහ Iskoola Pota.


0. මූලාශ්‍ර ​

IDමූලාශ්‍රයURL
S1Unicode Standard 18.0, පරිච්ඡේදය 13, §13.2 Sinhalahttp://www.unicode.org/versions/Unicode18.0.0/core-spec/chapter-13/
S2යුනිකේත කේත සටහන U+0D80–0DFF (නාම, අන්වර්ථ නාම, ≡ වියෝජන, කොටස පිළිබඳ සටහන්)https://www.unicode.org/charts/PDF/U0D80.pdf
S3UCD IndicPositionalCategory.txt / IndicSyllabicCategory.txthttps://www.unicode.org/Public/UCD/latest/ucd/IndicPositionalCategory.txt , https://www.unicode.org/Public/UCD/latest/ucd/IndicSyllabicCategory.txt
S4UCD DoNotEmit.txt (සිංහල ස්වර අකුරු ඇතුළත් කිරීම්)https://www.unicode.org/Public/UCD/latest/ucd/DoNotEmit.txt
S5SLS 1134:2004 කෙටුම්පත (2 වන සංශෝධනය), ශ්‍රී ලංකා ප්‍රමිති ආයතනය, ICTA දායකත්වය සහිතවhttps://sinhala.sourceforge.net/archive/akuru.org/att-0028/sls1134.pdf (WG2 N2737 ලෙසද)
S6SLSI කාර්ය කණ්ඩායම් තීරණ 2004-06-09 (යුනිකේත ලේඛනය L2/04-231)https://www.unicode.org/L2/L2004/04231-sinhala-rep.pdf
S7Microsoft, Creating and Supporting OpenType Fonts for Sinhala Scripthttps://learn.microsoft.com/en-us/typography/script-development/sinhala
S8HarfBuzz hb-ot-shaper-vowel-constraints.cc (සිංහල කොටස)https://github.com/harfbuzz/harfbuzz/blob/main/src/hb-ot-shaper-vowel-constraints.cc
S9Sinhala Generation Panel, Proposal for a Sinhala Script Root Zone LGR v3.0 (2019, ICANN). මණ්ඩලයේ මහාචාර්ය J.B. Dissanayake ද සිටීhttps://www.icann.org/en/system/files/files/proposal-sinhala-lgr-22apr19-en.pdf
S10H. Jayasuriya (UCSC LTRL), Sinhala Orthography: Ola Leaf to the Computer (2007)https://ftp3.gwdg.de/pub/gnu/www/savannah-checkouts/non-gnu/sinhala/doc/presentations/sinhala-orthography-hj-20070212.pdf
S11A. Wasala & K. Gamage (UCSC), Research Report on Phonetics and Phonology of Sinhalahttp://www.columbia.edu/~kf2119/SPLTE1014/Day 3 slides and readings/SinhalaPhoneticsandPhonology.pdf
S12M. Żygis, Typology of Consonantal Insertions, ZAS Papers in Linguistics 52 (2010), සිංහල ගැන Smith (2001:63) උපුටා දක්වයිhttps://d-nb.info/1096751291/34
S13සිංහල විකිපීඩියා, සන්ධි (ආගම සන්ධි ඇතුළු සන්ධි වර්ග): හැඳින්වීම පමණිhttps://si.wikipedia.org/wiki/සන්ධි
S14ඉංග්‍රීසි විකිපීඩියා, Sinhala script: හැඳින්වීම පමණි (Gair & Paolillo 1997, Fairbanks/Gair/Silva 1968 උපුටා දක්වයි)https://en.wikipedia.org/wiki/Sinhala_script
S15Liyanapathirana, Gunasinghe, Dias, SinSpell (2021)https://arxiv.org/abs/2107.02983
S16මෙහි කළ පරීක්ෂණය (ලේඛනයේ ආරම්භය බලන්න)-
S17University of Moratuwa NLPC, Word Frequency List for Sinhala: වචන මිලියන 2.1 ලැයිස්තුව (word_frequency_list_2M)https://github.com/nlpcuom/Word-Frequency-List-for-Sinhala
S18සිංහල විකිපීඩියා, 2026-10-01 pages-articles ඩම්පයේ ලිපි (tools/corpus_counts.py)https://dumps.wikimedia.org/siwiki/20261001/

හිඩැස: වෙබ් සෙවුමෙන් NIE / educationpublications.gov.lk ව්‍යාකරණ පෙළපොතක් සොයාගත නොහැකි විය. එබැවින් පහත දැක්වෙන පිලිවල සාම්ප්‍රදායික සිංහල නම් S2/S5 වලින් ගත් ඒවාය (යුනිකේත නාම සාම්ප්‍රදායික සිංහල නම් අනුගමනය කරයි). ඒවා සිංහල ව්‍යාකරණ පෙළපොතකින් තහවුරු කර නැති බැවින් ඒවායේ විශ්වාස මට්ටම අඩු කර ඇත (§10, අයිතමය 10).


1. ප්‍රවේශම් විය යුතු කරුණු ​

  1. කොම්බු දෙකට (ෛ U+0DDB) වියෝජනයක් නැත. ෙ+ෙ යනු පෙනුමින් බොහෝ දුරට සමාන වෙනත් අනුක්‍රමයකි. NFC කිසි විට ෙෙ, ෛ බවට පත් නොකරයි. එබැවින් "කොම්බුව දෙවරක්" ලෙස ලියූ පෙළ, එය නිපදවන හෝ පිරිසිදු කරන ක්‍රමය පැහැදිලිවම U+0DDB බවට හැරවිය යුතුය (VS-004).
  2. ෝ හි කොටස්වල අනුපිළිවෙළ වැදගත්ය. ෙ + ා + ් සාමාන්‍යකරණයේදී ෝ බවට පත් වේ. නමුත් ෙ + ් + ා, ේ + ා බවට පත් වේ. එය එකම ලෙස දර්ශනය විය හැකි වුවද ෝ ට සමාන නොවේ (VS-005).
  3. කොම්බුව ලියන්නේත් පෙන්වන්නේත් මුලින්ම වුවද, ගබඩා කරන්නේ ව්‍යඤ්ජනයට පසුවය. තාර්කික අනුපිළිවෙළ සැමවිටම ව්‍යඤ්ජනය (හෝ සම්පූර්ණ පොකුර) සහ ඉන්පසු ලකුණයි (VS-002, VS-018).
  4. ස්වතන්ත්‍ර ස්වරයක් + ලකුණක් කිසි විට නිවැරදි නොවේ. බොහෝ හැඩගැන්වීමේ එන්ජින් (shapers) ඒ ගැන අනතුරු අඟවන්නේ නැත. HarfBuzz තිත් කවයක් (dotted circle) පෙන්වන්නේ එක සමාන පෙනෙන යුගල 9 සඳහා පමණි (අ+ා ආදිය). ඉ+ී හෝ ඔ+ා වැනි යුගල කිසිදු සලකුණක් නැතිව අර්ථ විරහිත ලෙස දර්ශනය වේ. එබැවින් වලංගුතාව පරීක්ෂා කිරීමට දර්ශනය මත විශ්වාසය තැබිය නොහැක (VS-006, VS-007).
  5. ර + u සහ ර + ae එක සමාන පෙනේ. රු (ra+u) හි දකුණට කොක්කක් ඇත. රැ (ra+ae) වෙනම අක්ෂර රූපයකි. ක්‍රු (k.ru), ක්‍රැ (k.rae) ලෙස ගබඩා නොකළ යුතුය (VS-012, VS-016).
  6. "ru" ට කියවීම් තුනක් ඇත: රු (ra+u), ෘ (ස්වර r, /ru/ ලෙස උච්චාරණය වේ), සහ ්‍රු (රකාරාංශය+u). උදාහරණයක් ලෙස ගෘහ (gṛha, නිවස) සහ ග්‍රහ (graha, ග්‍රහලෝකය) වෙනස් වචන දෙකකි (VS-020, VS-033).
  7. ai / au සාමාන්‍යයෙන් ෛ / ෞ නොවේ. දේශීය වචනවල සහ ඉංග්‍රීසි ණය වචනවල ලියන්නේ අයි / අවු ය (ලයිට්, කවුද). ෛ/ෞ යෙදෙන්නේ සංස්කෘත මූලයක් ඇති වචනවල පමණි (සෛලය, පෞද්ගලික) (VS-022).
  8. ඞ කිසි විට ස්වර ලකුණක් නොගනී. සමකාලීන ලේඛනයේ එය යෙදෙන්නේ ඞ් ලෙස පමණි (VS-023). සඤ්ඤක අකුරු (ඟ ඬ ඳ ඹ ඦ) කිසි විට හල් ලකුණ නොගනී (VS-025).
  9. ෟ (U+0DDF) සහ ෳ (U+0DF3) තනිව ප්‍රායෝගිකව භාවිත නොවේ. ෟ ඉතිරිව ඇත්තේ ෞ හි දෙවන කොටස ලෙස පමණි (VS-021).

2. ලකුණු ලැයිස්තුව ​

VS-001: පරායත්ත ලකුණු සමූහය ​

ප්‍රකාශය. සිංහලයේ පරායත්ත ස්වර ලකුණු 17ක් සහ හල් ලකුණ ඇත. U+0DD5 සහ U+0DD7 කිසිවකට පවරා නැත. දත්ත S2 වලින්ද, පිහිටීම් S3 (IndicPositionalCategory) වලින්ද, වියෝජන S2/UCD වලින්ද ගෙන මෙහිදී පරීක්ෂා කර ඇත (S16).

කේතයලකුණයුනිකේත නාමය (S2)සාම්ප්‍රදායික නම (සිංහල)ස්වරය (අකුරු හැඳුනුම)පිහිටීම (S3)කැනොනිකල් වියෝජනයසාමාන්‍ය වර්ගය
U+0DCA◌්AL-LAKUNA (= virama)හල් කිරීම / හල් ලකුණhal (ආවේණික a ඉවත් කරයි)Top- (ccc = 9)Mn
U+0DCF◌ාAELA-PILLAඇලපිල්ලaaRight-Mc
U+0DD0◌ැKETTI AEDA-PILLAඇදපිල්ලaeRight-Mc
U+0DD1◌ෑDIGA AEDA-PILLAදිග ඇදපිල්ලaeeRight-Mc
U+0DD2◌ිKETTI IS-PILLAඉස්පිල්ලiTop-Mn
U+0DD3◌ීDIGA IS-PILLAදිග ඉස්පිල්ලiiTop-Mn
U+0DD4◌ුKETTI PAA-PILLAපාපිල්ලuBottom-Mn
U+0DD6◌ූDIGA PAA-PILLAදිග පාපිල්ලuuBottom-Mn
U+0DD8◌ෘGAETTA-PILLAගැටපිල්ලru (ස්වර r)Right-Mc
U+0DF2◌ෲDIGA GAETTA-PILLAදිග ගැටපිල්ලruu (ස්වර rr)Right-Mc
U+0DDF◌ෟGAYANUKITTAගයනුකිත්තilu (ස්වර l)Right-Mc
U+0DF3◌ෳDIGA GAYANUKITTAදිග ගයනුකිත්තiluu (ස්වර ll)Right-Mc
U+0DD9ෙ◌KOMBUVAකොම්බුවeLeft (පාදයට පෙර)-Mc
U+0DDAෙ◌්DIGA KOMBUVAකොම්බුව සහ හල් කිරීමeeTop_And_Left≡ 0DD9 0DCAMc
U+0DDBෛ◌KOMBU DEKAකොම්බු දෙකaiLeft (පාදයට පෙර)නැතMc
U+0DDCෙ◌ාKOMBUVA HAA AELA-PILLAකොම්බුව සහ ඇලපිල්ලoLeft_And_Right (දෙකට බෙදුණු)≡ 0DD9 0DCFMc
U+0DDDෙ◌ෝKOMBUVA HAA DIGA AELA-PILLAකොම්බුව, ඇලපිල්ල සහ හල් කිරීමooTop_And_Left_And_Right≡ 0DDC 0DCA (සම්පූර්ණ NFD: 0DD9 0DCF 0DCA)Mc
U+0DDEෙ◌ෟKOMBUVA HAA GAYANUKITTAකොම්බුව සහ ගයනුකිත්තauLeft_And_Right (දෙකට බෙදුණු)≡ 0DD9 0DDFMc
  • ව්‍යතිරේක. නැත. නාමවල "diga" යනු දිග, "ketti" යනු කෙටි බව සලකන්න. කෙටි a (ආවේණික ස්වරය) සඳහා ලකුණක් නැත.
  • අදාළ වන්නේ: සියලු ව්‍යඤ්ජනවලට (වලංගුතාව §8 හි ඇත).
  • විශ්වාසය: ඉහළ. සිංහල අකුරෙන් ලියූ සාම්ප්‍රදායික නම් සඳහා මධ්‍යම (පාසල් පෙළපොතකින් තහවුරු කර නැත; §10, අයිතමය 10).
  • මූලාශ්‍ර: S2, S3, S5 (වගුව 1 සහ වගුව 4), S16.

VS-002: පිහිටීම්, දෙකට බෙදුණු ලකුණු සහ නැවත පෙළගැස්වීම ​

ප්‍රකාශය. ලකුණු පිහිටීම අනුව පන්ති පහකට වැටේ. ා ැ ෑ ෘ ෲ ෟ ෳ දකුණු පසින් සිටී. ි ී ් ඉහළින් සිටී. ු ූ පහළින් සිටී. ෙ ෛ වම් පසින් (පාදයට පෙර) සිටී. ො ෝ ේ ෞ දෙකට බෙදී ඇත: වම් පස කොම්බුවක් සහ දකුණු හෝ ඉහළ කොටසක් ඇත. ගබඩාවේදී සෑම ලකුණක්ම එය වෙනස් කරන ව්‍යඤ්ජනයට හෝ පොකුරට පසුව පැමිණේ. හැඩගැන්වීමේ එන්ජිම පාදයට පෙර කොටස සම්පූර්ණ පොකුරේ ඉදිරියට ගෙන යයි. Microsoft පිරිවිතරයට අනුව එන්ජිම ේ ො ෝ ෞ සඳහා ෙ අක්ෂර රූපයක් ඇතුළු කර එය පොකුරේ ආරම්භයට ගෙන යයි. ඉන්පසු දෙවන කොටස හසුරුවන්නේ අකුරු මුහුණතේ pstf විශේෂාංගයයි.

  • උදාහරණ: කො = ක + ො (U+0D9A U+0DDC), ෙ-ක-ා ලෙස දර්ශනය වේ. ක්‍රෙ = ක ් ZWJ ර ෙ, මෙහි කොම්බුව ක ට පෙර දර්ශනය වේ.
  • ව්‍යතිරේක: කේතනයේ නැත. දර්ශන අනුපිළිවෙළ තාර්කික අනුපිළිවෙළෙන් වෙනස් වන්නේ කොම්බු කොටස් සඳහා පමණි.
  • අදාළ වන්නේ: e, ee, ai, o, oo, au.
  • විශ්වාසය: ඉහළ.
  • මූලාශ්‍ර: S2 (කොටස් දෙකේ ලකුණු "follow the consonant in logical order"), S3, S7 ("Processing split matras" සහ "Reordering").

3. වියෝජනය සහ සාමාන්‍යකරණය ​

VS-003: කැනොනිකල් සමානතා සහ NFC ​

ප්‍රකාශය. ලකුණු හතරකට කැනොනිකල් වියෝජන ඇත: ේ ≡ ෙ+්, ො ≡ ෙ+ා, ෝ ≡ ො+් (එනම් ෙ+ා+්), සහ ෞ ≡ ෙ+ෟ. මින් එකක්වත් සංයෝජනයෙන් බැහැර කළ ඒවා (composition exclusion) නොවේ. එබැවින් NFC මෙම අනුක්‍රම නැවත තනි කේත ලක්ෂ්‍යයකට සංයෝජනය කරයි. මෙහි කළ පරීක්ෂණය (UCD 16.0): ක ෙ ා → NFC ක ො, ක ෙ ් → ක ේ, ක ෙ ෟ → ක ෞ, ක ො ් → ක ෝ.

  • පෙළ සැකසීමේ නීතිය: සැමවිටම පූර්ව සංයුක්ත ලකුණ ගබඩා කරන්න (SLS 1134 §5.4 සටහන 2 ලකුණු කිහිපයකින් ලිවීම නිර්දේශ නොකරයි). පෙළ සංසන්දනය කිරීමට පෙර NFC වලට සාමාන්‍යකරණය කරන්න.
  • ව්‍යතිරේක: VS-004 සහ VS-005 බලන්න.
  • අදාළ වන්නේ: ee, o, oo, au.
  • විශ්වාසය: ඉහළ.
  • මූලාශ්‍ර: S2, S5 §5.4, S16.

VS-004: කොම්බු දෙක බෙදිය නොහැකි ඒකකයකි ​

ප්‍රකාශය. ෛ U+0DDB ට වියෝජනයක් නැත. ෙ+ෙ අනුක්‍රමය එයට සමාන නොවේ. Nirmala UI සමඟ HarfBuzz තුළ ක+ෙ+ෙ වෙනම කොම්බු අක්ෂර රූප දෙකක් ලබා දෙයි (gid 3858 දෙවරක්). ක+ෛ ඊට වෙනස් කොම්බු දෙක අක්ෂර රූපයක් ලබා දෙයි (gid 3860). කිසිදු අවස්ථාවක තිත් කවයක් නොපෙන්වන නිසා දෝෂය නොදැනී යයි. SLS 1134 ai විස්තර කරන්නේ කොම්බුව + කොම්බුව + ව්‍යඤ්ජනය ලෙස ලියන බවයි. නමුත් ගබඩා කරන රූපය U+0DDB විය යුතුය.

  • උදාහරණ: කෛ = U+0D9A U+0DDB. වැරදි: U+0D9A U+0DD9 U+0DD9.
  • අදාළ වන්නේ: ai.
  • විශ්වාසය: ඉහළ.
  • මූලාශ්‍ර: S2, S5 §6.2 ("ai modifier"), S10 (කොම්බු අනුපිළිවෙළ පිළිබඳ සටහන), S16.

VS-005: ෝ / ේ තුළ ලකුණුවල අනුපිළිවෙළ ​

ප්‍රකාශය. ෝ කැනොනිකල් ලෙස ෙ ා ් වලට වියෝජනය වේ. හල් ලකුණේ ccc = 9 වන අතර ස්වර ලකුණුවල ccc = 0 වේ. එබැවින් සාමාන්‍යකරණය කිසි විට ඒවා නැවත පෙළගස්වන්නේ නැත. ඒ නිසා ෙ ් ා අනුක්‍රමය ේ + ා ලෙස සංයෝජනය වේ. එය ෝ ගෙන් වෙනස් අනුක්‍රමයකි. මෙහි කළ පරීක්ෂණය: ක ෙ ් ා → NFC ක ේ ා (U+0DDA U+0DCF), U+0DDD නොවේ.

  • අදාළ වන්නේ: oo, ee.
  • විශ්වාසය: ඉහළ.
  • මූලාශ්‍ර: S2, S16.

VS-006: ස්වතන්ත්‍ර ස්වර බෙදිය නොහැකි ඒකක වේ; කිසි විට ඒවා අකුරක් + ලකුණකින් නොසාදන්න ​

ප්‍රකාශය. ස්වර අකුරු නවයක් මූලික ස්වරයක් + ලකුණක් මෙන් පෙනේ. නමුත් ඒවා තනි කේත ලක්ෂ්‍ය ලෙස කේතනය කළ යුතුය. යුනිකේතයේ Table 13-2 සහ DoNotEmit.txt ඒවා ලැයිස්තුගත කරයි:

භාවිත කරන්නභාවිත නොකරන්න
ආ U+0D86අ + ා
ඇ U+0D87අ + ැ
ඈ U+0D88අ + ෑ
ඌ U+0D8Cඋ + ෟ
ඎ U+0D8Eඍ + ෘ
ඐ U+0D90ඏ + ෟ
ඒ U+0D92එ + ්
ඓ U+0D93එ + ෙ
ඖ U+0D96ඔ + ෟ

HarfBuzz තිත් කවයක් යොදන්නේ හරියටම මෙම අනුක්‍රමවලට පමණි.

  • සටහන. ඕ (U+0D95) ලැයිස්තුවේ නැත. SLS ඕ විස්තර කරන්නේ ඔ + ් ලෙස ලියන බවයි. මෙහි කළ පරීක්ෂණය: ඔ + ් තිත් කවයක් නැතිව හැඩගැන්වේ. එබැවින් පරිවර්තක සහ වලංගුතා පරීක්ෂක එය තමන් විසින්ම හඳුනා ගත යුතුය.
  • අදාළ වන්නේ: a aa ae aee u uu ru ruu ilu iluu e ee ai o oo au.
  • විශ්වාසය: ඉහළ.
  • මූලාශ්‍ර: S1 Table 13-2, S4, S5 §5.1 සහ §6.2, S8, S16.

4. අවලංගු සහ වැරදි ලෙස සැකසූ අනුක්‍රම ​

VS-007: ස්වතන්ත්‍ර ස්වරයකට පසු ස්වර ලකුණක් නොයෙදේ ​

ප්‍රකාශය. පරායත්ත ලකුණක් හෝ හල් ලකුණ ව්‍යඤ්ජනයකට (හෝ සඤ්ඤක අකුරකට) පසුව පැමිණිය යුතුය. LGR හි සම්පූර්ණ ලේබල නීති අනුව ලකුණකට "must be preceded by C or J", සහ H ට පෙර C තිබිය යුතුය. ස්වර ලකුණු ව්‍යඤ්ජනයකට පසුව එන බව SLS 1134 ද පවසයි. HarfBuzz සලකුණු කරන්නේ VS-006 හි එක සමාන පෙනෙන ඒවා පමණි. මෙහි කළ පරීක්ෂණය: ඉ+ී, ඔ+ා, එ+ැ සහ අ+ි සියල්ල තිත් කවයක් නැතිව දර්ශනය වේ. මේවා හඳුනා නොගැනෙන අර්ථ විරහිත පෙළකි.

  • උදාහරණ: වැරදි: ඉී. නිවැරදි: ඊ.
  • අදාළ වන්නේ: සියලු ලකුණුවලට; සියලු ස්වතන්ත්‍ර ස්වරවලට.
  • විශ්වාසය: ඉහළ.
  • මූලාශ්‍ර: S5 §4, S9 §7 නීති 1–2, S8, S16.

VS-008: පාදයක් නැති ලකුණක් ​

ප්‍රකාශය. පාදයක් (base) නැති ලකුණක් පෙළෙහි අවලංගුය. හැඩගැන්වීමේ එන්ජින් එය තිත් කවයක් (U+25CC) මත පෙන්වයි. ලකුණක් හිතාමතාම තනිව පෙන්වීම සම්බන්ධයෙන් මූලාශ්‍ර එකඟ නොවේ:

  • SLS 1134 කෙටුම්පත: ZWNJ + ලකුණ.
  • SLSI WG 2004: හිස්තැන + ලකුණ (අමතර හිස්තැනක් නැතිව), සහ කොකු රූපය පෙන්වීමට NBSP + pāpilla.
  • Microsoft: වාර්තා වන පරිදි හිස්තැනකට පසු ZWJ.

මෙහි කළ පරීක්ෂණය: තනි ා හෝ ZWNJ + ා HarfBuzz තුළ තිත් කවයක් ලබා ගනී.

  • අදාළ වන්නේ: සියලු ලකුණුවලට.
  • විශ්වාසය: "අවලංගු" යන්නට ඉහළ. දර්ශන සම්මුතිය විවාදාත්මකය (§10 බලන්න).
  • මූලාශ්‍ර: S5 §5.4, S6 අයිතමය 1, S7 ("Handling invalid combining marks"), S16.

VS-009: හල් ලකුණට පසු ZWJ, ව්‍යඤ්ජනයක් හෝ අවසානයක් හැර වෙනත් කිසිවක් නොයෙදේ ​

ප්‍රකාශය. හල් ලකුණ ස්වරය ඉවත් කරයි. ඊට පසු ස්වර ලකුණක් යෙදීම පරස්පර විරෝධීය. මෙහි කළ පරීක්ෂණය: ක + ් + ා → ා ට පෙර තිත් කවයක්. ක + ් + ෙ → තිත් කවයක්. ක + ් + ් → තිත් කවයක්. අනුස්වාරය/විසර්ගයද හල් ලකුණට පසු නොයෙදිය යුතුය (LGR අනුව ං ට හල් ලකුණ හැර ඕනෑම ලකුණකට පසු යෙදිය හැක).

  • අදාළ වන්නේ: hal.
  • විශ්වාසය: ඉහළ.
  • මූලාශ්‍ර: S9 §3.3.4 සහ §7, S16.

VS-010: එක් අක්ෂරයකට එක් ස්වර ලකුණක් ​

ප්‍රකාශය. ව්‍යඤ්ජනයක් ගන්නේ උපරිම වශයෙන් එක් ස්වර ලකුණකි. SLS 1134 ව්‍යඤ්ජනයකට හරියටම ස්වර රූප 17ක් ගණන් කරයි (හිස් ව්‍යඤ්ජනය + හල් + ස්වර ලකුණු 16, ෟ ෳ හැර) සහ ලකුණු කිහිපයකින් ලිවීම නිර්දේශ නොකරයි. හැඩගැන්වීමේ එන්ජින් මේ ගැන ලිහිල්ය. මෙහි කළ පරීක්ෂණය: කාා, කිි සහ කුු HarfBuzz තුළ තිත් කවයක් නොලබයි. ක්‍රියාත්මක කිරීම් මේ සම්බන්ධයෙන් වෙනස් වන බව Microsoft පිරිවිතරය සඳහන් කරයි. නිවැරදිව සැකසූ පෙළෙහි කිසි විට එක් ව්‍යඤ්ජනයක ලකුණු දෙකක් නැත.

  • ව්‍යතිරේකය: අනුස්වාරය ං හෝ විසර්ගය ඃ ස්වර ලකුණකට පසුව යෙදිය හැක. එය සැමවිටම පොකුරේ අවසානයේ සිටී (කාං, කෝං).
  • විශ්වාසය: ඉහළ.
  • මූලාශ්‍ර: S5 §3.5 සහ §5.5, S7, S9 §5.6.4, S16.

5. ව්‍යඤ්ජනයට විශේෂිත හැඩ ​

මේවා අකුරු මුහුණත සහ හැඩගැන්වීමේ එන්ජිම සම්බන්ධ කරුණුය. ඒවා කිසි විට කේතනය වෙනස් නොකරයි. පෙළ සැකසීමට ඒවා වැදගත් වන්නේ, ලියන්නන් තමන් දකින දේ එක සමාන පෙනෙන කේත ලක්ෂ්‍යවලින් ලිවීමට උත්සාහ කළ හැකි නිසා පමණි.

VS-011: ර + ae / aee: අක්‍රමවත් සංයුක්ත රූප ​

ප්‍රකාශය. ර + ැ → රැ සහ ර + ෑ → රෑ අක්‍රමවත් අක්ෂර රූප වේ (Unicode Table 13-5). කේතනය ර U+0DBB + U+0DD0/U+0DD1 ලෙසම පවතී.

  • උදාහරණ: රැය (ræya, "රාත්‍රිය"), රෑ (ræː).
  • අදාළ වන්නේ: ra; ae, aee.
  • විශ්වාසය: ඉහළ.
  • මූලාශ්‍ර: S1 Table 13-5, S5 §5.4, S7 (psts උදාහරණය), S16.

VS-012: ර + u / uu: අක්‍රමවත් සංයුක්ත රූප ​

ප්‍රකාශය. ර + ු → රු සහ ර + ූ → රූ විශේෂ හැඩ ගනී. මේවායේ u ලකුණ පහළින් නොව, කොක්කක් මෙන් දකුණු පසින් එකතු වේ. රු/රූ සඳහා යොදන ලකුණ සාමාන්‍යයෙන් æ සඳහා යොදන ලකුණ මෙන් පෙනෙන බවත්, රැ/රෑ වෙනස් විශේෂ හැඩ ගන්නා බවත් විකිපීඩියාව සඳහන් කරයි. SLS 1134 මේ සඳහා වෙනම කේතයක් නොදෙයි: එය ගබඩා කරන්නේ ර + pāpilla ලෙසය.

  • උදාහරණ: රුපියල (rupiyala), රූපය (rūpaya).
  • අදාළ වන්නේ: ra; u, uu.
  • විශ්වාසය: ඉහළ.
  • මූලාශ්‍ර: S1 Table 13-5, S5 §5.4 සහ §6.2, S14, S16.
  • සටහන. S1 හි HTML පිටපතේ රු/ළු පේළිවල ◌ු ට පසු අනවශ්‍ය ZWJ එකක් පෙනේ. මෙය අවශ්‍ය ZWJ එකක් නොව දර්ශනයේ දෝෂයක් ලෙස සැලකේ; කිසිදු මූලාශ්‍රයක් මෙය සඳහන් නොකරයි [විසඳා නැත] (§10, අයිතමය 11).

VS-013: ළ + u / uu ​

ප්‍රකාශය. ළ + ු → ළු සහ ළ + ූ → ළූ අක්‍රමවත් අක්ෂර රූප වේ. SLS ළු වෙනම රූපයක් ලෙස ලැයිස්තුගත කරයි. නමුත් එය තවමත් ගබඩා කරන්නේ ළ U+0DC5 + ු U+0DD4 ලෙසය. ළූ, ළු + ෑ මෙන් පෙනිය හැක. නමුත් එය ළ + ූ ලෙස ගබඩා කළ යුතුය.

  • උදාහරණ: කළු (kaḷu, "කළු පාට").
  • අදාළ වන්නේ: lla; u, uu.
  • විශ්වාසය: ඉහළ.
  • මූලාශ්‍ර: S1 Table 13-5, S5 §5.4 සහ §6.1–6.2.

VS-014: u / uu හි "කොකු" රූපය ​

ප්‍රකාශය. ක, ග, ඟ, ත, භ සහ ශ මත ු සහ ූ විකල්ප කොකු රූපයක් ගනී (දකුණු පාදයට එකතු වේ). SLS මේවා "ketti/diga paa-pilla 2" ලෙස හඳුන්වයි. ඉරේ හැඩය ව්‍යඤ්ජනය අනුව වෙනස් වන නමුත් කේතය එලෙසම පවතින බවද එය සඳහන් කරයි. Nirmala UI සමඟ මෙහි කළ පරීක්ෂණය කොකු රූපය හරියටම මෙම හය මත පමණක් ඇති බව තහවුරු කරයි. අනෙක් සියලු ව්‍යඤ්ජන පාදයට පහළින් සාමාන්‍ය වළල්ල ගනී.

  • උදාහරණ: කුකුළා (kukuḷā), ගුරු (guru), තුන (tuna), භූමිය (bhūmiya), ශුද්ධ (śuddha).
  • අදාළ වන්නේ: ka, ga, nnga, ta, bha, sha; u, uu.
  • විශ්වාසය: ඉහළ.
  • මූලාශ්‍ර: S1, S5 වගුව 1 (7a, 8a), S14, S16.

VS-015: ද වැනි පාදවල පහළ වලිගය නැති වීම ​

ප්‍රකාශය. ද වැනි හැඩයක් ඇති පාදවලට පහළින් ලකුණක් එකතු වූ විට ඒවායේ පහළට යන වලිගය නැති වේ (දු, දූ, සහ ද්‍ර). මෙහි කළ පරීක්ෂණය: Nirmala UI තුළ ඳු අකුරේත් වලිගය නැති වේ. යුනිකේතය සම්පූර්ණ පන්තිය ලැයිස්තුගත නොකරයි. එබැවින් ඳ පිළිබඳ කරුණ ලේඛනගත නීතියක් නොව අකුරු මුහුණතක නිරීක්ෂණයක් පමණි [විසඳා නැත] (§10, අයිතමය 7).

  • උදාහරණ: දුව (duva), අඳුර (an̆dura).
  • අදාළ වන්නේ: da, nda (නිරීක්ෂිත); u, uu, රකාරාංශය.
  • විශ්වාසය: da සඳහා ඉහළ, nda සඳහා මධ්‍යම.
  • මූලාශ්‍ර: S1, S16.

VS-016: රකාරාංශ / යංශ පොකුරු මත ස්වර ලකුණු ​

ප්‍රකාශය. ක්‍ර හෝ ක්‍ය වැනි පොකුරකට පසු ස්වරය අයත් වන්නේ ර හෝ ය ටය. එහි ලකුණ දකුණු කෙළවරේ ඇති කොටසට එකතු වේ. කොම්බුව සම්පූර්ණ පොකුරට පෙර යයි.

රකාරාංශ පොකුරක් මත ු/ූ තවත් හැඩ යුගලයක් ගනී. මේවා ැ/ෑ ලෙස කේතනය නොකළ යුතුය. ැ/ෑ එක සමාන පෙනුණත් තරමක් ඉහළින් සිටී (යුනිකේතයේ පැහැදිලි අනතුරු ඇඟවීම).

SLS 1134 වගුව 3 වලංගු ස්වර ලැයිස්තුගත කරයි:

පොකුරවලංගු ස්වර (SLS 1134 වගුව 3)
යංශයa, aa, u, uu, e, ee, o, oo
රකාරාංශයa, aa, ae, aee, i, ii, e, ee, ai, o, oo, au

අනෙක් සංයෝජන භාවිත නොවුණත් ඒවාටද ඉඩ දිය යුතු බව SLS පවසයි.

  • උදාහරණ: ක්‍රෝධය (krōdhaya), ප්‍රශ්නය, ත්‍රි, ව්‍යාපාරය, ක්‍රූර (krūra).
  • අදාළ වන්නේ: රකාරාංශය/යංශය සහිත සෑම ව්‍යඤ්ජනයකටම.
  • විශ්වාසය: කේතනය සඳහා ඉහළ. රකාරාංශයට පසු ru/ruu ගැන ගැටුමක් ඇත (§10 බලන්න).
  • මූලාශ්‍ර: S1, S5 වගුව 3 සහ §6.3, S7 (vatu, abvs).

VS-017: හල් ලකුණට හැඩ දෙකක් ඇත ​

ප්‍රකාශය. බොහෝ අකුරුවල හල් ලකුණ සුපුරුදු කොඩිය ("kodiya") ලෙස පෙනේ. සමහර අකුරුවල එය දෙවන හැඩයක් ගනී. SLS ට් උදාහරණයට ගනී. යුනිකේතය ච් උදාහරණයට ගනී. මෙහි කළ පරීක්ෂණය (Nirmala UI): ච් ජ් ඦ් ට් සහ ර් වෙනස් ලෙස පෙනේ. නමුත් නිශ්චිත පන්තිය අකුරු මුහුණත මත රඳා පවතී. කෙසේ වෙතත් කේත ලක්ෂ්‍යය එකක් පමණි (U+0DCA).

  • අදාළ වන්නේ: hal.
  • විශ්වාසය: කේතය එකම බවට ඉහළ. නිශ්චිත අකුරු ලැයිස්තුවට අඩු.
  • මූලාශ්‍ර: S1, S5 වගුව 1 (1a) සහ §5.4, S16.

VS-018: කොම්බුවේ පිහිටීම ​

ප්‍රකාශය. දර්ශනයේදී කොම්බුව (සහ ේ ො ෝ ෞ හි වම් කොටස, සහ ෛ) සම්පූර්ණ අක්ෂර පොකුරට පෙර යයි: ZWJ සංයුක්ත අකුරක, රකාරාංශ/යංශ පොකුරක හෝ ස්පර්ශ අකුරු පොකුරක පළමු ව්‍යඤ්ජනයට පෙර. ස්වරයේ ඉතිරි කොටස දකුණු කෙළවරේ කොටසට එකතු වේ. ගබඩාවේදී තවමත් මුලින් පොකුර, ඉන්පසු ලකුණයි.

  • උදාහරණ: ක්‍රෝ → ෙ ක්‍ර ා ් ලෙස දර්ශනය වේ. ද්‍යෙ.
  • ව්‍යතිරේකය: රේඵය ඊළඟ පාදයට ඉහළින් සිටින අතර කොම්බුවට පෙර එන කොටසට අයත් නොවේ. කොම්බුව එම පාදයට පෙර යයි.
  • අදාළ වන්නේ: e, ee, ai, o, oo, au.
  • විශ්වාසය: ඉහළ.
  • මූලාශ්‍ර: S7 (පාදයට පෙර කොටස පොකුරේ ආරම්භයට නැවත පෙළගැසේ), S10 ("ensure pre-base dependent vowels precede consonant clusters"), S14.

6. භාවිතයේ ඇති ව්‍යඤ්ජන + ස්වර සංයෝජන ​

VS-019: ඇ / ඈ සහ ැ / ෑ සුවිශේෂී ලෙස සිංහලයට අයත්ය ​

ප්‍රකාශය. ඉන්දු-ආර්ය අක්ෂර මාලා අතර æ ස්වර ඇත්තේ සිංහලයට පමණි. ඒවා දළ වශයෙන් 7 වන සියවසේ සිට භාවිතයේ ඇත. දේශීය වචනවල සහ ඉංග්‍රීසි ණය වචනවල ඒවා බහුලය. සංස්කෘත/පාලි ණය වචනවල ඒවා නැත. එබැවින් මහාප්‍රාණ සහ සංස්කෘතයට පමණක් අයත් ව්‍යඤ්ජන ැ/ෑ ගන්නේ කලාතුරකිනි.

  • උදාහරණ: ඇස (æsa), පැන (pæna), කෑම (kǣma), බැංකුව, ෆෑන් (NLPC 829).
  • අදාළ වන්නේ: ae, aee.
  • විශ්වාසය: සුවිශේෂීත්වයට ඉහළ. "මහාප්‍රාණ මත දුර්ලභ" යන්නට මධ්‍යම (අනුමානයකි).
  • මූලාශ්‍ර: S1, S5 §3 සටහන 1, S9.

VS-020: ෘ /ru/ ලෙස උච්චාරණය වේ: සංස්කෘත ṛ, සහ වෙනත් වචනවල C + r + u ​

ප්‍රකාශය. ෘ (ගැටපිල්ල) තත්සම (සංස්කෘත) වචනවල යෙදේ. එය ru (හෝ ri) ලෙස උච්චාරණය වේ. මිශ්‍ර හෝඩියේ ṛ ශුද්ධ සිංහලයේදී උච්චාරණය අනුව r+u ලෙසද ලිවිය හැක. SLS එය සම්මත රූප 17 අතරට ගණන් කරයි. ෘ /ru/ ලෙස කියවන නිසා ලියන්නන් සංස්කෘත නොවන වචනවල සහ ඉංග්‍රීසි ණය වචනවල ව්‍යඤ්ජනයකට පසු /ru/ සහ /ruː/ සඳහාද ෘ/ෲ භාවිත කරයි (ගෲප්, ඇන්ඩෲ). C + r + u/uu සඳහා සුපුරුදු අක්ෂර වින්‍යාසයද එයයි (VS-035).

  • භාවිතයේ හමු වූ ව්‍යඤ්ජන (උදාහරණ, NLPC ටෝකන): කෘෂිකර්මය 941, ගෘහ 5,906, තෘප්තිය 1,103, දෘෂ්ටිය 987, ධෘති (දුර්ලභ: 2), නෘත්‍ය 106, පෘථිවිය 2,451, බෘහස්පති 26, භෘත්‍ය (දුර්ලභ: 2), මෘදු 1,616, වෘක්ෂ 350, ශෘංගාර 268, සෘජු 3,302, හෘදය 1,375, ඝෘණා (දුර්ලභ: තනි වචනයක් ලෙස 0, ප්‍රත්‍ය සමඟ 26; LGR ඝෘ අනුක්‍රමයක් ලෙස ලැයිස්තුගත කරයි).
  • කිසි විට නැත: ර+ෘ (සංස්කෘතයේ rṛ නැත) [inferred], ළ ඞ ඤ ඥ ඦ, සඤ්ඤක අකුරු, ණ ය ල ෂ [inferred]. ඉංග්‍රීසි ණය වචනවල ෆ භාවිතයේ හමු වේ (ෆෘට් "පලතුරු", S17).
  • අදාළ වන්නේ: ru.
  • විශ්වාසය: සංස්කෘත ṛ සඳහා ඉහළ. පුළුල් /ru/ භාවිතය සඳහා ඉහළ (S17, VS-035). ව්‍යඤ්ජන ලැයිස්තුවට මධ්‍යම.
  • මූලාශ්‍ර: S5 වගුව 2, S9 වගු 2 සහ 3a, S11, S14, S17.

VS-021: ෲ, ෟ, ෳ, ඎ, ඏ, ඐ ආන්තික වේ ​

ප්‍රකාශය.

  • ඏ සහ ඐ වර්තමාන භාවිතයේ නැත (SLS).

  • ඎ වර්තමාන භාවිතයේ නැත, නමුත් එහි ලකුණ ෲ භාවිත වේ (SLS).

  • ෳ (දිග ගයනුකිත්ත) භාවිත නොවේ (SLS).

  • LGR ෟ සහ ෳ "භාවිතය නොදන්නා" ඒවා ලෙස බැහැර කරයි. එය ඎ ඏ ඐ ද බැහැර කරයි.

  • ෟ ඉතිරිව ඇත්තේ ෞ හි දෙවන කොටස ලෙසය. SLS ගයනුකිත්ත සලකන්නේ au සාදන ඉර ලෙසය.

  • උදාහරණ: ෲ මාතෲ (NLPC 65) සහ කර්තෲ (දුර්ලභ: NLPC 15) වැනි සංස්කෘත මූලවල යෙදේ. බොහෝ විට උපුටා දක්වන pitṝ (පිතෲ) NLPC හි තනි වචනයක් ලෙස හමු නොවේ (ප්‍රත්‍ය සමඟ ටෝකන 4).

  • අදාළ වන්නේ: ruu, ilu, iluu.

  • විශ්වාසය: ඉහළ.

  • මූලාශ්‍ර: S5 §3.1 සටහන් 2–3 සහ §3.4 සටහන 4, S9 වගුව 4.

VS-022: ණය වචනවල ෛ / ෞ; දේශීය ai/au සඳහා ය/ව ​

ප්‍රකාශය. සන්ධ්‍යක්ෂර ලකුණු ෛ සහ ෞ මිශ්‍ර (සංස්කෘත මූලයක් ඇති) කට්ටලයට අයත්ය. ශුද්ධ සිංහල අක්ෂර වින්‍යාසයේ ai, a + yi ලෙසද au, a + wu ලෙසද ලියයි. කථිත සිංහලයේ සන්ධ්‍යක්ෂර බොහොමයක් ඇති අතර ඒ සියල්ල ඉහළ ස්වරයකින් අවසන් වේ. ඒවා ලියන්නේ ය/ව ව්‍යඤ්ජනය සහ ලකුණක් සමඟය.

  • උදාහරණ (ෛ): සෛලය, වෛද්‍ය, දෛනික, ජෛව, මෛත්‍රී, ඓතිහාසික (ස්වතන්ත්‍ර).
  • උදාහරණ (ෞ): පෞද්ගලික, බෞද්ධ, භෞතික, සෞඛ්‍යය, ගෞරවය, යෞවන, ලෞකික, ඖෂධ (ස්වතන්ත්‍ර).
  • උදාහරණ (දේශීය / ඉංග්‍රීසි ණය වචන): අයිය (ayiya), ලයිට් (light), කවුද (kavuda/kauda), මවුස්.
  • අදාළ වන්නේ: ai, au.
  • විශ්වාසය: මූලධර්මයට ඉහළ. ඉහත සෑම උදාහරණයක්ම NLPC හි හමු වේ (සෛලය ටෝකන 285 සිට වෛද්‍ය 46,508 දක්වා).
  • මූලාශ්‍ර: S11 (සන්ධ්‍යක්ෂර ලැයිස්තුව), S14.

VS-023: ඞ ස්වර ලකුණු නොගනී ​

ප්‍රකාශය. SLS 1134 අනුව ඞ කිසි විට ස්වරයක් සමඟ එක් නොවන අතර යෙදෙන්නේ ඞ් ලෙස පමණි (සඞ්ඝ හි මෙන්). LGR ඞ නූතන භාවිතයේ නැති බැවින් බැහැර කරයි. නූතන ලේඛනයේ ඞ් වෙනුවට සාමාන්‍යයෙන් අනුස්වාරය ං යෙදේ.

  • අදාළ වන්නේ: nga × සෑම ස්වර ලකුණක්ම (කිසි විට නැත). nga + hal වලංගු නමුත් දුර්ලභය.
  • විශ්වාසය: ඉහළ.
  • මූලාශ්‍ර: S5 §3.5 සටහන 1, S9 වගුව 4.

VS-024: ඦ පුරාතනය ​

ප්‍රකාශය. සමකාලීන ලේඛනයේ ඦ හමු නොවේ (SLS). LGR අනුව එය යෙදෙන්නේ බල්ලෙකු කැඳවීමට භාවිත කරන එක් වචනයක පමණි. එය මත ඇති සෑම ලකුණක්ම දුර්ලභ ලෙස සලකන්න. එය සමඟ කිසි විට හල් ලකුණ භාවිත නොකරන්න (VS-025).

  • අදාළ වන්නේ: nyja.
  • විශ්වාසය: ඉහළ.
  • මූලාශ්‍ර: S5 §3.2 සටහන 1, S9 වගුව 4.

VS-025: සඤ්ඤක අකුරු ස්වර ගනී, නමුත් හල් ලකුණ නොගනී ​

ප්‍රකාශය. ස්වර ලකුණු සඤ්ඤක ව්‍යඤ්ජනයකට එකතු වන්නේ සාමාන්‍ය ස්පර්ශ ව්‍යඤ්ජනයට එකතු වන ආකාරයටමය (S14). LGR හි සම්පූර්ණ ලේබල නීති සඤ්ඤක + ස්වර ලකුණ සහ සඤ්ඤක + ං ට ඉඩ දෙයි. නමුත් සඤ්ඤක අකුරුවලට පසු හල් ලකුණ යෙදිය නොහැකි බව පවසයි.

  • උදාහරණ: කුඹුර (kum̆bura), අඳුර, ගඟ, කඳු, අඹ.
  • අදාළ වන්නේ: nnga, nndda, nda, mba, nyja.
  • විශ්වාසය: "හල් නැත" යන්නට ඉහළ. එක් එක් ලකුණ කොතරම් වාර ගණනක් යෙදේද යන්නට මධ්‍යම.
  • මූලාශ්‍ර: S9 §3.3.6 සහ §5.6.5, S14.

VS-026: ඥ සහ ඤ ​

ප්‍රකාශය. ඥ (jña) බෙදිය නොහැකි සංයුක්ත අකුරකි. වචනයක මුලදී එය ඤ ලෙසම ශබ්ද වේ. නමුත් වෙනත් තැන්වල එය ව්‍යඤ්ජන පොකුරකි. දෙකම ස්වර ලකුණු ගනී. ඥා බොහෝ සෙයින්ම බහුලතම රූපයයි.

  • උදාහරණ: ඥාතියා, ඥානය, විඥානය, ප්‍රඥාව, සංඥාව; ඤාණ (පාලි විලාසය).
  • අදාළ වන්නේ: jnya, nya.
  • විශ්වාසය: සංඛ්‍යාතය සඳහා මධ්‍යම.
  • මූලාශ්‍ර: S1, S5 §3.2 සටහන 2.

VS-027: ෆ ණය වචන සඳහා පමණි ​

ප්‍රකාශය. ෆ (fa) ඉංග්‍රීසි සහ වෙනත් ණය වචන සඳහා භාවිත වේ. එය සාමාන්‍ය ලකුණු (ා ැ ෑ ි ී ු ූ ෙ ේ ො ෝ ්) ගනී, නමුත් ෘ ෲ ෛ ෞ නොගනී.

  • උදාහරණ: ෆයිල් (file), ෆෝන් (phone), ෆිල්ම් (film).
  • අදාළ වන්නේ: fa.
  • විශ්වාසය: මධ්‍යම (අකුර භාවිත වන කාර්යයෙන් අනුමාන කළ).
  • මූලාශ්‍ර: S2, S5 §3.2.

VS-028: මහාප්‍රාණ සහ සංස්කෘතයට පමණක් අයත් ව්‍යඤ්ජන ​

ප්‍රකාශය. ඛ ඝ ඡ ඣ ඨ ඪ ථ ධ ඵ භ ශ ෂ (සහ බොහෝ ස්ථානවල ණ) මිශ්‍ර හෝඩියට අයත්ය. ඒවා ප්‍රධාන වශයෙන් තත්සම/පාලි ණය වචනවල යෙදේ. එබැවින් ඒවායේ ලකුණු කට්ටලය සංස්කෘත කට්ටලයයි: ැ/ෑ නැත හෝ දුර්ලභය, නමුත් ෘ ෛ ෞ යෙදිය හැක. ඉංග්‍රීසි ණය වචනවල ශ/ෂ + ැ ද යෙදේ (උදාහරණයක් ලෙස ෂැම්පු, NLPC 218).

  • විශ්වාසය: මධ්‍යම.
  • මූලාශ්‍ර: S14 (මිශ්‍ර සහ ශුද්ධ හෝඩිය), S5.

7. ස්වතන්ත්‍ර ස්වරය සහ ලකුණ; ස්වර එක ළඟ යෙදීම සහ අර්ධ ස්වර; දිග ​

VS-029: ස්වතන්ත්‍ර ස්වර වචන මුලදී යෙදේ ​

ප්‍රකාශය. SLS 1134 අනුව ස්වර 18, ව්‍යඤ්ජන මෙන් නොව, භාවිත වන්නේ වචනවල මුලදී පමණි. ස්වතන්ත්‍ර ස්වර වචන අරඹන බවත් පරායත්ත ස්වර ව්‍යඤ්ජනවලට පසු එන බවත් LGR එකතු කරයි. වචනයක් ඇතුළත ව්‍යඤ්ජනයකට පසු එන ස්වරයක් සැමවිටම ලකුණකි. වෙනත් ස්වරයකට පසු එන ස්වරයක් විසඳන්නේ අර්ධ ස්වරයකින් (VS-030) හෝ සන්ධියෙන් (VS-031) මිස දෙවන ස්වතන්ත්‍ර ස්වරයක් ලිවීමෙන් නොවේ.

  • ව්‍යතිරේක [විසඳා නැත]: අකුරෙන් අකුර කියවන කෙටි යෙදුම් සහ අකුරුවල නම් (ඩී එන් ඒ), සන්ධි නොකර ලියන සමහර සමාස සහ ණය උපසර්ග රූප, සහ පාලි පාඨ. §10, අයිතමය 9 බලන්න.
  • අදාළ වන්නේ: සියලු ස්වරවලට.
  • විශ්වාසය: නීතියට ඉහළ. ව්‍යතිරේක ලැයිස්තුවට අඩු.
  • මූලාශ්‍ර: S5 §3.1, S9 §3.3.2.

VS-030: ස්වර එක ළඟ යෙදීම ය (ඉදිරි ස්වරවලට පසු) හෝ ව (පසු ස්වරවලට පසු) මඟින් විසඳේ ​

ප්‍රකාශය. නාම පදවල මූලය සහ ප්‍රත්‍යය හමු වන තැන ස්වර දෙකක් එක ළඟ යෙදුණු විට සිංහලය සැමවිටම අර්ධ ස්වරයක් ඇතුළු කර එය විසඳයි. i හෝ æ ට පසු එය j (ය) වන අතර u හෝ ā ට පසු w (ව) වේ. ක්‍රියා පදවල ස්වරයක් ඉවත් කිරීමට වැඩි නැඹුරුවක් ඇත. අක්ෂර වින්‍යාසය උච්චාරණය අනුගමනය කරයි. එබැවින් අර්ධ ස්වරය ලියන්නේ ඊළඟ ස්වරය දරන ය/ව ව්‍යඤ්ජනය ලෙසය.

මූලික රූපයකථනයේලිඛිතඅර්ථය
ræ + a[ræjə]රැයරාත්‍රිය (නිශ්චිත)
toppi + a[toppijə]තොප්පියතොප්පිය (නිශ්චිත)
ašu + a[ašuwə]අටුව (NLPC 85)අට්ටාලය (නිශ්චිත)
maaligaa + a[maaligaawə]මාලිගාවමාලිගාව (නිශ්චිත)

සාමාන්‍ය අක්ෂර වින්‍යාස: dia → දිය, dua → දුව, kiyanawa → කියනවා, diyunu → දියුණු (iu → ඉයු), ovun → ඔවුන් (ou → ඔවු), æyi → ඇයි "කුමක් නිසාද" (æi → ඇයි).

  • අදාළ වන්නේ: සියලු ස්වර අනුක්‍රමවලට; ya, va.
  • විශ්වාසය: නාම පද සඳහා ඉහළ (භාෂා විද්‍යාත්මක මූලාශ්‍රය). පොදු අක්ෂර වින්‍යාස ප්‍රකාශය සඳහා මධ්‍යම.
  • මූලාශ්‍ර: S12 (Smith 2001 උපුටා දක්වයි), S11.

VS-031: සමාසවල ආගම (ඇතුළු කිරීමේ) සන්ධිය ​

ප්‍රකාශය. සමාසවල පළමු පදයේ අවසාන ස්වරය සහ දෙවන පදයේ මුල් ස්වරය අතරට ය හෝ ව (හෝ ඉඳහිට ර) ඇතුළු වේ.

  • උදාහරණ: නො + එක් → නොයෙක් (ය), කටු + අල → කටුවල (ව), නි + අවුල් → නිරවුල් (ර).
  • වෙනත් ස්වර සන්ධි: ඒ වෙනුවට ස්වරය ඉවත් විය හැක, නැතහොත් වෙනත් ස්වරයකින් ආදේශ විය හැක (දන්ත + ආලේප → දන්තාලේප).
  • විශ්වාසය: මධ්‍යම (විකිපීඩියා හැඳින්වීම පමණි; පෙළපොත ලබා ගත නොහැකි විය).
  • මූලාශ්‍ර: S13.

VS-032: ස්වර දිග අර්ථ භේදකය; දිග ස්වරවලට වෙනම ලකුණු ඇත ​

ප්‍රකාශය. කෙටි සහ දිග ස්වර වෙනස් ස්වනිම වේ (මුළු ස්වර ස්වනිම 14ක්). සෑම දිග ස්වරයකටම තමන්ගේම ලකුණක් ඇත:

කෙටිදිග
(ආවේණික)ා
ැෑ
ිී
ුූ
ෙේ
ොෝ
ෘෲ

ේ සහ ෝ හි දිග සලකුණ හල් ලකුණේ ඉරයි. ස්වතන්ත්‍ර අකුරු ඒ සහ ඕ ද එලෙසම ක්‍රියා කරයි.

  • උදාහරණ යුගල (NLPC ටෝකන): බල 30,873 / බාල 8,405 (bala / bāla), සුදු 30,640 / සූදු 1,106 (sudu "සුදු පාට" / sūdu "සූදුව"), මල 12,867 / මාල 1,665.
  • විශ්වාසය: ක්‍රමයට ඉහළ. උදාහරණ යුගලවලට මධ්‍යම.
  • මූලාශ්‍ර: S2, S5 වගුව 2, S11.

VS-033: පිලි සම්බන්ධ පොදු අක්ෂර වින්‍යාස දෝෂ ​

  1. ස්වර දිග (හ්‍රස්ව/දීර්ඝ) සිංහල පෙළෙහි බහුලතම දෝෂ වර්ගයයි (S15).
  2. ෘ සහ ්‍ර / රු පටලවා ගැනීම (ගෘහ සහ ග්‍රහ, සැබෑ අර්ථ වෙනසකි).
  3. ෛ/ෞ සහ ayi/avu. උදාහරණයක් ලෙස වෛද්‍ය නිවැරදිය. එය අයි සමඟ ලිවීම වැරදිය.
  4. කේතන දෝෂ: ෛ වෙනුවට ෙ+ෙ; ෝ වෙනුවට ෙ+්+ා; ආ වෙනුවට අ+ා; රකාරාංශ-u රූප වෙනුවට ැ/ෑ ගබඩා කිරීම (S1 අනතුරු ඇඟවීම; ක්‍රෑර, ශ්‍රැති, VS-035 බලන්න); එක් ව්‍යඤ්ජනයක ලකුණු දෙකක්.
  5. ඥ/ඤ වචන මුලදී මාරු වීම (එහිදී ඒවා එක ලෙස ශබ්ද වේ; S5).
  • විශ්වාසය: 1 සහ 4 සඳහා ඉහළ. 2, 3 සහ 5 සඳහා මධ්‍යම.
  • මූලාශ්‍ර: S15, S1, S4, S5, S16.

VS-035: C + r + u/uu සාමාන්‍යයෙන් ෘ/ෲ ලෙස ලියයි; විකල්පය රකාරාංශය + ු/ූ ය ​

ප්‍රකාශය. /ru/ හෝ /ruː/ ට පෙර එන ව්‍යඤ්ජනයකට නිවැරදි කේතන දෙකක් ඇත. ෘ /ru/ ලෙස උච්චාරණය වන නිසා දෙකම එකම ලෙස කියවේ (VS-020, 05:G2P-011):

  • C + ෘ / ෲ: කෘ, කෲර, මෘදු, ගෲප්. බොහෝ සෙයින් බහුල වන්නේ මෙම අක්ෂර වින්‍යාසයයි.
  • C ් ZWJ ර + ු / ූ (රකාරාංශය + u/uu): ක්‍රු, ක්‍රූර. රකාරාංශය + u/uu අක්ෂර රූප පෙන්වීමට S1 භාවිත කරන්නේ මෙම අක්ෂර වින්‍යාසයයි (VS-016).

තෙවන අක්ෂර වින්‍යාසයක් රකාරාංශය + u/uu අක්ෂර රූපයේ පෙනුම ැ/ෑ මඟින් අනුකරණය කරයි (ක්‍රෑර, ශ්‍රැති, භ්‍රෑණ). එය බහුල නමුත් වැරදිය: ැ/ෑ ලියන්නේ /æ/ ස්වරයයි. මෙම ආදේශයට එරෙහිව S1 අනතුරු අඟවයි (VS-016, VS-033).

සාක්ෂි (S17). ලැයිස්තුවේ C + ෘ/ෲ සමඟ ලියූ සෑම වචනයක් සඳහාම, එම වචනයම රකාරාංශය + ු/ූ සමඟද රකාරාංශය + ැ/ෑ සමඟද සොයා බැලිණි. අක්ෂර වින්‍යාස දෙකක් හෝ වැඩි ගණනක් හමු වන තැන්වල, වචන 155ක ෘ/ෲ ද, 47ක රකාරාංශය + ැ/ෑ ද, 3ක රකාරාංශය + ු/ූ ද බහුලතම වේ (reports/corpus-counts.md හි CC-02). පහත ගණන් වචනය සහ එහි වරනැඟූ රූප, එනම් එයින් ආරම්භ වන සෑම වචනයක්ම, ඇතුළත් කරයි (CC-03):

වචනයC + ෘ/ෲ්‍ර + ු/ූ්‍ර + ැ/ෑ
krūra "කුරිරු"කෲර 1,6679186
saṃskṛtika "සංස්කෘතියට අදාළ"සංස්කෘතික 14,68030
mṛdukāṃga "පරිගණක වැඩසටහන්"මෘදුකාංග 16,49230
ṛju "කෙළින්ම"සෘජු 7,01300
"group" (ඉංග්‍රීසි)ගෲප් 937, ගෘප් 685114
śrutiශෘති 213124
bhrūṇa "කලලය"භෲණ 0280

සිංහල විකිපීඩියාවද මෙයට එකඟ වේ (S18): කෲර ලිපි 126ක, ක්‍රෑර 24ක ඇති අතර ක්‍රූර එකකවත් නැත (CC-16). අවසාන පේළි දෙකෙන් පෙනෙන්නේ ශාස්ත්‍රීය වචන කිහිපයක ැ/ෑ ආදේශය ජය ගන්නා බවයි. දී ඇති වචනයක අක්ෂර වින්‍යාසය තෝරා ගත යුත්තේ ස්ථාවර නීතියකින් නොව ශබ්දකෝෂයකින් වීමට හේතුව එයයි.

ෘ/ෲ සංස්කෘත වචනවලට පමණක් සීමා නොවේ. ඉංග්‍රීසි ණය වචන සහ නම් /ru/ සහ /ruː/ සඳහා ඒවා භාවිත කරයි: ගෲප් "group", ඇන්ඩෲ "Andrew", බෲනායි "Brunei", ෆෘට් "fruit", ටෲමන් "Truman".

දර්ශනය (S16). රකාරාංශය + u/uu අක්ෂර රූපය සම්බන්ධයෙන් අකුරු මුහුණත් එකඟ නොවේ. Noto Sans Sinhala, Noto Serif Sinhala, Yaldevi සහ Gemunu Libre, S1 විස්තර කරන විශේෂ රූපය අඳියි: පොකුරට පසු ෑ ට සමාන ඉරකි. Nirmala UI, Iskoola Pota සහ Abhaya Libre පොකුරට පහළින් සාමාන්‍ය ු/ූ එකතු කරයි. එබැවින් Windows පද්ධති අකුරු මුහුණත් සමඟ නිවැරදිව කේතනය කළ ක්‍රූර කියවන්නන්ට වැරදි ලෙස පෙනේ. ලියන්නන් එය මඟ හරින්නට එක් හේතුවක් මෙය විය හැක [inferred].

  • අදාළ වන්නේ: රකාරාංශය ගන්නා සෑම ව්‍යඤ්ජනයකටම; u, uu, ru, ruu.
  • විශ්වාසය: භාවිත ගණන් සඳහා ඉහළ. අකුරු මුහුණත් මත පදනම් වූ පැහැදිලි කිරීමට මධ්‍යම.
  • මූලාශ්‍ර: S1, S16, S17, S18.

8. වලංගුතා වගුව: ව්‍යඤ්ජන 41 × ස්වර ලකුණු ​

සංකේත.

  • V = වලංගුය, සාමාන්‍ය නූතන වචනවල යෙදේ.
  • L = වලංගුය, නමුත් ප්‍රායෝගිකව සංස්කෘත/පාලි ණය වචනවල (තත්සම) පමණි.
  • R = දුර්ලභ හෝ ආන්තික.
  • N = කිසි විට නැත, භාවිතයේ හමු නොවූ, හෝ ප්‍රමිතියකින් බැහැර කළ.
  • S = විශේෂ අක්ෂර රූප හැඩය (කොටුවේ V/L/R කේතයක්ද ඇත). හැඩය කේතනය වෙනස් නොකරයි.

තීරු: a = ආවේණික ස්වරය; hal = ්; ru ruu ilu iluu = ෘ ෲ ෟ ෳ.

ෟ සහ ෳ තීරු සෑම පේළියකටම N වේ (VS-021). එබැවින් ඒවා පහත වගුවෙන් ඉවත් කර ඇත.

පදනම. වගුව අනිවාර්ය නීති (VS-019 සිට VS-028 දක්වා), අකුරු මුහුණත් නිරීක්ෂණ (S16), සහ තනි තනිව ගණන් නොකළ නිදර්ශන උදාහරණ ඒකාබද්ධ කරයි. අනිවාර්ය නීතිවලින් ඔබ්බට යන කොටු (ඞ ලකුණු, සඤ්ඤක හල්, ෟ/ෳ සඳහා N; S කොටු) මධ්‍යම/අඩු විශ්වාසයක් ඇති අතර පෙළ සංග්‍රහයකින් තහවුරු කළ යුතුය (§10 බලන්න).

ru සහ ruu තීරු S17 සමඟ පරීක්ෂා කරන ලදී (එක් එක් ව්‍යඤ්ජනයේ ගණන්: CC-04). වැරදි අක්ෂර වින්‍යාස ඉවත් කළ පසු, ලැයිස්තුවේ වචන වර්ග 10කට නොඅඩු ගණනක ටෝකන 150කට නොඅඩු ගණනක් ඇති විට කොටුවක් ඉහළ නැංවිණි: ka ga tta dda pa ba + ෲ සහ tta dda fa + ෘ V බවට පත් විය, ta + ෲ L බවට පත් විය (ශාස්තෲ). ya සහ ra පේළි වෙනස් කළේ නැත: ඒවායේ ෘ ටෝකන වැරදි අක්ෂර වින්‍යාස වේ (ව්‍යෘපෘති, ද්‍රෘෂ්ටි).

idCahalaaaeaeeiiiuuururuueeeaioooau
kaකVVVVVVVV SV SLVVVLVVL
khaඛLLLRRLLLLNNLLRLLR
gaගVVVVVVVV SV SLVVVRVVL
ghaඝLLLNNLLLLLNLLNLLN
ngaඞNRNNNNNNNNNNNNNNN
nngaඟVNVRRVVV SR SNNVVNVRN
caචVV SVVVVVVVNNVVLVVR
chaඡLLLNNLLLLNNLLNLLN
jaජVV SVVVVVVVRNVVLVVR
jhaඣRRRNNRRRRNNRRNRRN
nyaඤRRRNNRRRNNNRNNRNN
jnyaඥVNVNNRNRNNNRRNRNN
nyjaඦRNRRRRRRRNNRRNRRN
ttaටVV SVVVVVVVVVVVNVVN
tthaඨLLLNNLLLLNNLLNLLN
ddaඩVVVVVVVVVVVVVNVVN
ddhaඪLLLNNLLLLNNLLNLLN
nnaණVVVRRVVVVNNVVNVVN
nnddaඬVNVRRVVVRNNVVNVRN
taතVVVVVVVV SV SLLVVLVVR
thaථLLLNNLLLLNNLLNLLN
daදVVVVVVVV SV SLRVVLVVL
dhaධLLLRRLLLLLNLLLLLL
naනVVVVVVVVVLNVVLVVL
ndaඳVNVRRVVV SR SNNVVNVRN
paපVVVVVVVVVLVVVLVVL
phaඵLLLNNLLLLNNLLNLLN
baබVVVVVVVVVLVVVRVVL
bhaභLLLRRLLL SL SLNLLLLLL
maමVVVVVVVVVLRVVLVVL
mbaඹVNVRRVVVRNNVVNVRN
yaයVVVVVVVVVNNVVRVVL
raරVV SVV SV SVVV SV SNNVVRVVL
laලVVVVVVVVVNNVVRVVL
vaවVVVVVVVVVLNVVLVVR
shaශLLLRRLLL SL SLNLLLLLL
ssaෂLLLRRLLLLNNLLNLLN
saසVVVVVVVVVLNVVLVVL
haහVVVVVVVVVLNVVRVVR
llaළVRVVRVVV SR SNNVRNVRN
faෆVVVVVVVVVVNVVNVVN

වගුව පිළිබඳ සටහන්:

  • S, u/uu: ka ga nnga ta bha sha කොකු රූපය ගනී (VS-014). ra සහ lla අක්‍රමවත්ය (VS-012, VS-013). da සහ nda හි වලිගය නැති වේ (VS-015).
  • S, hal: Nirmala UI තුළ ca ja tta ra මත පෙනෙන හල් ලකුණේ විකල්ප හැඩය (VS-017) (nyja මතද පෙනේ, නමුත් nyja + hal N වේ).
  • S, ae/aee: ra පමණි (VS-011).
  • Nirmala UI තුළ ru (ෘ) කිසිදු පේළියක ව්‍යඤ්ජනයට විශේෂිත හැඩයක් නොපෙන්වීය.
  • jnya/nya/nyja/jha පේළි: "a/aa යෙදේ" යන්නෙන් ඔබ්බට විශ්වාසය අඩුය.

9. රෝමානුකරණය සහ අක්ෂර පරිවර්තනය සඳහා ඇඟවුම් ​

ලතින් අකුරු රෝමානුකරණයක් සහ සිංහල අකුරු අතර පරිවර්තනය කරන ඕනෑම අයෙකුට, හෝ ගබඩා කළ සිංහල පෙළෙහි වලංගුතාව පරීක්ෂා කරන ඕනෑම අයෙකුට මෙම කරුණු අදාළ වේ.

  1. කැනොනිකල්, තනි කේත ලක්ෂ්‍ය ලකුණු පමණක් භාවිත කරන්න (VS-003 සිට VS-006 දක්වා). එම ලකුණු අදහස් කරන විට රෝමානු "ee" → ේ, "oo" → ෝ, "o" → ො, "au" → ෞ, "ai" → ෛ (U+0DDB). ෙෙ, ෙ+්+ා, අ+ා සහ ඔ+් කිසි විට නිවැරදි ගබඩා රූප නොවේ. NFC ප්‍රයෝජනවත් ආරක්ෂාවකි, නමුත් එය ෙෙ වලින් U+0DDB නිපදවන්නේ නැත.
  2. තාර්කික අනුපිළිවෙළ රෝමානුකරණයට ස්වාභාවිකය. රෝමානු ස්වරයක් එහි ව්‍යඤ්ජනයට පසුව එයි. එය ගබඩා අනුපිළිවෙළට ගැළපේ. කොම්බුව මුලින් එන අනුපිළිවෙළ අයත් වන්නේ ලිවීමට සහ දර්ශනයට පමණි (VS-002, VS-018).
  3. ස්වතන්ත්‍ර ස්වරයද ලකුණද යන්න සන්දර්භය තීරණය කරයි (VS-029). ව්‍යඤ්ජනයකට (හෝ පොකුරකට) පසු ස්වරයක් ලකුණකට අනුරූප වේ. වචන මුලදී එය ස්වතන්ත්‍ර අකුරකට අනුරූප වේ. වෙනත් ස්වරයකට පසු සාමාන්‍ය අක්ෂර වින්‍යාසය දෙවන ස්වතන්ත්‍ර අකුරක් වෙනුවට අර්ධ ස්වරයක් (VS-030) භාවිත කරයි:
    • "dia" → දිය, "dua" → දුව, "aeyi" → ඇයි.
    • සරල මඟපෙන්වීම: i/ii/e/ee/ae/aee ට පසු ය භාවිත කරන්න. u/uu/o/oo/a/aa ට පසු ව භාවිත කරන්න. ඉහළ ස්වරයකට පෙර (ai/au වර්ගයේ අනුක්‍රම), ය/ව + ලකුණ අක්ෂර වින්‍යාසය භාවිත කරන්න.
    • වචනය මැද සැබෑ ස්වතන්ත්‍ර ස්වරයක් ව්‍යතිරේකයකි (කෙටි යෙදුම්). රෝමානුකරණයක් එය පැහැදිලිව සලකුණු කළ යුතුය.
  4. "ai" සහ "au" අපැහැදිලිය (VS-022). ai → ෛ සහ au → ෞ ලෙස සිතියම්ගත කිරීම සෑම වචනයකටම සංස්කෘත අක්ෂර වින්‍යාසය ලබා දෙයි. දේශීය සහ ණය වචනවලට අයි/අවු අවශ්‍යය (ලයිට්, කවුද, හවුස්). විකල්ප:
    • ayi/avu පෙරනිමි කියවීම ලෙස සලකා ෛ/ෞ සඳහා වෙනම සංකේත වෙන් කිරීම, නැතහොත්
    • ශබ්දකෝෂයක් මඟින් වචනයෙන් වචනය තීරණය කිරීම.
  5. "ru" ආකාර තුනකින් ගැටේ (VS-012, VS-016, VS-020): ර+ු, ෘ, සහ රකාරාංශය + ු.
    • "kru" සාමාන්‍යයෙන් කෘ (කෘෂි, කෲර) වන අතර ඉඳහිට ක්‍රු වේ; වචනයෙන් වචනය ශබ්දකෝෂයක් තීරණය කරයි (VS-035), සහ
    • "karu" කිසි විට කෘ නොවිය යුතුය. ආපසු හැරවිය හැකි රෝමානුකරණයක් ෘ සඳහා වෙනම සංකේතයක් (උදාහරණයක් ලෙස ṛ) දිය යුතු අතර, සරල ru යන්නෙන් r+u අදහස් විය යුතුය.
  6. "ae" යනු ඇ බැවින් a + e එක ළඟ යෙදීමට වෙනත් නිරූපණයක් අවශ්‍යය. එය ප්‍රශ්නයක් වන්නේ කලාතුරකිනි, මන්ද a + e එක ළඟ යෙදීම කෙසේ හෝ අර්ධ ස්වරයකින් ලියන බැවිනි (නො + එක් → නොයෙක්, VS-031). රෝමානුකරණයක් "ae" සැමවිටම æ අදහස් කරන බව පැවසිය යුතු අතර, a + e සඳහා අර්ධ ස්වර සලකන නීතියක් (හෝ පැහැදිලි වෙන් කිරීමේ ලකුණක්) භාවිත කළ යුතුය.
  7. නොහැකි යුගල (§8 හි N කොටු) ප්‍රයෝජනවත් වලංගුතා පරීක්ෂාවන් වේ:
    • ඞ මත කිසිදු ලකුණක් නැත (ඒ වෙනුවට ං සුපුරුදු නූතන අක්ෂර වින්‍යාසයයි);
    • ඟ ඬ ඳ ඹ ඦ මත හල් ලකුණ නැත;
    • සංස්කෘත පාඨවලින් පිටත ෟ/ෳ නැත;
    • ෆ, ළ හෝ සඤ්ඤක අකුරු මත ෘ/ෛ/ෞ නැත. L/R කොටු වලංගු නමුත් සංඛ්‍යාතය අඩුය.
  8. ලකුණ + ලකුණ නැත, හල් ලකුණට පසු ලකුණක් නැත (VS-009, VS-010). උදාහරණයක් ලෙස "kaa" + "a" කාා නොදිය යුතුය. රෝමානුකරණයක දෙගුණ කළ ස්වර අකුරක් යනු දිග ස්වරයකි (a → aa, i → ii ආදී ලෙස), දෙවන ලකුණක් නොවේ.
  9. දෙගුණ කිරීමෙන් දිග කිරීම ස්ථාවරය. සෑම කෙටි ලකුණකටම හරියටම එක් දිග ලකුණක් ඇත (VS-032). ස්ථාවර ක්‍රමය a→aa, ae→aee, i→ii, u→uu, e→ee, o→oo, ru→ruu වේ. අවිධිමත් රෝමානුකරණ බොහෝ විට ī සඳහා "ee" ලියයි. "ee" ේ වෙනුවට ී ලෙස අර්ථකථනය කිරීමට ශබ්දකෝෂ සහාය අවශ්‍යය, මන්ද ee → ේ ක්‍රමානුකූල කියවීම වන බැවිනි.
  10. විශේෂ හැඩ සඳහා නීති අවශ්‍ය නොවේ (VS-011 සිට VS-015 දක්වා). කේතනය ඒකාකාරය (ර+ු, ළ+ු). "දෘශ්‍ය" සමාන රූප වැරදිය: ළු වෙනම කේත ලක්ෂ්‍යයක් නොවේ, සහ ැ රකාරාංශ-u ලකුණ නොවේ.
  11. අක්ෂර වින්‍යාස පරීක්ෂාව: දිග දෝෂ බහුලතම වැරැද්දයි (VS-033). ශබ්දකෝෂයක එක් රූපයක් පමණක් ඇති විට දිග විචල්‍ය දෙකම පරීක්ෂා කිරීම වටී.

10. විසඳා නැති ප්‍රශ්න / ගැටෙන මූලාශ්‍ර ​

  1. රකාරාංශය + u/uu. SLS 1134 වගුව 3 වලංගු රකාරාංශ ස්වරවලින් kru/kruu ඉවත් කර, එවැනි අනුක්‍රම "are not used" බව පවසයි. යුනිකේත §13.2 ක්‍රු/ක්‍රූ වෙනම අක්ෂර රූප ප්‍රභේද සහිත සාමාන්‍ය රූප ලෙස දක්වයි. පෙළ සංග්‍රහ ගණන් (VS-035) SLS ට අර්ධ වශයෙන් සහාය දෙයි: අනුක්‍රමය වලංගු නමුත් දුර්ලභය, මන්ද ලියන්නන් ඒ වෙනුවට ෘ/ෲ (කෲර) හෝ වැරදි ලෙස ැ/ෑ (ක්‍රෑර) භාවිත කරන බැවිනි. ෘ/ෲ සහ රකාරාංශය + ු/ූ දෙකම වලංගු ලෙස සලකන්න; සුපුරුදු රූපය ෘ/ෲ වේ.
  2. ලකුණක් තනිව පෙන්වීම. සම්මුති තුනක් ගැටේ:
    • SLS 1134 කෙටුම්පත: ZWNJ + ලකුණ;
    • SLSI WG 2004: හිස්තැන + ලකුණ, කොකු රූපය සඳහා NBSP + pāpilla;
    • Microsoft: වාර්තා වන පරිදි හිස්තැන + ZWJ (SLSI සටහනට අනුව). මෙය අදාළ වන්නේ ලකුණක් තනිව පෙන්වන ලේඛන, අකුරු වගු සහ ඉගැන්වීම් ද්‍රව්‍ය සඳහා පමණි.
  3. ගයනුකිත්ත ෟ. SLS වගුව 1 එය au ඉර ලෙස සලකන අතර තනි ස්වරයක් ලෙස භාවිත නොකරයි. LGR එය බැහැර කරයි ("usage unknown"). යුනිකේතය එය ස්වර l ලකුණ ලෙස නම් කරයි. එකඟතාව: නූතන සිංහලයේ එය තනිව නොයොදන්න.
  4. ෲ භාවිතය. SLS අනුව ෲ "is used" (PDF හි එහි උදාහරණය විකෘති වී ඇත; සමහර විට කර්තෲ). LGR ෲ ඇතුළත් කරන නමුත් ඎ බැහැර කරයි. පොදු භාවිතයේ අක්ෂර වින්‍යාසය කර්තෘ (ෘ සමඟ) වේ: NLPC හි කර්තෘ ටෝකන 2,938ක් ඇති අතර කර්තෲ ඇත්තේ 15ක් (දුර්ලභ) පමණි.
  5. කොටස් දෙකේ ai/o/au සන්දර්භ රූප. යුනිකේත පරිච්ඡේදය 13 හි ස්වයංක්‍රීය සාරාංශයක් ga, nya, ttha, nna, tha, dha සහ sha ට පසු මෙම ලකුණුවලට විශේෂ කොටස් දෙකේ රූප ඇති බව කියා සිටියේය. එම පෙළ මෙහි උපුටා ගත් §13.2 හි නැත. එබැවින් එය ද්විතීයික සාරාංශයක දෝෂයක් ලෙස ප්‍රතික්ෂේප කරන ලදී. කිසිවෙකු එය නැවත ඇතුළත් නොකරන ලෙස මෙහි සටහන් කර ඇත.
  6. හල් ලකුණු හැඩ පන්ති (VS-017). යුනිකේතය ච උදාහරණයට ගනී, SLS ට උදාහරණයට ගනී. සම්පූර්ණ කට්ටලය අකුරු මුහුණත මත රඳා පවතින අතර කිසිදු ප්‍රමිතිගත මූලාශ්‍රයක හමු නොවීය.
  7. ඳ හි වලිගය නැති වීම (VS-015). දුටුවේ Nirmala UI තුළ පමණි; යුනිකේතය "bases similar to ද" යැයි පවසන නමුත් ඒවා ලැයිස්තුගත නොකරයි.
  8. වලංගුතා වගුව (§8) පෙළ සංග්‍රහ මිනුමක් නොව සංශ්ලේෂණයකි. මහාප්‍රාණ, සඤ්ඤක + දිග ස්වර, ළ + දිග ස්වර, සහ ඤ/ඥ/ඦ සඳහා L/R/N බෙදීම සිංහල පෙළ සංග්‍රහයකින් තහවුරු කළ යුතුය. යෝජනාව: UCSC වචන මිලියන 10 පෙළ සංග්‍රහය හෝ විකිපීඩියා දත්ත ගොනුවක් භාවිත කර C+ලකුණ යුගල ගණන් කිරීම.
  9. වචනය මැද ස්වතන්ත්‍ර ස්වර (VS-029). SLS අනුව ස්වර යෙදෙන්නේ වචන මුලදී පමණි. සැබෑ පෙළෙහි කෙටි යෙදුම් (ඩී එන් ඒ) සහ සන්ධි නොකළ සමාස කිහිපයක් ඇත. මෙය කොතරම් පුළුල්ද යන්න කිසිදු මූලාශ්‍රයක හමු නොවීය.
  10. පිලිවල සාම්ප්‍රදායික නම් (VS-001) NIE ව්‍යාකරණ පෙළපොතක් සමඟ පරීක්ෂා කළේ නැත. සිංහල අකුරු සෙවුම් සඳහා සෙවුම් යන්ත්‍ර ප්‍රයෝජනවත් කිසිවක් ලබා දුන්නේ නැත. educationpublications.gov.lk හි 6–9 ශ්‍රේණි සිංහල භාෂාව පෙළපොත් අතින් පරීක්ෂා කිරීම නිර්දේශ කෙරේ.
  11. S1 වගුවේ දෝෂය. යුනිකේත HTML පිටපතේ Table 13-5 හි රු/ළු පේළිවල ◌ු ට පසු ZWJ එකක් පෙනේ. මෙය HTML දෝෂයක් යැයි උපකල්පනය කෙරේ; SLS කේතනයේ (ර U+0DBB + U+0DD4) ZWJ එකක් නැත.
  12. ඔ + ් සහ ඕ. මෙම යුගලය යුනිකේත Table 13-2 හි සහ DoNotEmit හි නැත. HarfBuzz ද එය සලකුණු නොකරයි. එසේ වුවද නිවැරදිව සැකසූ පෙළෙහි එය කිසි විට නොතිබිය යුතුය.
  13. ඉවත් කළ නීති: VS-034 විෂය පථයෙන් පිටත බැවින් ඉවත් කරන ලදී.

පෙළ සහ කේතය MIT බලපත්‍රය යටතේ නිකුත් කර ඇත. උපුටා දක්වන්න: doi:10.5281/zenodo.23244126.