02: ස්වර ලකුණු (පිලි) සහ ස්වර එකතු වීම
විෂය පථය: සිංහලයේ සියලු පරායත්ත ස්වර ලකුණු (U+0DCF–U+0DDF, U+0DF2, U+0DF3) සහ හල් ලකුණ (al-lakuna, U+0DCA). ඒවා ව්යඤ්ජනවලට එකතු වන ආකාරය, භාවිතයේ ඇති ව්යඤ්ජන + ලකුණු යුගල, ස්වතන්ත්ර සහ පරායත්ත ස්වර භාවිතය, ස්වර දෙකක් එක ළඟ යෙදීම (hiatus) සහ අර්ධ ස්වර, ස්වර දිග, සහ ලියන අනුපිළිවෙළ, ගබඩා කරන අනුපිළිවෙළ සහ දර්ශනය කිරීම අතර සම්බන්ධය මෙහි සාකච්ඡා වේ.
සම්පාදනය කළේ 2026 ඔක්තෝබර්.
සියලු පෙළ මූලාශ්රවල අදහස් අපේ වචනවලින් ලියා ඇත. සෑම නීතියකටම විශ්වාස මට්ටමක් ඇත. විමසූ කිසිදු මූලාශ්රයකින් තහවුරු නොවන ප්රකාශ [විසඳා නැත] ලෙස සලකුණු කර §10 හි ලැයිස්තුගත කර ඇත. "(NLPC 829)" වැනි සංඛ්යා NLPC වචන මිලියන 2.1 ලැයිස්තුවේ (S17) ටෝකන ගණන්ය; "දුර්ලභ" යනු ටෝකන 20 ට අඩු බවයි. "මෙහි කළ පරීක්ෂණය" (local test) යනු සම්පාදකයා තම පරිගණකයේ හැසිරීම පරීක්ෂා කළ බවයි: Python unicodedata (UCD 16.0), uharfbuzz 0.56.2 හරහා HarfBuzz සහ Windows Nirmala UI අකුරු මුහුණත, සහ ව්යඤ්ජන 41 × ලකුණු සියල්ල Chromium තුළ දර්ශනය කිරීම. දෙවන පරීක්ෂණයක් (2026 ඔක්තෝබර්) රකාරාංශය + u/uu අකුරු මුහුණත් හතක දර්ශනය කළේය: Noto Sans Sinhala, Noto Serif Sinhala, Abhaya Libre, Yaldevi, Gemunu Libre, Nirmala UI සහ Iskoola Pota.
0. මූලාශ්ර
| ID | මූලාශ්රය | URL |
|---|---|---|
| S1 | Unicode Standard 18.0, පරිච්ඡේදය 13, §13.2 Sinhala | http://www.unicode.org/versions/Unicode18.0.0/core-spec/chapter-13/ |
| S2 | යුනිකේත කේත සටහන U+0D80–0DFF (නාම, අන්වර්ථ නාම, ≡ වියෝජන, කොටස පිළිබඳ සටහන්) | https://www.unicode.org/charts/PDF/U0D80.pdf |
| S3 | UCD IndicPositionalCategory.txt / IndicSyllabicCategory.txt | https://www.unicode.org/Public/UCD/latest/ucd/IndicPositionalCategory.txt , https://www.unicode.org/Public/UCD/latest/ucd/IndicSyllabicCategory.txt |
| S4 | UCD DoNotEmit.txt (සිංහල ස්වර අකුරු ඇතුළත් කිරීම්) | https://www.unicode.org/Public/UCD/latest/ucd/DoNotEmit.txt |
| S5 | SLS 1134:2004 කෙටුම්පත (2 වන සංශෝධනය), ශ්රී ලංකා ප්රමිති ආයතනය, ICTA දායකත්වය සහිතව | https://sinhala.sourceforge.net/archive/akuru.org/att-0028/sls1134.pdf (WG2 N2737 ලෙසද) |
| S6 | SLSI කාර්ය කණ්ඩායම් තීරණ 2004-06-09 (යුනිකේත ලේඛනය L2/04-231) | https://www.unicode.org/L2/L2004/04231-sinhala-rep.pdf |
| S7 | Microsoft, Creating and Supporting OpenType Fonts for Sinhala Script | https://learn.microsoft.com/en-us/typography/script-development/sinhala |
| S8 | HarfBuzz hb-ot-shaper-vowel-constraints.cc (සිංහල කොටස) | https://github.com/harfbuzz/harfbuzz/blob/main/src/hb-ot-shaper-vowel-constraints.cc |
| S9 | Sinhala Generation Panel, Proposal for a Sinhala Script Root Zone LGR v3.0 (2019, ICANN). මණ්ඩලයේ මහාචාර්ය J.B. Dissanayake ද සිටී | https://www.icann.org/en/system/files/files/proposal-sinhala-lgr-22apr19-en.pdf |
| S10 | H. Jayasuriya (UCSC LTRL), Sinhala Orthography: Ola Leaf to the Computer (2007) | https://ftp3.gwdg.de/pub/gnu/www/savannah-checkouts/non-gnu/sinhala/doc/presentations/sinhala-orthography-hj-20070212.pdf |
| S11 | A. Wasala & K. Gamage (UCSC), Research Report on Phonetics and Phonology of Sinhala | http://www.columbia.edu/~kf2119/SPLTE1014/Day 3 slides and readings/SinhalaPhoneticsandPhonology.pdf |
| S12 | M. Żygis, Typology of Consonantal Insertions, ZAS Papers in Linguistics 52 (2010), සිංහල ගැන Smith (2001:63) උපුටා දක්වයි | https://d-nb.info/1096751291/34 |
| S13 | සිංහල විකිපීඩියා, සන්ධි (ආගම සන්ධි ඇතුළු සන්ධි වර්ග): හැඳින්වීම පමණි | https://si.wikipedia.org/wiki/සන්ධි |
| S14 | ඉංග්රීසි විකිපීඩියා, Sinhala script: හැඳින්වීම පමණි (Gair & Paolillo 1997, Fairbanks/Gair/Silva 1968 උපුටා දක්වයි) | https://en.wikipedia.org/wiki/Sinhala_script |
| S15 | Liyanapathirana, Gunasinghe, Dias, SinSpell (2021) | https://arxiv.org/abs/2107.02983 |
| S16 | මෙහි කළ පරීක්ෂණය (ලේඛනයේ ආරම්භය බලන්න) | - |
| S17 | University of Moratuwa NLPC, Word Frequency List for Sinhala: වචන මිලියන 2.1 ලැයිස්තුව (word_frequency_list_2M) | https://github.com/nlpcuom/Word-Frequency-List-for-Sinhala |
| S18 | සිංහල විකිපීඩියා, 2026-10-01 pages-articles ඩම්පයේ ලිපි (tools/corpus_counts.py) | https://dumps.wikimedia.org/siwiki/20261001/ |
හිඩැස: වෙබ් සෙවුමෙන් NIE / educationpublications.gov.lk ව්යාකරණ පෙළපොතක් සොයාගත නොහැකි විය. එබැවින් පහත දැක්වෙන පිලිවල සාම්ප්රදායික සිංහල නම් S2/S5 වලින් ගත් ඒවාය (යුනිකේත නාම සාම්ප්රදායික සිංහල නම් අනුගමනය කරයි). ඒවා සිංහල ව්යාකරණ පෙළපොතකින් තහවුරු කර නැති බැවින් ඒවායේ විශ්වාස මට්ටම අඩු කර ඇත (§10, අයිතමය 10).
1. ප්රවේශම් විය යුතු කරුණු
- කොම්බු දෙකට (ෛ U+0DDB) වියෝජනයක් නැත. ෙ+ෙ යනු පෙනුමින් බොහෝ දුරට සමාන වෙනත් අනුක්රමයකි. NFC කිසි විට ෙෙ, ෛ බවට පත් නොකරයි. එබැවින් "කොම්බුව දෙවරක්" ලෙස ලියූ පෙළ, එය නිපදවන හෝ පිරිසිදු කරන ක්රමය පැහැදිලිවම U+0DDB බවට හැරවිය යුතුය (VS-004).
- ෝ හි කොටස්වල අනුපිළිවෙළ වැදගත්ය. ෙ + ා + ් සාමාන්යකරණයේදී ෝ බවට පත් වේ. නමුත් ෙ + ් + ා, ේ + ා බවට පත් වේ. එය එකම ලෙස දර්ශනය විය හැකි වුවද ෝ ට සමාන නොවේ (VS-005).
- කොම්බුව ලියන්නේත් පෙන්වන්නේත් මුලින්ම වුවද, ගබඩා කරන්නේ ව්යඤ්ජනයට පසුවය. තාර්කික අනුපිළිවෙළ සැමවිටම ව්යඤ්ජනය (හෝ සම්පූර්ණ පොකුර) සහ ඉන්පසු ලකුණයි (VS-002, VS-018).
- ස්වතන්ත්ර ස්වරයක් + ලකුණක් කිසි විට නිවැරදි නොවේ. බොහෝ හැඩගැන්වීමේ එන්ජින් (shapers) ඒ ගැන අනතුරු අඟවන්නේ නැත. HarfBuzz තිත් කවයක් (dotted circle) පෙන්වන්නේ එක සමාන පෙනෙන යුගල 9 සඳහා පමණි (අ+ා ආදිය). ඉ+ී හෝ ඔ+ා වැනි යුගල කිසිදු සලකුණක් නැතිව අර්ථ විරහිත ලෙස දර්ශනය වේ. එබැවින් වලංගුතාව පරීක්ෂා කිරීමට දර්ශනය මත විශ්වාසය තැබිය නොහැක (VS-006, VS-007).
- ර + u සහ ර + ae එක සමාන පෙනේ. රු (ra+u) හි දකුණට කොක්කක් ඇත. රැ (ra+ae) වෙනම අක්ෂර රූපයකි. ක්රු (k.ru), ක්රැ (k.rae) ලෙස ගබඩා නොකළ යුතුය (VS-012, VS-016).
- "ru" ට කියවීම් තුනක් ඇත: රු (ra+u), ෘ (ස්වර r, /ru/ ලෙස උච්චාරණය වේ), සහ ්රු (රකාරාංශය+u). උදාහරණයක් ලෙස ගෘහ (gṛha, නිවස) සහ ග්රහ (graha, ග්රහලෝකය) වෙනස් වචන දෙකකි (VS-020, VS-033).
- ai / au සාමාන්යයෙන් ෛ / ෞ නොවේ. දේශීය වචනවල සහ ඉංග්රීසි ණය වචනවල ලියන්නේ අයි / අවු ය (ලයිට්, කවුද). ෛ/ෞ යෙදෙන්නේ සංස්කෘත මූලයක් ඇති වචනවල පමණි (සෛලය, පෞද්ගලික) (VS-022).
- ඞ කිසි විට ස්වර ලකුණක් නොගනී. සමකාලීන ලේඛනයේ එය යෙදෙන්නේ ඞ් ලෙස පමණි (VS-023). සඤ්ඤක අකුරු (ඟ ඬ ඳ ඹ ඦ) කිසි විට හල් ලකුණ නොගනී (VS-025).
- ෟ (U+0DDF) සහ ෳ (U+0DF3) තනිව ප්රායෝගිකව භාවිත නොවේ. ෟ ඉතිරිව ඇත්තේ ෞ හි දෙවන කොටස ලෙස පමණි (VS-021).
2. ලකුණු ලැයිස්තුව
VS-001: පරායත්ත ලකුණු සමූහය
ප්රකාශය. සිංහලයේ පරායත්ත ස්වර ලකුණු 17ක් සහ හල් ලකුණ ඇත. U+0DD5 සහ U+0DD7 කිසිවකට පවරා නැත. දත්ත S2 වලින්ද, පිහිටීම් S3 (IndicPositionalCategory) වලින්ද, වියෝජන S2/UCD වලින්ද ගෙන මෙහිදී පරීක්ෂා කර ඇත (S16).
| කේතය | ලකුණ | යුනිකේත නාමය (S2) | සාම්ප්රදායික නම (සිංහල) | ස්වරය (අකුරු හැඳුනුම) | පිහිටීම (S3) | කැනොනිකල් වියෝජනය | සාමාන්ය වර්ගය |
|---|---|---|---|---|---|---|---|
| U+0DCA | ◌් | AL-LAKUNA (= virama) | හල් කිරීම / හල් ලකුණ | hal (ආවේණික a ඉවත් කරයි) | Top | - (ccc = 9) | Mn |
| U+0DCF | ◌ා | AELA-PILLA | ඇලපිල්ල | aa | Right | - | Mc |
| U+0DD0 | ◌ැ | KETTI AEDA-PILLA | ඇදපිල්ල | ae | Right | - | Mc |
| U+0DD1 | ◌ෑ | DIGA AEDA-PILLA | දිග ඇදපිල්ල | aee | Right | - | Mc |
| U+0DD2 | ◌ි | KETTI IS-PILLA | ඉස්පිල්ල | i | Top | - | Mn |
| U+0DD3 | ◌ී | DIGA IS-PILLA | දිග ඉස්පිල්ල | ii | Top | - | Mn |
| U+0DD4 | ◌ු | KETTI PAA-PILLA | පාපිල්ල | u | Bottom | - | Mn |
| U+0DD6 | ◌ූ | DIGA PAA-PILLA | දිග පාපිල්ල | uu | Bottom | - | Mn |
| U+0DD8 | ◌ෘ | GAETTA-PILLA | ගැටපිල්ල | ru (ස්වර r) | Right | - | Mc |
| U+0DF2 | ◌ෲ | DIGA GAETTA-PILLA | දිග ගැටපිල්ල | ruu (ස්වර rr) | Right | - | Mc |
| U+0DDF | ◌ෟ | GAYANUKITTA | ගයනුකිත්ත | ilu (ස්වර l) | Right | - | Mc |
| U+0DF3 | ◌ෳ | DIGA GAYANUKITTA | දිග ගයනුකිත්ත | iluu (ස්වර ll) | Right | - | Mc |
| U+0DD9 | ෙ◌ | KOMBUVA | කොම්බුව | e | Left (පාදයට පෙර) | - | Mc |
| U+0DDA | ෙ◌් | DIGA KOMBUVA | කොම්බුව සහ හල් කිරීම | ee | Top_And_Left | ≡ 0DD9 0DCA | Mc |
| U+0DDB | ෛ◌ | KOMBU DEKA | කොම්බු දෙක | ai | Left (පාදයට පෙර) | නැත | Mc |
| U+0DDC | ෙ◌ා | KOMBUVA HAA AELA-PILLA | කොම්බුව සහ ඇලපිල්ල | o | Left_And_Right (දෙකට බෙදුණු) | ≡ 0DD9 0DCF | Mc |
| U+0DDD | ෙ◌ෝ | KOMBUVA HAA DIGA AELA-PILLA | කොම්බුව, ඇලපිල්ල සහ හල් කිරීම | oo | Top_And_Left_And_Right | ≡ 0DDC 0DCA (සම්පූර්ණ NFD: 0DD9 0DCF 0DCA) | Mc |
| U+0DDE | ෙ◌ෟ | KOMBUVA HAA GAYANUKITTA | කොම්බුව සහ ගයනුකිත්ත | au | Left_And_Right (දෙකට බෙදුණු) | ≡ 0DD9 0DDF | Mc |
- ව්යතිරේක. නැත. නාමවල "diga" යනු දිග, "ketti" යනු කෙටි බව සලකන්න. කෙටි a (ආවේණික ස්වරය) සඳහා ලකුණක් නැත.
- අදාළ වන්නේ: සියලු ව්යඤ්ජනවලට (වලංගුතාව §8 හි ඇත).
- විශ්වාසය: ඉහළ. සිංහල අකුරෙන් ලියූ සාම්ප්රදායික නම් සඳහා මධ්යම (පාසල් පෙළපොතකින් තහවුරු කර නැත; §10, අයිතමය 10).
- මූලාශ්ර: S2, S3, S5 (වගුව 1 සහ වගුව 4), S16.
VS-002: පිහිටීම්, දෙකට බෙදුණු ලකුණු සහ නැවත පෙළගැස්වීම
ප්රකාශය. ලකුණු පිහිටීම අනුව පන්ති පහකට වැටේ. ා ැ ෑ ෘ ෲ ෟ ෳ දකුණු පසින් සිටී. ි ී ් ඉහළින් සිටී. ු ූ පහළින් සිටී. ෙ ෛ වම් පසින් (පාදයට පෙර) සිටී. ො ෝ ේ ෞ දෙකට බෙදී ඇත: වම් පස කොම්බුවක් සහ දකුණු හෝ ඉහළ කොටසක් ඇත. ගබඩාවේදී සෑම ලකුණක්ම එය වෙනස් කරන ව්යඤ්ජනයට හෝ පොකුරට පසුව පැමිණේ. හැඩගැන්වීමේ එන්ජිම පාදයට පෙර කොටස සම්පූර්ණ පොකුරේ ඉදිරියට ගෙන යයි. Microsoft පිරිවිතරයට අනුව එන්ජිම ේ ො ෝ ෞ සඳහා ෙ අක්ෂර රූපයක් ඇතුළු කර එය පොකුරේ ආරම්භයට ගෙන යයි. ඉන්පසු දෙවන කොටස හසුරුවන්නේ අකුරු මුහුණතේ pstf විශේෂාංගයයි.
- උදාහරණ: කො = ක + ො (U+0D9A U+0DDC), ෙ-ක-ා ලෙස දර්ශනය වේ. ක්රෙ = ක ් ZWJ ර ෙ, මෙහි කොම්බුව ක ට පෙර දර්ශනය වේ.
- ව්යතිරේක: කේතනයේ නැත. දර්ශන අනුපිළිවෙළ තාර්කික අනුපිළිවෙළෙන් වෙනස් වන්නේ කොම්බු කොටස් සඳහා පමණි.
- අදාළ වන්නේ: e, ee, ai, o, oo, au.
- විශ්වාසය: ඉහළ.
- මූලාශ්ර: S2 (කොටස් දෙකේ ලකුණු "follow the consonant in logical order"), S3, S7 ("Processing split matras" සහ "Reordering").
3. වියෝජනය සහ සාමාන්යකරණය
VS-003: කැනොනිකල් සමානතා සහ NFC
ප්රකාශය. ලකුණු හතරකට කැනොනිකල් වියෝජන ඇත: ේ ≡ ෙ+්, ො ≡ ෙ+ා, ෝ ≡ ො+් (එනම් ෙ+ා+්), සහ ෞ ≡ ෙ+ෟ. මින් එකක්වත් සංයෝජනයෙන් බැහැර කළ ඒවා (composition exclusion) නොවේ. එබැවින් NFC මෙම අනුක්රම නැවත තනි කේත ලක්ෂ්යයකට සංයෝජනය කරයි. මෙහි කළ පරීක්ෂණය (UCD 16.0): ක ෙ ා → NFC ක ො, ක ෙ ් → ක ේ, ක ෙ ෟ → ක ෞ, ක ො ් → ක ෝ.
- පෙළ සැකසීමේ නීතිය: සැමවිටම පූර්ව සංයුක්ත ලකුණ ගබඩා කරන්න (SLS 1134 §5.4 සටහන 2 ලකුණු කිහිපයකින් ලිවීම නිර්දේශ නොකරයි). පෙළ සංසන්දනය කිරීමට පෙර NFC වලට සාමාන්යකරණය කරන්න.
- ව්යතිරේක: VS-004 සහ VS-005 බලන්න.
- අදාළ වන්නේ: ee, o, oo, au.
- විශ්වාසය: ඉහළ.
- මූලාශ්ර: S2, S5 §5.4, S16.
VS-004: කොම්බු දෙක බෙදිය නොහැකි ඒකකයකි
ප්රකාශය. ෛ U+0DDB ට වියෝජනයක් නැත. ෙ+ෙ අනුක්රමය එයට සමාන නොවේ. Nirmala UI සමඟ HarfBuzz තුළ ක+ෙ+ෙ වෙනම කොම්බු අක්ෂර රූප දෙකක් ලබා දෙයි (gid 3858 දෙවරක්). ක+ෛ ඊට වෙනස් කොම්බු දෙක අක්ෂර රූපයක් ලබා දෙයි (gid 3860). කිසිදු අවස්ථාවක තිත් කවයක් නොපෙන්වන නිසා දෝෂය නොදැනී යයි. SLS 1134 ai විස්තර කරන්නේ කොම්බුව + කොම්බුව + ව්යඤ්ජනය ලෙස ලියන බවයි. නමුත් ගබඩා කරන රූපය U+0DDB විය යුතුය.
- උදාහරණ: කෛ = U+0D9A U+0DDB. වැරදි: U+0D9A U+0DD9 U+0DD9.
- අදාළ වන්නේ: ai.
- විශ්වාසය: ඉහළ.
- මූලාශ්ර: S2, S5 §6.2 ("ai modifier"), S10 (කොම්බු අනුපිළිවෙළ පිළිබඳ සටහන), S16.
VS-005: ෝ / ේ තුළ ලකුණුවල අනුපිළිවෙළ
ප්රකාශය. ෝ කැනොනිකල් ලෙස ෙ ා ් වලට වියෝජනය වේ. හල් ලකුණේ ccc = 9 වන අතර ස්වර ලකුණුවල ccc = 0 වේ. එබැවින් සාමාන්යකරණය කිසි විට ඒවා නැවත පෙළගස්වන්නේ නැත. ඒ නිසා ෙ ් ා අනුක්රමය ේ + ා ලෙස සංයෝජනය වේ. එය ෝ ගෙන් වෙනස් අනුක්රමයකි. මෙහි කළ පරීක්ෂණය: ක ෙ ් ා → NFC ක ේ ා (U+0DDA U+0DCF), U+0DDD නොවේ.
- අදාළ වන්නේ: oo, ee.
- විශ්වාසය: ඉහළ.
- මූලාශ්ර: S2, S16.
VS-006: ස්වතන්ත්ර ස්වර බෙදිය නොහැකි ඒකක වේ; කිසි විට ඒවා අකුරක් + ලකුණකින් නොසාදන්න
ප්රකාශය. ස්වර අකුරු නවයක් මූලික ස්වරයක් + ලකුණක් මෙන් පෙනේ. නමුත් ඒවා තනි කේත ලක්ෂ්ය ලෙස කේතනය කළ යුතුය. යුනිකේතයේ Table 13-2 සහ DoNotEmit.txt ඒවා ලැයිස්තුගත කරයි:
| භාවිත කරන්න | භාවිත නොකරන්න |
|---|---|
| ආ U+0D86 | අ + ා |
| ඇ U+0D87 | අ + ැ |
| ඈ U+0D88 | අ + ෑ |
| ඌ U+0D8C | උ + ෟ |
| ඎ U+0D8E | ඍ + ෘ |
| ඐ U+0D90 | ඏ + ෟ |
| ඒ U+0D92 | එ + ් |
| ඓ U+0D93 | එ + ෙ |
| ඖ U+0D96 | ඔ + ෟ |
HarfBuzz තිත් කවයක් යොදන්නේ හරියටම මෙම අනුක්රමවලට පමණි.
- සටහන. ඕ (U+0D95) ලැයිස්තුවේ නැත. SLS ඕ විස්තර කරන්නේ ඔ + ් ලෙස ලියන බවයි. මෙහි කළ පරීක්ෂණය: ඔ + ් තිත් කවයක් නැතිව හැඩගැන්වේ. එබැවින් පරිවර්තක සහ වලංගුතා පරීක්ෂක එය තමන් විසින්ම හඳුනා ගත යුතුය.
- අදාළ වන්නේ: a aa ae aee u uu ru ruu ilu iluu e ee ai o oo au.
- විශ්වාසය: ඉහළ.
- මූලාශ්ර: S1 Table 13-2, S4, S5 §5.1 සහ §6.2, S8, S16.
4. අවලංගු සහ වැරදි ලෙස සැකසූ අනුක්රම
VS-007: ස්වතන්ත්ර ස්වරයකට පසු ස්වර ලකුණක් නොයෙදේ
ප්රකාශය. පරායත්ත ලකුණක් හෝ හල් ලකුණ ව්යඤ්ජනයකට (හෝ සඤ්ඤක අකුරකට) පසුව පැමිණිය යුතුය. LGR හි සම්පූර්ණ ලේබල නීති අනුව ලකුණකට "must be preceded by C or J", සහ H ට පෙර C තිබිය යුතුය. ස්වර ලකුණු ව්යඤ්ජනයකට පසුව එන බව SLS 1134 ද පවසයි. HarfBuzz සලකුණු කරන්නේ VS-006 හි එක සමාන පෙනෙන ඒවා පමණි. මෙහි කළ පරීක්ෂණය: ඉ+ී, ඔ+ා, එ+ැ සහ අ+ි සියල්ල තිත් කවයක් නැතිව දර්ශනය වේ. මේවා හඳුනා නොගැනෙන අර්ථ විරහිත පෙළකි.
- උදාහරණ: වැරදි: ඉී. නිවැරදි: ඊ.
- අදාළ වන්නේ: සියලු ලකුණුවලට; සියලු ස්වතන්ත්ර ස්වරවලට.
- විශ්වාසය: ඉහළ.
- මූලාශ්ර: S5 §4, S9 §7 නීති 1–2, S8, S16.
VS-008: පාදයක් නැති ලකුණක්
ප්රකාශය. පාදයක් (base) නැති ලකුණක් පෙළෙහි අවලංගුය. හැඩගැන්වීමේ එන්ජින් එය තිත් කවයක් (U+25CC) මත පෙන්වයි. ලකුණක් හිතාමතාම තනිව පෙන්වීම සම්බන්ධයෙන් මූලාශ්ර එකඟ නොවේ:
- SLS 1134 කෙටුම්පත: ZWNJ + ලකුණ.
- SLSI WG 2004: හිස්තැන + ලකුණ (අමතර හිස්තැනක් නැතිව), සහ කොකු රූපය පෙන්වීමට NBSP + pāpilla.
- Microsoft: වාර්තා වන පරිදි හිස්තැනකට පසු ZWJ.
මෙහි කළ පරීක්ෂණය: තනි ා හෝ ZWNJ + ා HarfBuzz තුළ තිත් කවයක් ලබා ගනී.
- අදාළ වන්නේ: සියලු ලකුණුවලට.
- විශ්වාසය: "අවලංගු" යන්නට ඉහළ. දර්ශන සම්මුතිය විවාදාත්මකය (§10 බලන්න).
- මූලාශ්ර: S5 §5.4, S6 අයිතමය 1, S7 ("Handling invalid combining marks"), S16.
VS-009: හල් ලකුණට පසු ZWJ, ව්යඤ්ජනයක් හෝ අවසානයක් හැර වෙනත් කිසිවක් නොයෙදේ
ප්රකාශය. හල් ලකුණ ස්වරය ඉවත් කරයි. ඊට පසු ස්වර ලකුණක් යෙදීම පරස්පර විරෝධීය. මෙහි කළ පරීක්ෂණය: ක + ් + ා → ා ට පෙර තිත් කවයක්. ක + ් + ෙ → තිත් කවයක්. ක + ් + ් → තිත් කවයක්. අනුස්වාරය/විසර්ගයද හල් ලකුණට පසු නොයෙදිය යුතුය (LGR අනුව ං ට හල් ලකුණ හැර ඕනෑම ලකුණකට පසු යෙදිය හැක).
- අදාළ වන්නේ: hal.
- විශ්වාසය: ඉහළ.
- මූලාශ්ර: S9 §3.3.4 සහ §7, S16.
VS-010: එක් අක්ෂරයකට එක් ස්වර ලකුණක්
ප්රකාශය. ව්යඤ්ජනයක් ගන්නේ උපරිම වශයෙන් එක් ස්වර ලකුණකි. SLS 1134 ව්යඤ්ජනයකට හරියටම ස්වර රූප 17ක් ගණන් කරයි (හිස් ව්යඤ්ජනය + හල් + ස්වර ලකුණු 16, ෟ ෳ හැර) සහ ලකුණු කිහිපයකින් ලිවීම නිර්දේශ නොකරයි. හැඩගැන්වීමේ එන්ජින් මේ ගැන ලිහිල්ය. මෙහි කළ පරීක්ෂණය: කාා, කිි සහ කුු HarfBuzz තුළ තිත් කවයක් නොලබයි. ක්රියාත්මක කිරීම් මේ සම්බන්ධයෙන් වෙනස් වන බව Microsoft පිරිවිතරය සඳහන් කරයි. නිවැරදිව සැකසූ පෙළෙහි කිසි විට එක් ව්යඤ්ජනයක ලකුණු දෙකක් නැත.
- ව්යතිරේකය: අනුස්වාරය ං හෝ විසර්ගය ඃ ස්වර ලකුණකට පසුව යෙදිය හැක. එය සැමවිටම පොකුරේ අවසානයේ සිටී (කාං, කෝං).
- විශ්වාසය: ඉහළ.
- මූලාශ්ර: S5 §3.5 සහ §5.5, S7, S9 §5.6.4, S16.
5. ව්යඤ්ජනයට විශේෂිත හැඩ
මේවා අකුරු මුහුණත සහ හැඩගැන්වීමේ එන්ජිම සම්බන්ධ කරුණුය. ඒවා කිසි විට කේතනය වෙනස් නොකරයි. පෙළ සැකසීමට ඒවා වැදගත් වන්නේ, ලියන්නන් තමන් දකින දේ එක සමාන පෙනෙන කේත ලක්ෂ්යවලින් ලිවීමට උත්සාහ කළ හැකි නිසා පමණි.
VS-011: ර + ae / aee: අක්රමවත් සංයුක්ත රූප
ප්රකාශය. ර + ැ → රැ සහ ර + ෑ → රෑ අක්රමවත් අක්ෂර රූප වේ (Unicode Table 13-5). කේතනය ර U+0DBB + U+0DD0/U+0DD1 ලෙසම පවතී.
- උදාහරණ: රැය (ræya, "රාත්රිය"), රෑ (ræː).
- අදාළ වන්නේ: ra; ae, aee.
- විශ්වාසය: ඉහළ.
- මූලාශ්ර: S1 Table 13-5, S5 §5.4, S7 (
pstsඋදාහරණය), S16.
VS-012: ර + u / uu: අක්රමවත් සංයුක්ත රූප
ප්රකාශය. ර + ු → රු සහ ර + ූ → රූ විශේෂ හැඩ ගනී. මේවායේ u ලකුණ පහළින් නොව, කොක්කක් මෙන් දකුණු පසින් එකතු වේ. රු/රූ සඳහා යොදන ලකුණ සාමාන්යයෙන් æ සඳහා යොදන ලකුණ මෙන් පෙනෙන බවත්, රැ/රෑ වෙනස් විශේෂ හැඩ ගන්නා බවත් විකිපීඩියාව සඳහන් කරයි. SLS 1134 මේ සඳහා වෙනම කේතයක් නොදෙයි: එය ගබඩා කරන්නේ ර + pāpilla ලෙසය.
- උදාහරණ: රුපියල (rupiyala), රූපය (rūpaya).
- අදාළ වන්නේ: ra; u, uu.
- විශ්වාසය: ඉහළ.
- මූලාශ්ර: S1 Table 13-5, S5 §5.4 සහ §6.2, S14, S16.
- සටහන. S1 හි HTML පිටපතේ රු/ළු පේළිවල ◌ු ට පසු අනවශ්ය ZWJ එකක් පෙනේ. මෙය අවශ්ය ZWJ එකක් නොව දර්ශනයේ දෝෂයක් ලෙස සැලකේ; කිසිදු මූලාශ්රයක් මෙය සඳහන් නොකරයි [විසඳා නැත] (§10, අයිතමය 11).
VS-013: ළ + u / uu
ප්රකාශය. ළ + ු → ළු සහ ළ + ූ → ළූ අක්රමවත් අක්ෂර රූප වේ. SLS ළු වෙනම රූපයක් ලෙස ලැයිස්තුගත කරයි. නමුත් එය තවමත් ගබඩා කරන්නේ ළ U+0DC5 + ු U+0DD4 ලෙසය. ළූ, ළු + ෑ මෙන් පෙනිය හැක. නමුත් එය ළ + ූ ලෙස ගබඩා කළ යුතුය.
- උදාහරණ: කළු (kaḷu, "කළු පාට").
- අදාළ වන්නේ: lla; u, uu.
- විශ්වාසය: ඉහළ.
- මූලාශ්ර: S1 Table 13-5, S5 §5.4 සහ §6.1–6.2.
VS-014: u / uu හි "කොකු" රූපය
ප්රකාශය. ක, ග, ඟ, ත, භ සහ ශ මත ු සහ ූ විකල්ප කොකු රූපයක් ගනී (දකුණු පාදයට එකතු වේ). SLS මේවා "ketti/diga paa-pilla 2" ලෙස හඳුන්වයි. ඉරේ හැඩය ව්යඤ්ජනය අනුව වෙනස් වන නමුත් කේතය එලෙසම පවතින බවද එය සඳහන් කරයි. Nirmala UI සමඟ මෙහි කළ පරීක්ෂණය කොකු රූපය හරියටම මෙම හය මත පමණක් ඇති බව තහවුරු කරයි. අනෙක් සියලු ව්යඤ්ජන පාදයට පහළින් සාමාන්ය වළල්ල ගනී.
- උදාහරණ: කුකුළා (kukuḷā), ගුරු (guru), තුන (tuna), භූමිය (bhūmiya), ශුද්ධ (śuddha).
- අදාළ වන්නේ: ka, ga, nnga, ta, bha, sha; u, uu.
- විශ්වාසය: ඉහළ.
- මූලාශ්ර: S1, S5 වගුව 1 (7a, 8a), S14, S16.
VS-015: ද වැනි පාදවල පහළ වලිගය නැති වීම
ප්රකාශය. ද වැනි හැඩයක් ඇති පාදවලට පහළින් ලකුණක් එකතු වූ විට ඒවායේ පහළට යන වලිගය නැති වේ (දු, දූ, සහ ද්ර). මෙහි කළ පරීක්ෂණය: Nirmala UI තුළ ඳු අකුරේත් වලිගය නැති වේ. යුනිකේතය සම්පූර්ණ පන්තිය ලැයිස්තුගත නොකරයි. එබැවින් ඳ පිළිබඳ කරුණ ලේඛනගත නීතියක් නොව අකුරු මුහුණතක නිරීක්ෂණයක් පමණි [විසඳා නැත] (§10, අයිතමය 7).
- උදාහරණ: දුව (duva), අඳුර (an̆dura).
- අදාළ වන්නේ: da, nda (නිරීක්ෂිත); u, uu, රකාරාංශය.
- විශ්වාසය: da සඳහා ඉහළ, nda සඳහා මධ්යම.
- මූලාශ්ර: S1, S16.
VS-016: රකාරාංශ / යංශ පොකුරු මත ස්වර ලකුණු
ප්රකාශය. ක්ර හෝ ක්ය වැනි පොකුරකට පසු ස්වරය අයත් වන්නේ ර හෝ ය ටය. එහි ලකුණ දකුණු කෙළවරේ ඇති කොටසට එකතු වේ. කොම්බුව සම්පූර්ණ පොකුරට පෙර යයි.
රකාරාංශ පොකුරක් මත ු/ූ තවත් හැඩ යුගලයක් ගනී. මේවා ැ/ෑ ලෙස කේතනය නොකළ යුතුය. ැ/ෑ එක සමාන පෙනුණත් තරමක් ඉහළින් සිටී (යුනිකේතයේ පැහැදිලි අනතුරු ඇඟවීම).
SLS 1134 වගුව 3 වලංගු ස්වර ලැයිස්තුගත කරයි:
| පොකුර | වලංගු ස්වර (SLS 1134 වගුව 3) |
|---|---|
| යංශය | a, aa, u, uu, e, ee, o, oo |
| රකාරාංශය | a, aa, ae, aee, i, ii, e, ee, ai, o, oo, au |
අනෙක් සංයෝජන භාවිත නොවුණත් ඒවාටද ඉඩ දිය යුතු බව SLS පවසයි.
- උදාහරණ: ක්රෝධය (krōdhaya), ප්රශ්නය, ත්රි, ව්යාපාරය, ක්රූර (krūra).
- අදාළ වන්නේ: රකාරාංශය/යංශය සහිත සෑම ව්යඤ්ජනයකටම.
- විශ්වාසය: කේතනය සඳහා ඉහළ. රකාරාංශයට පසු ru/ruu ගැන ගැටුමක් ඇත (§10 බලන්න).
- මූලාශ්ර: S1, S5 වගුව 3 සහ §6.3, S7 (
vatu,abvs).
VS-017: හල් ලකුණට හැඩ දෙකක් ඇත
ප්රකාශය. බොහෝ අකුරුවල හල් ලකුණ සුපුරුදු කොඩිය ("kodiya") ලෙස පෙනේ. සමහර අකුරුවල එය දෙවන හැඩයක් ගනී. SLS ට් උදාහරණයට ගනී. යුනිකේතය ච් උදාහරණයට ගනී. මෙහි කළ පරීක්ෂණය (Nirmala UI): ච් ජ් ඦ් ට් සහ ර් වෙනස් ලෙස පෙනේ. නමුත් නිශ්චිත පන්තිය අකුරු මුහුණත මත රඳා පවතී. කෙසේ වෙතත් කේත ලක්ෂ්යය එකක් පමණි (U+0DCA).
- අදාළ වන්නේ: hal.
- විශ්වාසය: කේතය එකම බවට ඉහළ. නිශ්චිත අකුරු ලැයිස්තුවට අඩු.
- මූලාශ්ර: S1, S5 වගුව 1 (1a) සහ §5.4, S16.
VS-018: කොම්බුවේ පිහිටීම
ප්රකාශය. දර්ශනයේදී කොම්බුව (සහ ේ ො ෝ ෞ හි වම් කොටස, සහ ෛ) සම්පූර්ණ අක්ෂර පොකුරට පෙර යයි: ZWJ සංයුක්ත අකුරක, රකාරාංශ/යංශ පොකුරක හෝ ස්පර්ශ අකුරු පොකුරක පළමු ව්යඤ්ජනයට පෙර. ස්වරයේ ඉතිරි කොටස දකුණු කෙළවරේ කොටසට එකතු වේ. ගබඩාවේදී තවමත් මුලින් පොකුර, ඉන්පසු ලකුණයි.
- උදාහරණ: ක්රෝ → ෙ ක්ර ා ් ලෙස දර්ශනය වේ. ද්යෙ.
- ව්යතිරේකය: රේඵය ඊළඟ පාදයට ඉහළින් සිටින අතර කොම්බුවට පෙර එන කොටසට අයත් නොවේ. කොම්බුව එම පාදයට පෙර යයි.
- අදාළ වන්නේ: e, ee, ai, o, oo, au.
- විශ්වාසය: ඉහළ.
- මූලාශ්ර: S7 (පාදයට පෙර කොටස පොකුරේ ආරම්භයට නැවත පෙළගැසේ), S10 ("ensure pre-base dependent vowels precede consonant clusters"), S14.
6. භාවිතයේ ඇති ව්යඤ්ජන + ස්වර සංයෝජන
VS-019: ඇ / ඈ සහ ැ / ෑ සුවිශේෂී ලෙස සිංහලයට අයත්ය
ප්රකාශය. ඉන්දු-ආර්ය අක්ෂර මාලා අතර æ ස්වර ඇත්තේ සිංහලයට පමණි. ඒවා දළ වශයෙන් 7 වන සියවසේ සිට භාවිතයේ ඇත. දේශීය වචනවල සහ ඉංග්රීසි ණය වචනවල ඒවා බහුලය. සංස්කෘත/පාලි ණය වචනවල ඒවා නැත. එබැවින් මහාප්රාණ සහ සංස්කෘතයට පමණක් අයත් ව්යඤ්ජන ැ/ෑ ගන්නේ කලාතුරකිනි.
- උදාහරණ: ඇස (æsa), පැන (pæna), කෑම (kǣma), බැංකුව, ෆෑන් (NLPC 829).
- අදාළ වන්නේ: ae, aee.
- විශ්වාසය: සුවිශේෂීත්වයට ඉහළ. "මහාප්රාණ මත දුර්ලභ" යන්නට මධ්යම (අනුමානයකි).
- මූලාශ්ර: S1, S5 §3 සටහන 1, S9.
VS-020: ෘ /ru/ ලෙස උච්චාරණය වේ: සංස්කෘත ṛ, සහ වෙනත් වචනවල C + r + u
ප්රකාශය. ෘ (ගැටපිල්ල) තත්සම (සංස්කෘත) වචනවල යෙදේ. එය ru (හෝ ri) ලෙස උච්චාරණය වේ. මිශ්ර හෝඩියේ ṛ ශුද්ධ සිංහලයේදී උච්චාරණය අනුව r+u ලෙසද ලිවිය හැක. SLS එය සම්මත රූප 17 අතරට ගණන් කරයි. ෘ /ru/ ලෙස කියවන නිසා ලියන්නන් සංස්කෘත නොවන වචනවල සහ ඉංග්රීසි ණය වචනවල ව්යඤ්ජනයකට පසු /ru/ සහ /ruː/ සඳහාද ෘ/ෲ භාවිත කරයි (ගෲප්, ඇන්ඩෲ). C + r + u/uu සඳහා සුපුරුදු අක්ෂර වින්යාසයද එයයි (VS-035).
- භාවිතයේ හමු වූ ව්යඤ්ජන (උදාහරණ, NLPC ටෝකන): කෘෂිකර්මය 941, ගෘහ 5,906, තෘප්තිය 1,103, දෘෂ්ටිය 987, ධෘති (දුර්ලභ: 2), නෘත්ය 106, පෘථිවිය 2,451, බෘහස්පති 26, භෘත්ය (දුර්ලභ: 2), මෘදු 1,616, වෘක්ෂ 350, ශෘංගාර 268, සෘජු 3,302, හෘදය 1,375, ඝෘණා (දුර්ලභ: තනි වචනයක් ලෙස 0, ප්රත්ය සමඟ 26; LGR ඝෘ අනුක්රමයක් ලෙස ලැයිස්තුගත කරයි).
- කිසි විට නැත: ර+ෘ (සංස්කෘතයේ rṛ නැත) [inferred], ළ ඞ ඤ ඥ ඦ, සඤ්ඤක අකුරු, ණ ය ල ෂ [inferred]. ඉංග්රීසි ණය වචනවල ෆ භාවිතයේ හමු වේ (ෆෘට් "පලතුරු", S17).
- අදාළ වන්නේ: ru.
- විශ්වාසය: සංස්කෘත ṛ සඳහා ඉහළ. පුළුල් /ru/ භාවිතය සඳහා ඉහළ (S17, VS-035). ව්යඤ්ජන ලැයිස්තුවට මධ්යම.
- මූලාශ්ර: S5 වගුව 2, S9 වගු 2 සහ 3a, S11, S14, S17.
VS-021: ෲ, ෟ, ෳ, ඎ, ඏ, ඐ ආන්තික වේ
ප්රකාශය.
ඏ සහ ඐ වර්තමාන භාවිතයේ නැත (SLS).
ඎ වර්තමාන භාවිතයේ නැත, නමුත් එහි ලකුණ ෲ භාවිත වේ (SLS).
ෳ (දිග ගයනුකිත්ත) භාවිත නොවේ (SLS).
LGR ෟ සහ ෳ "භාවිතය නොදන්නා" ඒවා ලෙස බැහැර කරයි. එය ඎ ඏ ඐ ද බැහැර කරයි.
ෟ ඉතිරිව ඇත්තේ ෞ හි දෙවන කොටස ලෙසය. SLS ගයනුකිත්ත සලකන්නේ au සාදන ඉර ලෙසය.
උදාහරණ: ෲ මාතෲ (NLPC 65) සහ කර්තෲ (දුර්ලභ: NLPC 15) වැනි සංස්කෘත මූලවල යෙදේ. බොහෝ විට උපුටා දක්වන pitṝ (පිතෲ) NLPC හි තනි වචනයක් ලෙස හමු නොවේ (ප්රත්ය සමඟ ටෝකන 4).
අදාළ වන්නේ: ruu, ilu, iluu.
විශ්වාසය: ඉහළ.
මූලාශ්ර: S5 §3.1 සටහන් 2–3 සහ §3.4 සටහන 4, S9 වගුව 4.
VS-022: ණය වචනවල ෛ / ෞ; දේශීය ai/au සඳහා ය/ව
ප්රකාශය. සන්ධ්යක්ෂර ලකුණු ෛ සහ ෞ මිශ්ර (සංස්කෘත මූලයක් ඇති) කට්ටලයට අයත්ය. ශුද්ධ සිංහල අක්ෂර වින්යාසයේ ai, a + yi ලෙසද au, a + wu ලෙසද ලියයි. කථිත සිංහලයේ සන්ධ්යක්ෂර බොහොමයක් ඇති අතර ඒ සියල්ල ඉහළ ස්වරයකින් අවසන් වේ. ඒවා ලියන්නේ ය/ව ව්යඤ්ජනය සහ ලකුණක් සමඟය.
- උදාහරණ (ෛ): සෛලය, වෛද්ය, දෛනික, ජෛව, මෛත්රී, ඓතිහාසික (ස්වතන්ත්ර).
- උදාහරණ (ෞ): පෞද්ගලික, බෞද්ධ, භෞතික, සෞඛ්යය, ගෞරවය, යෞවන, ලෞකික, ඖෂධ (ස්වතන්ත්ර).
- උදාහරණ (දේශීය / ඉංග්රීසි ණය වචන): අයිය (ayiya), ලයිට් (light), කවුද (kavuda/kauda), මවුස්.
- අදාළ වන්නේ: ai, au.
- විශ්වාසය: මූලධර්මයට ඉහළ. ඉහත සෑම උදාහරණයක්ම NLPC හි හමු වේ (සෛලය ටෝකන 285 සිට වෛද්ය 46,508 දක්වා).
- මූලාශ්ර: S11 (සන්ධ්යක්ෂර ලැයිස්තුව), S14.
VS-023: ඞ ස්වර ලකුණු නොගනී
ප්රකාශය. SLS 1134 අනුව ඞ කිසි විට ස්වරයක් සමඟ එක් නොවන අතර යෙදෙන්නේ ඞ් ලෙස පමණි (සඞ්ඝ හි මෙන්). LGR ඞ නූතන භාවිතයේ නැති බැවින් බැහැර කරයි. නූතන ලේඛනයේ ඞ් වෙනුවට සාමාන්යයෙන් අනුස්වාරය ං යෙදේ.
- අදාළ වන්නේ: nga × සෑම ස්වර ලකුණක්ම (කිසි විට නැත). nga + hal වලංගු නමුත් දුර්ලභය.
- විශ්වාසය: ඉහළ.
- මූලාශ්ර: S5 §3.5 සටහන 1, S9 වගුව 4.
VS-024: ඦ පුරාතනය
ප්රකාශය. සමකාලීන ලේඛනයේ ඦ හමු නොවේ (SLS). LGR අනුව එය යෙදෙන්නේ බල්ලෙකු කැඳවීමට භාවිත කරන එක් වචනයක පමණි. එය මත ඇති සෑම ලකුණක්ම දුර්ලභ ලෙස සලකන්න. එය සමඟ කිසි විට හල් ලකුණ භාවිත නොකරන්න (VS-025).
- අදාළ වන්නේ: nyja.
- විශ්වාසය: ඉහළ.
- මූලාශ්ර: S5 §3.2 සටහන 1, S9 වගුව 4.
VS-025: සඤ්ඤක අකුරු ස්වර ගනී, නමුත් හල් ලකුණ නොගනී
ප්රකාශය. ස්වර ලකුණු සඤ්ඤක ව්යඤ්ජනයකට එකතු වන්නේ සාමාන්ය ස්පර්ශ ව්යඤ්ජනයට එකතු වන ආකාරයටමය (S14). LGR හි සම්පූර්ණ ලේබල නීති සඤ්ඤක + ස්වර ලකුණ සහ සඤ්ඤක + ං ට ඉඩ දෙයි. නමුත් සඤ්ඤක අකුරුවලට පසු හල් ලකුණ යෙදිය නොහැකි බව පවසයි.
- උදාහරණ: කුඹුර (kum̆bura), අඳුර, ගඟ, කඳු, අඹ.
- අදාළ වන්නේ: nnga, nndda, nda, mba, nyja.
- විශ්වාසය: "හල් නැත" යන්නට ඉහළ. එක් එක් ලකුණ කොතරම් වාර ගණනක් යෙදේද යන්නට මධ්යම.
- මූලාශ්ර: S9 §3.3.6 සහ §5.6.5, S14.
VS-026: ඥ සහ ඤ
ප්රකාශය. ඥ (jña) බෙදිය නොහැකි සංයුක්ත අකුරකි. වචනයක මුලදී එය ඤ ලෙසම ශබ්ද වේ. නමුත් වෙනත් තැන්වල එය ව්යඤ්ජන පොකුරකි. දෙකම ස්වර ලකුණු ගනී. ඥා බොහෝ සෙයින්ම බහුලතම රූපයයි.
- උදාහරණ: ඥාතියා, ඥානය, විඥානය, ප්රඥාව, සංඥාව; ඤාණ (පාලි විලාසය).
- අදාළ වන්නේ: jnya, nya.
- විශ්වාසය: සංඛ්යාතය සඳහා මධ්යම.
- මූලාශ්ර: S1, S5 §3.2 සටහන 2.
VS-027: ෆ ණය වචන සඳහා පමණි
ප්රකාශය. ෆ (fa) ඉංග්රීසි සහ වෙනත් ණය වචන සඳහා භාවිත වේ. එය සාමාන්ය ලකුණු (ා ැ ෑ ි ී ු ූ ෙ ේ ො ෝ ්) ගනී, නමුත් ෘ ෲ ෛ ෞ නොගනී.
- උදාහරණ: ෆයිල් (file), ෆෝන් (phone), ෆිල්ම් (film).
- අදාළ වන්නේ: fa.
- විශ්වාසය: මධ්යම (අකුර භාවිත වන කාර්යයෙන් අනුමාන කළ).
- මූලාශ්ර: S2, S5 §3.2.
VS-028: මහාප්රාණ සහ සංස්කෘතයට පමණක් අයත් ව්යඤ්ජන
ප්රකාශය. ඛ ඝ ඡ ඣ ඨ ඪ ථ ධ ඵ භ ශ ෂ (සහ බොහෝ ස්ථානවල ණ) මිශ්ර හෝඩියට අයත්ය. ඒවා ප්රධාන වශයෙන් තත්සම/පාලි ණය වචනවල යෙදේ. එබැවින් ඒවායේ ලකුණු කට්ටලය සංස්කෘත කට්ටලයයි: ැ/ෑ නැත හෝ දුර්ලභය, නමුත් ෘ ෛ ෞ යෙදිය හැක. ඉංග්රීසි ණය වචනවල ශ/ෂ + ැ ද යෙදේ (උදාහරණයක් ලෙස ෂැම්පු, NLPC 218).
- විශ්වාසය: මධ්යම.
- මූලාශ්ර: S14 (මිශ්ර සහ ශුද්ධ හෝඩිය), S5.
7. ස්වතන්ත්ර ස්වරය සහ ලකුණ; ස්වර එක ළඟ යෙදීම සහ අර්ධ ස්වර; දිග
VS-029: ස්වතන්ත්ර ස්වර වචන මුලදී යෙදේ
ප්රකාශය. SLS 1134 අනුව ස්වර 18, ව්යඤ්ජන මෙන් නොව, භාවිත වන්නේ වචනවල මුලදී පමණි. ස්වතන්ත්ර ස්වර වචන අරඹන බවත් පරායත්ත ස්වර ව්යඤ්ජනවලට පසු එන බවත් LGR එකතු කරයි. වචනයක් ඇතුළත ව්යඤ්ජනයකට පසු එන ස්වරයක් සැමවිටම ලකුණකි. වෙනත් ස්වරයකට පසු එන ස්වරයක් විසඳන්නේ අර්ධ ස්වරයකින් (VS-030) හෝ සන්ධියෙන් (VS-031) මිස දෙවන ස්වතන්ත්ර ස්වරයක් ලිවීමෙන් නොවේ.
- ව්යතිරේක [විසඳා නැත]: අකුරෙන් අකුර කියවන කෙටි යෙදුම් සහ අකුරුවල නම් (ඩී එන් ඒ), සන්ධි නොකර ලියන සමහර සමාස සහ ණය උපසර්ග රූප, සහ පාලි පාඨ. §10, අයිතමය 9 බලන්න.
- අදාළ වන්නේ: සියලු ස්වරවලට.
- විශ්වාසය: නීතියට ඉහළ. ව්යතිරේක ලැයිස්තුවට අඩු.
- මූලාශ්ර: S5 §3.1, S9 §3.3.2.
VS-030: ස්වර එක ළඟ යෙදීම ය (ඉදිරි ස්වරවලට පසු) හෝ ව (පසු ස්වරවලට පසු) මඟින් විසඳේ
ප්රකාශය. නාම පදවල මූලය සහ ප්රත්යය හමු වන තැන ස්වර දෙකක් එක ළඟ යෙදුණු විට සිංහලය සැමවිටම අර්ධ ස්වරයක් ඇතුළු කර එය විසඳයි. i හෝ æ ට පසු එය j (ය) වන අතර u හෝ ā ට පසු w (ව) වේ. ක්රියා පදවල ස්වරයක් ඉවත් කිරීමට වැඩි නැඹුරුවක් ඇත. අක්ෂර වින්යාසය උච්චාරණය අනුගමනය කරයි. එබැවින් අර්ධ ස්වරය ලියන්නේ ඊළඟ ස්වරය දරන ය/ව ව්යඤ්ජනය ලෙසය.
| මූලික රූපය | කථනයේ | ලිඛිත | අර්ථය |
|---|---|---|---|
| ræ + a | [ræjə] | රැය | රාත්රිය (නිශ්චිත) |
| toppi + a | [toppijə] | තොප්පිය | තොප්පිය (නිශ්චිත) |
| ašu + a | [ašuwə] | අටුව (NLPC 85) | අට්ටාලය (නිශ්චිත) |
| maaligaa + a | [maaligaawə] | මාලිගාව | මාලිගාව (නිශ්චිත) |
සාමාන්ය අක්ෂර වින්යාස: dia → දිය, dua → දුව, kiyanawa → කියනවා, diyunu → දියුණු (iu → ඉයු), ovun → ඔවුන් (ou → ඔවු), æyi → ඇයි "කුමක් නිසාද" (æi → ඇයි).
- අදාළ වන්නේ: සියලු ස්වර අනුක්රමවලට; ya, va.
- විශ්වාසය: නාම පද සඳහා ඉහළ (භාෂා විද්යාත්මක මූලාශ්රය). පොදු අක්ෂර වින්යාස ප්රකාශය සඳහා මධ්යම.
- මූලාශ්ර: S12 (Smith 2001 උපුටා දක්වයි), S11.
VS-031: සමාසවල ආගම (ඇතුළු කිරීමේ) සන්ධිය
ප්රකාශය. සමාසවල පළමු පදයේ අවසාන ස්වරය සහ දෙවන පදයේ මුල් ස්වරය අතරට ය හෝ ව (හෝ ඉඳහිට ර) ඇතුළු වේ.
- උදාහරණ: නො + එක් → නොයෙක් (ය), කටු + අල → කටුවල (ව), නි + අවුල් → නිරවුල් (ර).
- වෙනත් ස්වර සන්ධි: ඒ වෙනුවට ස්වරය ඉවත් විය හැක, නැතහොත් වෙනත් ස්වරයකින් ආදේශ විය හැක (දන්ත + ආලේප → දන්තාලේප).
- විශ්වාසය: මධ්යම (විකිපීඩියා හැඳින්වීම පමණි; පෙළපොත ලබා ගත නොහැකි විය).
- මූලාශ්ර: S13.
VS-032: ස්වර දිග අර්ථ භේදකය; දිග ස්වරවලට වෙනම ලකුණු ඇත
ප්රකාශය. කෙටි සහ දිග ස්වර වෙනස් ස්වනිම වේ (මුළු ස්වර ස්වනිම 14ක්). සෑම දිග ස්වරයකටම තමන්ගේම ලකුණක් ඇත:
| කෙටි | දිග |
|---|---|
| (ආවේණික) | ා |
| ැ | ෑ |
| ි | ී |
| ු | ූ |
| ෙ | ේ |
| ො | ෝ |
| ෘ | ෲ |
ේ සහ ෝ හි දිග සලකුණ හල් ලකුණේ ඉරයි. ස්වතන්ත්ර අකුරු ඒ සහ ඕ ද එලෙසම ක්රියා කරයි.
- උදාහරණ යුගල (NLPC ටෝකන): බල 30,873 / බාල 8,405 (bala / bāla), සුදු 30,640 / සූදු 1,106 (sudu "සුදු පාට" / sūdu "සූදුව"), මල 12,867 / මාල 1,665.
- විශ්වාසය: ක්රමයට ඉහළ. උදාහරණ යුගලවලට මධ්යම.
- මූලාශ්ර: S2, S5 වගුව 2, S11.
VS-033: පිලි සම්බන්ධ පොදු අක්ෂර වින්යාස දෝෂ
- ස්වර දිග (හ්රස්ව/දීර්ඝ) සිංහල පෙළෙහි බහුලතම දෝෂ වර්ගයයි (S15).
- ෘ සහ ්ර / රු පටලවා ගැනීම (ගෘහ සහ ග්රහ, සැබෑ අර්ථ වෙනසකි).
- ෛ/ෞ සහ ayi/avu. උදාහරණයක් ලෙස වෛද්ය නිවැරදිය. එය අයි සමඟ ලිවීම වැරදිය.
- කේතන දෝෂ: ෛ වෙනුවට ෙ+ෙ; ෝ වෙනුවට ෙ+්+ා; ආ වෙනුවට අ+ා; රකාරාංශ-u රූප වෙනුවට ැ/ෑ ගබඩා කිරීම (S1 අනතුරු ඇඟවීම; ක්රෑර, ශ්රැති, VS-035 බලන්න); එක් ව්යඤ්ජනයක ලකුණු දෙකක්.
- ඥ/ඤ වචන මුලදී මාරු වීම (එහිදී ඒවා එක ලෙස ශබ්ද වේ; S5).
- විශ්වාසය: 1 සහ 4 සඳහා ඉහළ. 2, 3 සහ 5 සඳහා මධ්යම.
- මූලාශ්ර: S15, S1, S4, S5, S16.
VS-035: C + r + u/uu සාමාන්යයෙන් ෘ/ෲ ලෙස ලියයි; විකල්පය රකාරාංශය + ු/ූ ය
ප්රකාශය. /ru/ හෝ /ruː/ ට පෙර එන ව්යඤ්ජනයකට නිවැරදි කේතන දෙකක් ඇත. ෘ /ru/ ලෙස උච්චාරණය වන නිසා දෙකම එකම ලෙස කියවේ (VS-020, 05:G2P-011):
- C + ෘ / ෲ: කෘ, කෲර, මෘදු, ගෲප්. බොහෝ සෙයින් බහුල වන්නේ මෙම අක්ෂර වින්යාසයයි.
- C ් ZWJ ර + ු / ූ (රකාරාංශය + u/uu): ක්රු, ක්රූර. රකාරාංශය + u/uu අක්ෂර රූප පෙන්වීමට S1 භාවිත කරන්නේ මෙම අක්ෂර වින්යාසයයි (VS-016).
තෙවන අක්ෂර වින්යාසයක් රකාරාංශය + u/uu අක්ෂර රූපයේ පෙනුම ැ/ෑ මඟින් අනුකරණය කරයි (ක්රෑර, ශ්රැති, භ්රෑණ). එය බහුල නමුත් වැරදිය: ැ/ෑ ලියන්නේ /æ/ ස්වරයයි. මෙම ආදේශයට එරෙහිව S1 අනතුරු අඟවයි (VS-016, VS-033).
සාක්ෂි (S17). ලැයිස්තුවේ C + ෘ/ෲ සමඟ ලියූ සෑම වචනයක් සඳහාම, එම වචනයම රකාරාංශය + ු/ූ සමඟද රකාරාංශය + ැ/ෑ සමඟද සොයා බැලිණි. අක්ෂර වින්යාස දෙකක් හෝ වැඩි ගණනක් හමු වන තැන්වල, වචන 155ක ෘ/ෲ ද, 47ක රකාරාංශය + ැ/ෑ ද, 3ක රකාරාංශය + ු/ූ ද බහුලතම වේ (reports/corpus-counts.md හි CC-02). පහත ගණන් වචනය සහ එහි වරනැඟූ රූප, එනම් එයින් ආරම්භ වන සෑම වචනයක්ම, ඇතුළත් කරයි (CC-03):
| වචනය | C + ෘ/ෲ | ්ර + ු/ූ | ්ර + ැ/ෑ |
|---|---|---|---|
| krūra "කුරිරු" | කෲර 1,667 | 9 | 186 |
| saṃskṛtika "සංස්කෘතියට අදාළ" | සංස්කෘතික 14,680 | 3 | 0 |
| mṛdukāṃga "පරිගණක වැඩසටහන්" | මෘදුකාංග 16,492 | 3 | 0 |
| ṛju "කෙළින්ම" | සෘජු 7,013 | 0 | 0 |
| "group" (ඉංග්රීසි) | ගෲප් 937, ගෘප් 685 | 11 | 4 |
| śruti | ශෘති 21 | 3 | 124 |
| bhrūṇa "කලලය" | භෲණ 0 | 2 | 80 |
සිංහල විකිපීඩියාවද මෙයට එකඟ වේ (S18): කෲර ලිපි 126ක, ක්රෑර 24ක ඇති අතර ක්රූර එකකවත් නැත (CC-16). අවසාන පේළි දෙකෙන් පෙනෙන්නේ ශාස්ත්රීය වචන කිහිපයක ැ/ෑ ආදේශය ජය ගන්නා බවයි. දී ඇති වචනයක අක්ෂර වින්යාසය තෝරා ගත යුත්තේ ස්ථාවර නීතියකින් නොව ශබ්දකෝෂයකින් වීමට හේතුව එයයි.
ෘ/ෲ සංස්කෘත වචනවලට පමණක් සීමා නොවේ. ඉංග්රීසි ණය වචන සහ නම් /ru/ සහ /ruː/ සඳහා ඒවා භාවිත කරයි: ගෲප් "group", ඇන්ඩෲ "Andrew", බෲනායි "Brunei", ෆෘට් "fruit", ටෲමන් "Truman".
දර්ශනය (S16). රකාරාංශය + u/uu අක්ෂර රූපය සම්බන්ධයෙන් අකුරු මුහුණත් එකඟ නොවේ. Noto Sans Sinhala, Noto Serif Sinhala, Yaldevi සහ Gemunu Libre, S1 විස්තර කරන විශේෂ රූපය අඳියි: පොකුරට පසු ෑ ට සමාන ඉරකි. Nirmala UI, Iskoola Pota සහ Abhaya Libre පොකුරට පහළින් සාමාන්ය ු/ූ එකතු කරයි. එබැවින් Windows පද්ධති අකුරු මුහුණත් සමඟ නිවැරදිව කේතනය කළ ක්රූර කියවන්නන්ට වැරදි ලෙස පෙනේ. ලියන්නන් එය මඟ හරින්නට එක් හේතුවක් මෙය විය හැක [inferred].
- අදාළ වන්නේ: රකාරාංශය ගන්නා සෑම ව්යඤ්ජනයකටම; u, uu, ru, ruu.
- විශ්වාසය: භාවිත ගණන් සඳහා ඉහළ. අකුරු මුහුණත් මත පදනම් වූ පැහැදිලි කිරීමට මධ්යම.
- මූලාශ්ර: S1, S16, S17, S18.
8. වලංගුතා වගුව: ව්යඤ්ජන 41 × ස්වර ලකුණු
සංකේත.
- V = වලංගුය, සාමාන්ය නූතන වචනවල යෙදේ.
- L = වලංගුය, නමුත් ප්රායෝගිකව සංස්කෘත/පාලි ණය වචනවල (තත්සම) පමණි.
- R = දුර්ලභ හෝ ආන්තික.
- N = කිසි විට නැත, භාවිතයේ හමු නොවූ, හෝ ප්රමිතියකින් බැහැර කළ.
- S = විශේෂ අක්ෂර රූප හැඩය (කොටුවේ V/L/R කේතයක්ද ඇත). හැඩය කේතනය වෙනස් නොකරයි.
තීරු: a = ආවේණික ස්වරය; hal = ්; ru ruu ilu iluu = ෘ ෲ ෟ ෳ.
ෟ සහ ෳ තීරු සෑම පේළියකටම N වේ (VS-021). එබැවින් ඒවා පහත වගුවෙන් ඉවත් කර ඇත.
පදනම. වගුව අනිවාර්ය නීති (VS-019 සිට VS-028 දක්වා), අකුරු මුහුණත් නිරීක්ෂණ (S16), සහ තනි තනිව ගණන් නොකළ නිදර්ශන උදාහරණ ඒකාබද්ධ කරයි. අනිවාර්ය නීතිවලින් ඔබ්බට යන කොටු (ඞ ලකුණු, සඤ්ඤක හල්, ෟ/ෳ සඳහා N; S කොටු) මධ්යම/අඩු විශ්වාසයක් ඇති අතර පෙළ සංග්රහයකින් තහවුරු කළ යුතුය (§10 බලන්න).
ru සහ ruu තීරු S17 සමඟ පරීක්ෂා කරන ලදී (එක් එක් ව්යඤ්ජනයේ ගණන්: CC-04). වැරදි අක්ෂර වින්යාස ඉවත් කළ පසු, ලැයිස්තුවේ වචන වර්ග 10කට නොඅඩු ගණනක ටෝකන 150කට නොඅඩු ගණනක් ඇති විට කොටුවක් ඉහළ නැංවිණි: ka ga tta dda pa ba + ෲ සහ tta dda fa + ෘ V බවට පත් විය, ta + ෲ L බවට පත් විය (ශාස්තෲ). ya සහ ra පේළි වෙනස් කළේ නැත: ඒවායේ ෘ ටෝකන වැරදි අක්ෂර වින්යාස වේ (ව්යෘපෘති, ද්රෘෂ්ටි).
| id | C | a | hal | aa | ae | aee | i | ii | u | uu | ru | ruu | e | ee | ai | o | oo | au |
|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|
| ka | ක | V | V | V | V | V | V | V | V S | V S | L | V | V | V | L | V | V | L |
| kha | ඛ | L | L | L | R | R | L | L | L | L | N | N | L | L | R | L | L | R |
| ga | ග | V | V | V | V | V | V | V | V S | V S | L | V | V | V | R | V | V | L |
| gha | ඝ | L | L | L | N | N | L | L | L | L | L | N | L | L | N | L | L | N |
| nga | ඞ | N | R | N | N | N | N | N | N | N | N | N | N | N | N | N | N | N |
| nnga | ඟ | V | N | V | R | R | V | V | V S | R S | N | N | V | V | N | V | R | N |
| ca | ච | V | V S | V | V | V | V | V | V | V | N | N | V | V | L | V | V | R |
| cha | ඡ | L | L | L | N | N | L | L | L | L | N | N | L | L | N | L | L | N |
| ja | ජ | V | V S | V | V | V | V | V | V | V | R | N | V | V | L | V | V | R |
| jha | ඣ | R | R | R | N | N | R | R | R | R | N | N | R | R | N | R | R | N |
| nya | ඤ | R | R | R | N | N | R | R | R | N | N | N | R | N | N | R | N | N |
| jnya | ඥ | V | N | V | N | N | R | N | R | N | N | N | R | R | N | R | N | N |
| nyja | ඦ | R | N | R | R | R | R | R | R | R | N | N | R | R | N | R | R | N |
| tta | ට | V | V S | V | V | V | V | V | V | V | V | V | V | V | N | V | V | N |
| ttha | ඨ | L | L | L | N | N | L | L | L | L | N | N | L | L | N | L | L | N |
| dda | ඩ | V | V | V | V | V | V | V | V | V | V | V | V | V | N | V | V | N |
| ddha | ඪ | L | L | L | N | N | L | L | L | L | N | N | L | L | N | L | L | N |
| nna | ණ | V | V | V | R | R | V | V | V | V | N | N | V | V | N | V | V | N |
| nndda | ඬ | V | N | V | R | R | V | V | V | R | N | N | V | V | N | V | R | N |
| ta | ත | V | V | V | V | V | V | V | V S | V S | L | L | V | V | L | V | V | R |
| tha | ථ | L | L | L | N | N | L | L | L | L | N | N | L | L | N | L | L | N |
| da | ද | V | V | V | V | V | V | V | V S | V S | L | R | V | V | L | V | V | L |
| dha | ධ | L | L | L | R | R | L | L | L | L | L | N | L | L | L | L | L | L |
| na | න | V | V | V | V | V | V | V | V | V | L | N | V | V | L | V | V | L |
| nda | ඳ | V | N | V | R | R | V | V | V S | R S | N | N | V | V | N | V | R | N |
| pa | ප | V | V | V | V | V | V | V | V | V | L | V | V | V | L | V | V | L |
| pha | ඵ | L | L | L | N | N | L | L | L | L | N | N | L | L | N | L | L | N |
| ba | බ | V | V | V | V | V | V | V | V | V | L | V | V | V | R | V | V | L |
| bha | භ | L | L | L | R | R | L | L | L S | L S | L | N | L | L | L | L | L | L |
| ma | ම | V | V | V | V | V | V | V | V | V | L | R | V | V | L | V | V | L |
| mba | ඹ | V | N | V | R | R | V | V | V | R | N | N | V | V | N | V | R | N |
| ya | ය | V | V | V | V | V | V | V | V | V | N | N | V | V | R | V | V | L |
| ra | ර | V | V S | V | V S | V S | V | V | V S | V S | N | N | V | V | R | V | V | L |
| la | ල | V | V | V | V | V | V | V | V | V | N | N | V | V | R | V | V | L |
| va | ව | V | V | V | V | V | V | V | V | V | L | N | V | V | L | V | V | R |
| sha | ශ | L | L | L | R | R | L | L | L S | L S | L | N | L | L | L | L | L | L |
| ssa | ෂ | L | L | L | R | R | L | L | L | L | N | N | L | L | N | L | L | N |
| sa | ස | V | V | V | V | V | V | V | V | V | L | N | V | V | L | V | V | L |
| ha | හ | V | V | V | V | V | V | V | V | V | L | N | V | V | R | V | V | R |
| lla | ළ | V | R | V | V | R | V | V | V S | R S | N | N | V | R | N | V | R | N |
| fa | ෆ | V | V | V | V | V | V | V | V | V | V | N | V | V | N | V | V | N |
වගුව පිළිබඳ සටහන්:
- S, u/uu: ka ga nnga ta bha sha කොකු රූපය ගනී (VS-014). ra සහ lla අක්රමවත්ය (VS-012, VS-013). da සහ nda හි වලිගය නැති වේ (VS-015).
- S, hal: Nirmala UI තුළ ca ja tta ra මත පෙනෙන හල් ලකුණේ විකල්ප හැඩය (VS-017) (nyja මතද පෙනේ, නමුත් nyja + hal N වේ).
- S, ae/aee: ra පමණි (VS-011).
- Nirmala UI තුළ ru (ෘ) කිසිදු පේළියක ව්යඤ්ජනයට විශේෂිත හැඩයක් නොපෙන්වීය.
- jnya/nya/nyja/jha පේළි: "a/aa යෙදේ" යන්නෙන් ඔබ්බට විශ්වාසය අඩුය.
9. රෝමානුකරණය සහ අක්ෂර පරිවර්තනය සඳහා ඇඟවුම්
ලතින් අකුරු රෝමානුකරණයක් සහ සිංහල අකුරු අතර පරිවර්තනය කරන ඕනෑම අයෙකුට, හෝ ගබඩා කළ සිංහල පෙළෙහි වලංගුතාව පරීක්ෂා කරන ඕනෑම අයෙකුට මෙම කරුණු අදාළ වේ.
- කැනොනිකල්, තනි කේත ලක්ෂ්ය ලකුණු පමණක් භාවිත කරන්න (VS-003 සිට VS-006 දක්වා). එම ලකුණු අදහස් කරන විට රෝමානු "ee" → ේ, "oo" → ෝ, "o" → ො, "au" → ෞ, "ai" → ෛ (U+0DDB). ෙෙ, ෙ+්+ා, අ+ා සහ ඔ+් කිසි විට නිවැරදි ගබඩා රූප නොවේ. NFC ප්රයෝජනවත් ආරක්ෂාවකි, නමුත් එය ෙෙ වලින් U+0DDB නිපදවන්නේ නැත.
- තාර්කික අනුපිළිවෙළ රෝමානුකරණයට ස්වාභාවිකය. රෝමානු ස්වරයක් එහි ව්යඤ්ජනයට පසුව එයි. එය ගබඩා අනුපිළිවෙළට ගැළපේ. කොම්බුව මුලින් එන අනුපිළිවෙළ අයත් වන්නේ ලිවීමට සහ දර්ශනයට පමණි (VS-002, VS-018).
- ස්වතන්ත්ර ස්වරයද ලකුණද යන්න සන්දර්භය තීරණය කරයි (VS-029). ව්යඤ්ජනයකට (හෝ පොකුරකට) පසු ස්වරයක් ලකුණකට අනුරූප වේ. වචන මුලදී එය ස්වතන්ත්ර අකුරකට අනුරූප වේ. වෙනත් ස්වරයකට පසු සාමාන්ය අක්ෂර වින්යාසය දෙවන ස්වතන්ත්ර අකුරක් වෙනුවට අර්ධ ස්වරයක් (VS-030) භාවිත කරයි:
- "dia" → දිය, "dua" → දුව, "aeyi" → ඇයි.
- සරල මඟපෙන්වීම: i/ii/e/ee/ae/aee ට පසු ය භාවිත කරන්න. u/uu/o/oo/a/aa ට පසු ව භාවිත කරන්න. ඉහළ ස්වරයකට පෙර (ai/au වර්ගයේ අනුක්රම), ය/ව + ලකුණ අක්ෂර වින්යාසය භාවිත කරන්න.
- වචනය මැද සැබෑ ස්වතන්ත්ර ස්වරයක් ව්යතිරේකයකි (කෙටි යෙදුම්). රෝමානුකරණයක් එය පැහැදිලිව සලකුණු කළ යුතුය.
- "ai" සහ "au" අපැහැදිලිය (VS-022).
ai→ ෛ සහau→ ෞ ලෙස සිතියම්ගත කිරීම සෑම වචනයකටම සංස්කෘත අක්ෂර වින්යාසය ලබා දෙයි. දේශීය සහ ණය වචනවලට අයි/අවු අවශ්යය (ලයිට්, කවුද, හවුස්). විකල්ප:- ayi/avu පෙරනිමි කියවීම ලෙස සලකා ෛ/ෞ සඳහා වෙනම සංකේත වෙන් කිරීම, නැතහොත්
- ශබ්දකෝෂයක් මඟින් වචනයෙන් වචනය තීරණය කිරීම.
- "ru" ආකාර තුනකින් ගැටේ (VS-012, VS-016, VS-020): ර+ු, ෘ, සහ රකාරාංශය + ු.
- "kru" සාමාන්යයෙන් කෘ (කෘෂි, කෲර) වන අතර ඉඳහිට ක්රු වේ; වචනයෙන් වචනය ශබ්දකෝෂයක් තීරණය කරයි (VS-035), සහ
- "karu" කිසි විට කෘ නොවිය යුතුය. ආපසු හැරවිය හැකි රෝමානුකරණයක් ෘ සඳහා වෙනම සංකේතයක් (උදාහරණයක් ලෙස
ṛ) දිය යුතු අතර, සරලruයන්නෙන් r+u අදහස් විය යුතුය.
- "ae" යනු ඇ බැවින් a + e එක ළඟ යෙදීමට වෙනත් නිරූපණයක් අවශ්යය. එය ප්රශ්නයක් වන්නේ කලාතුරකිනි, මන්ද a + e එක ළඟ යෙදීම කෙසේ හෝ අර්ධ ස්වරයකින් ලියන බැවිනි (නො + එක් → නොයෙක්, VS-031). රෝමානුකරණයක් "ae" සැමවිටම æ අදහස් කරන බව පැවසිය යුතු අතර, a + e සඳහා අර්ධ ස්වර සලකන නීතියක් (හෝ පැහැදිලි වෙන් කිරීමේ ලකුණක්) භාවිත කළ යුතුය.
- නොහැකි යුගල (§8 හි N කොටු) ප්රයෝජනවත් වලංගුතා පරීක්ෂාවන් වේ:
- ඞ මත කිසිදු ලකුණක් නැත (ඒ වෙනුවට ං සුපුරුදු නූතන අක්ෂර වින්යාසයයි);
- ඟ ඬ ඳ ඹ ඦ මත හල් ලකුණ නැත;
- සංස්කෘත පාඨවලින් පිටත ෟ/ෳ නැත;
- ෆ, ළ හෝ සඤ්ඤක අකුරු මත ෘ/ෛ/ෞ නැත. L/R කොටු වලංගු නමුත් සංඛ්යාතය අඩුය.
- ලකුණ + ලකුණ නැත, හල් ලකුණට පසු ලකුණක් නැත (VS-009, VS-010). උදාහරණයක් ලෙස "kaa" + "a" කාා නොදිය යුතුය. රෝමානුකරණයක දෙගුණ කළ ස්වර අකුරක් යනු දිග ස්වරයකි (a → aa, i → ii ආදී ලෙස), දෙවන ලකුණක් නොවේ.
- දෙගුණ කිරීමෙන් දිග කිරීම ස්ථාවරය. සෑම කෙටි ලකුණකටම හරියටම එක් දිග ලකුණක් ඇත (VS-032). ස්ථාවර ක්රමය a→aa, ae→aee, i→ii, u→uu, e→ee, o→oo, ru→ruu වේ. අවිධිමත් රෝමානුකරණ බොහෝ විට ī සඳහා "ee" ලියයි. "ee" ේ වෙනුවට ී ලෙස අර්ථකථනය කිරීමට ශබ්දකෝෂ සහාය අවශ්යය, මන්ද ee → ේ ක්රමානුකූල කියවීම වන බැවිනි.
- විශේෂ හැඩ සඳහා නීති අවශ්ය නොවේ (VS-011 සිට VS-015 දක්වා). කේතනය ඒකාකාරය (ර+ු, ළ+ු). "දෘශ්ය" සමාන රූප වැරදිය: ළු වෙනම කේත ලක්ෂ්යයක් නොවේ, සහ ැ රකාරාංශ-u ලකුණ නොවේ.
- අක්ෂර වින්යාස පරීක්ෂාව: දිග දෝෂ බහුලතම වැරැද්දයි (VS-033). ශබ්දකෝෂයක එක් රූපයක් පමණක් ඇති විට දිග විචල්ය දෙකම පරීක්ෂා කිරීම වටී.
10. විසඳා නැති ප්රශ්න / ගැටෙන මූලාශ්ර
- රකාරාංශය + u/uu. SLS 1134 වගුව 3 වලංගු රකාරාංශ ස්වරවලින් kru/kruu ඉවත් කර, එවැනි අනුක්රම "are not used" බව පවසයි. යුනිකේත §13.2 ක්රු/ක්රූ වෙනම අක්ෂර රූප ප්රභේද සහිත සාමාන්ය රූප ලෙස දක්වයි. පෙළ සංග්රහ ගණන් (VS-035) SLS ට අර්ධ වශයෙන් සහාය දෙයි: අනුක්රමය වලංගු නමුත් දුර්ලභය, මන්ද ලියන්නන් ඒ වෙනුවට ෘ/ෲ (කෲර) හෝ වැරදි ලෙස ැ/ෑ (ක්රෑර) භාවිත කරන බැවිනි. ෘ/ෲ සහ රකාරාංශය + ු/ූ දෙකම වලංගු ලෙස සලකන්න; සුපුරුදු රූපය ෘ/ෲ වේ.
- ලකුණක් තනිව පෙන්වීම. සම්මුති තුනක් ගැටේ:
- SLS 1134 කෙටුම්පත: ZWNJ + ලකුණ;
- SLSI WG 2004: හිස්තැන + ලකුණ, කොකු රූපය සඳහා NBSP + pāpilla;
- Microsoft: වාර්තා වන පරිදි හිස්තැන + ZWJ (SLSI සටහනට අනුව). මෙය අදාළ වන්නේ ලකුණක් තනිව පෙන්වන ලේඛන, අකුරු වගු සහ ඉගැන්වීම් ද්රව්ය සඳහා පමණි.
- ගයනුකිත්ත ෟ. SLS වගුව 1 එය au ඉර ලෙස සලකන අතර තනි ස්වරයක් ලෙස භාවිත නොකරයි. LGR එය බැහැර කරයි ("usage unknown"). යුනිකේතය එය ස්වර l ලකුණ ලෙස නම් කරයි. එකඟතාව: නූතන සිංහලයේ එය තනිව නොයොදන්න.
- ෲ භාවිතය. SLS අනුව ෲ "is used" (PDF හි එහි උදාහරණය විකෘති වී ඇත; සමහර විට කර්තෲ). LGR ෲ ඇතුළත් කරන නමුත් ඎ බැහැර කරයි. පොදු භාවිතයේ අක්ෂර වින්යාසය කර්තෘ (ෘ සමඟ) වේ: NLPC හි කර්තෘ ටෝකන 2,938ක් ඇති අතර කර්තෲ ඇත්තේ 15ක් (දුර්ලභ) පමණි.
- කොටස් දෙකේ ai/o/au සන්දර්භ රූප. යුනිකේත පරිච්ඡේදය 13 හි ස්වයංක්රීය සාරාංශයක් ga, nya, ttha, nna, tha, dha සහ sha ට පසු මෙම ලකුණුවලට විශේෂ කොටස් දෙකේ රූප ඇති බව කියා සිටියේය. එම පෙළ මෙහි උපුටා ගත් §13.2 හි නැත. එබැවින් එය ද්විතීයික සාරාංශයක දෝෂයක් ලෙස ප්රතික්ෂේප කරන ලදී. කිසිවෙකු එය නැවත ඇතුළත් නොකරන ලෙස මෙහි සටහන් කර ඇත.
- හල් ලකුණු හැඩ පන්ති (VS-017). යුනිකේතය ච උදාහරණයට ගනී, SLS ට උදාහරණයට ගනී. සම්පූර්ණ කට්ටලය අකුරු මුහුණත මත රඳා පවතින අතර කිසිදු ප්රමිතිගත මූලාශ්රයක හමු නොවීය.
- ඳ හි වලිගය නැති වීම (VS-015). දුටුවේ Nirmala UI තුළ පමණි; යුනිකේතය "bases similar to ද" යැයි පවසන නමුත් ඒවා ලැයිස්තුගත නොකරයි.
- වලංගුතා වගුව (§8) පෙළ සංග්රහ මිනුමක් නොව සංශ්ලේෂණයකි. මහාප්රාණ, සඤ්ඤක + දිග ස්වර, ළ + දිග ස්වර, සහ ඤ/ඥ/ඦ සඳහා L/R/N බෙදීම සිංහල පෙළ සංග්රහයකින් තහවුරු කළ යුතුය. යෝජනාව: UCSC වචන මිලියන 10 පෙළ සංග්රහය හෝ විකිපීඩියා දත්ත ගොනුවක් භාවිත කර C+ලකුණ යුගල ගණන් කිරීම.
- වචනය මැද ස්වතන්ත්ර ස්වර (VS-029). SLS අනුව ස්වර යෙදෙන්නේ වචන මුලදී පමණි. සැබෑ පෙළෙහි කෙටි යෙදුම් (ඩී එන් ඒ) සහ සන්ධි නොකළ සමාස කිහිපයක් ඇත. මෙය කොතරම් පුළුල්ද යන්න කිසිදු මූලාශ්රයක හමු නොවීය.
- පිලිවල සාම්ප්රදායික නම් (VS-001) NIE ව්යාකරණ පෙළපොතක් සමඟ පරීක්ෂා කළේ නැත. සිංහල අකුරු සෙවුම් සඳහා සෙවුම් යන්ත්ර ප්රයෝජනවත් කිසිවක් ලබා දුන්නේ නැත. educationpublications.gov.lk හි 6–9 ශ්රේණි සිංහල භාෂාව පෙළපොත් අතින් පරීක්ෂා කිරීම නිර්දේශ කෙරේ.
- S1 වගුවේ දෝෂය. යුනිකේත HTML පිටපතේ Table 13-5 හි රු/ළු පේළිවල ◌ු ට පසු ZWJ එකක් පෙනේ. මෙය HTML දෝෂයක් යැයි උපකල්පනය කෙරේ; SLS කේතනයේ (ර U+0DBB + U+0DD4) ZWJ එකක් නැත.
- ඔ + ් සහ ඕ. මෙම යුගලය යුනිකේත Table 13-2 හි සහ DoNotEmit හි නැත. HarfBuzz ද එය සලකුණු නොකරයි. එසේ වුවද නිවැරදිව සැකසූ පෙළෙහි එය කිසි විට නොතිබිය යුතුය.
- ඉවත් කළ නීති: VS-034 විෂය පථයෙන් පිටත බැවින් ඉවත් කරන ලදී.