01: සිංහල ලේඛන ක්රමයේ සංකේත සමූහය
විෂය පථය: සිංහල ලේඛන ක්රමයේ සංකේත සමූහය (inventory). එනම් කුමන සංකේත තිබේද, ඒවාට කියන නම් මොනවාද, ඒවා වර්ග කරන්නේ කෙසේද, කුමන ඒවා දැනට භාවිතයේ, දුර්ලභ හෝ භාවිතයෙන් ඉවත් වූ ඒවාද යන්නයි. එසේම ඒවා යුනිකේත (Unicode) සහ SLS 1134 හි කේතනය කර ඇති ආකාරයද මෙහි ඇතුළත්ය. අක්ෂර වින්යාස නීති, සන්ධි සහ රෝමානුකරණ ක්රම සැලසුම් කිරීම මෙහි විෂය පථයට අයත් නොවේ. ඊට ව්යතිරේකය අවසාන “රෝමානුකරණයට සහ අක්ෂර පරිවර්තනයට ඇති බලපෑම්” කොටසයි.
සම්පාදනය කළේ 2026 ඔක්තෝබර් මාසයේදීය.
අකුරු හැඳුනුම් (මෙම ගබඩාව පුරා භාවිත වේ): ව්යඤ්ජන ka kha ga gha nga nnga(ඟ) ca cha ja jha nya(ඤ) jnya(ඥ) nyja(ඦ) tta ttha dda ddha nna nndda(ඬ) ta tha da dha na nda(ඳ) pa pha ba bha ma mba(ඹ) ya ra la va sha(ශ) ssa(ෂ) sa ha lla(ළ) fa; ස්වර a aa ae aee i ii u uu ru ruu ilu iluu e ee ai o oo au; hal = හල් ලකුණ (al-lakuna).
0. සාරාංශය
- යුනිකේත සිංහල කොටස (U+0D80–U+0DFF) කේතනය කරන්නේ මේවාය: “විවිධ ලකුණු” 3 (ඁ ං ඃ), ස්වතන්ත්ර ස්වර 18, ව්යඤ්ජන 41, හල් ලකුණ 1, ස්වර ලකුණු (පිලි) 19 (ප්රධාන පෙළේ 17 + “අමතර” 2), ලිත් ඉලක්කම් 10 සහ විරාම ලකුණ 1 (෴). Sinhala Archaic Numbers (U+111E1–U+111F4) කොටස ඓතිහාසික ඉලක්කම් 20ක් එක් කරයි. සෑම සංයුක්ත අකුරකටම, යංශයට, රකාරාංශයට සහ රේඵයට ZWJ (U+200D) අනිවාර්ය වේ. ZWNJ (U+200C) යෙදෙන්නේ දර්ශනයට අදාළ සුළු කාර්යයන් සඳහා පමණි.
- පාසල් සම්මතය වන්නේ “අකුරු 60” නූතන හෝඩියයි (NIE 1989: ස්වර 18 + “ව්යඤ්ජන” 42; මේ 42 තුළ ං සහ ඃ ලකුණුද ඇතුළත්ය). SLS 1134 අකුරු 61ක් ගණන් කරයි (ස්වර 18 + ව්යඤ්ජන 41 + අර්ධ ව්යඤ්ජන 2). ඊට හේතුව, 1989 NIE ලැයිස්තුවේ නැති ඥ (jnya) අකුර SLS එක් කිරීමයි.
- ඓතිහාසිකව: සිදත් සඟරා (13 වන සියවස) අකුරු 30 → එළු / ශුද්ධ 32 (ඇ ඈ එක් කරයි) → වදන් කවි 50 → මිශ්ර 54 → NIE 1989 60 (ෆ + සඤ්ඤක අකුරු පහ එක් කරයි) → SLS/Unicode 61 (ඥ එක් කරයි). එක් එක් අවධියේ අකුරු ගණන සහ එක් කළ අකුරු මූලාශ්රයෙන් මූලාශ්රයට වෙනස් වේ (§11 බලන්න).
- නූතන භාවිතයේ ඏ ඐ ඎ ෟ(තනිව) ෳ ඁ ඦ ප්රායෝගිකව භාවිතයෙන් ඉවත් වී ඇත. ඞ ඣ ඪ පාලි/සංස්කෘත වචනවල පමණක් හමු වන දුර්ලභ අකුරුය. ඉංග්රීසි ශබ්ද සඳහා වැඩිපුරම යොදා ගැනෙන්නේ ෆ සහ ඇ/ඈ අකුරුය. /z/ සඳහා අකුරක් නැත.
1. මූලාශ්ර (වගුවල කේතයෙන් සඳහන් වේ)
| කේතය | මූලාශ්රය | සටහන් |
|---|---|---|
| U-CH | Unicode 18.0 code chart, Sinhala: https://www.unicode.org/charts/PDF/U0D80.pdf | නිල නම්, අන්වර්ථ නාම, වියෝජන. සෘජුවම කියවා ඇත. |
| U-AN | Unicode 18.0 code chart, Sinhala Archaic Numbers: https://www.unicode.org/charts/PDF/U111E0.pdf | සෘජුවම කියවා ඇත. |
| U-SP | Unicode Core Spec ch. 13 (v16.0), §13.2 Sinhala: https://www.unicode.org/versions/Unicode16.0.0/core-spec/chapter-13/ | ZWJ නීති, u/uu සන්දර්භීය රූප, චන්ද්රබින්දුව, කුණ්ඩලිය. සාරාංශ ආකාරයෙන් පරිශීලනය කර ඇත. |
| U-NS | Unicode NamedSequences.txt: https://www.unicode.org/Public/UCD/latest/ucd/NamedSequences.txt | යංශය / රකාරාංශය / රේඵය සඳහා අනුක්රම. සෘජුවම කියවා ඇත. |
| U-L2 | L2/08-105, J. B. Disanayaka for ICTA & SLSI, "Observations on the Encoding of Archaic Sinhala Numerals", Feb 2008: https://www.unicode.org/L2/L2008/08105-sinhala.pdf | සෘජුවම කියවා ඇත. |
| CP | codepoints.net (Unicode version of first encoding): https://codepoints.net/U+0D81 , https://codepoints.net/U+0DE6 , https://codepoints.net/U+0DC6 | ද්විතීයික මූලාශ්රයකි. දත්ත UCD DerivedAge වෙතින් ලබා ගෙන ඇත. |
| SLS | SLS 1134 Draft, 2nd revision (SLSI, draft dated 2004-04-26): https://sinhala.sourceforge.net/archive/akuru.org/att-0028/sls1134.pdf | සෘජුවම කියවා ඇත (පිටු 1–20). අවසානයේ ප්රකාශිත SLS 1134:2004 / :2011 පෙළ ලබා ගත නොහැකි විය. කෙටුම්පත ඒවායින් වෙනස් විය හැක. |
| WP-EN | Wikipedia, "Sinhala script": https://en.wikipedia.org/wiki/Sinhala_script | හැඳින්වීම පමණි. |
| WP-SI | සිංහල විකිපීඩියා, "සිංහල හෝඩි": https://si.wikipedia.org/wiki/සිංහල_හෝඩි | හැඳින්වීම පමණි. සාරාංශ ආකාරයෙන් පරිශීලනය කර ඇත. |
| WP-NUM | Wikipedia, "Sinhala numerals": https://en.wikipedia.org/wiki/Sinhala_numerals | හැඳින්වීම පමණි. |
| KLN | University of Kelaniya, නෙමඩල, "සිංහල හෝඩියේ උත්පත්තිය", බී. ලක්ෂිකා මදුශානි, 2022-07-11: https://units.kln.ac.lk/nemadala/index.php/visheshanga/gaweshana/295-2022-07-11-03-29-22 | විශ්වවිද්යාල ශිෂ්ය පර්යේෂණ ද්වාරයකි. හෝඩියේ ඉතිහාසය ගැන පරිශීලනය කළ වඩාත් විස්තරාත්මක සිංහල මූලාශ්රයයි. |
| LD | Lankadeepa, "'ෆ' අක්ෂරය සිංහල හෝඩියට ආ හැටි": https://www.lankadeepa.lk/mathaka_ha_mathaka/ෆ-අකෂරය-සහල-හඩයට-ආ-හට/287-656225 | පුවත්පතකි. ෆ අකුරේ ඉතිහාසය. |
| B-AK | akurusinhala.blogspot.com, "සිංහල අක්ෂර වර්ගීකරණය" (2016): http://akurusinhala.blogspot.com/2016/10/blog-post.html | බ්ලොග් අඩවියකි. වර්ගීකරණ වගු (තහවුරු කිරීමට පමණි). |
| B-BN | bingunada.blogspot.com, "සිංහල භාෂාවේ පිලි" (2014): http://bingunada.blogspot.com/2014/09/blog-post.html | බ්ලොග් අඩවියකි. පිලිවල නම් (තහවුරු කිරීමට පමණි). |
| B-IH | ihhodiya.blogspot.com, "අපේ සිංහල හෝඩිය" (2018): http://ihhodiya.blogspot.com/2018/09/2.html | බ්ලොග් අඩවියකි. හෝඩියේ ඉතිහාසය. |
| B-S4 | sinhala4all.weebly.com, "අක්ෂර මාලාව": https://sinhala4all.weebly.com/34613482353035223515-35123535351735353520.html | ගුරු වෙබ් අඩවියකි. හෝඩියේ ඉතිහාසය. |
| YM | Yamu.lk, "සිංහල හෝඩිය ගැන හැංගුණු කතාවක්" (2019-11-22): https://www.yamu.lk/trending/sinhala-alphabet-doubts/ | ජනප්රිය ලිපියකි. ඥ/z ගැන අදහස්. |
| ST | Sunday Times (LK), 1998-10-04: https://www.sundaytimes.lk/981004/plus2.html | Disanayaka සමඟ සම්මුඛ සාකච්ඡාව: "from around 37 letters… up to 60". |
පරිශීලනය නොකළ මූලාශ්ර: NIE / අධ්යාපන ප්රකාශන දෙපාර්තමේන්තුවේ 6 ශ්රේණියේ පෙළපොතේ “අක්ෂරමාලාව හා පිල්ලම්” පාඩම (https://govdoc.lk/lesson-view?id=3986&fid=62e8a270be286 හි සඳහන්ය; පෙළ ලබා ගත නොහැකි විය), සහ encyclopedia.gov.lk හි ශ්රී ලංකා සිංහල විශ්වකෝෂයේ “අක්ෂරමාලාව (සිංහල)” ලිපිය (වෙබ් අඩවිය ලබා ගත නොහැකි විය). එබැවින් පහත “පාසල් ව්යාකරණයට” ආරෝපණය කළ ඕනෑම දෙයක් තහවුරු කරන්නේ ද්විතීයික සිංහල මූලාශ්ර පමණි. පෙළපොත සමඟ සසඳා බලන තුරු එයට මධ්යම විශ්වාසයක් දෙනු ලැබේ.
2. වගුව 1: යුනිකේත සිංහල කොටස, සම්පූර්ණයෙන් (U+0D80–U+0DFF)
තීරු: ID = මෙම ගබඩාවේ භාවිත වන අකුරු හැඳුනුම. Unicode name යනු නිල නාමයයි (එහි = අන්වර්ථ නාමය සමඟ). සිංහල නම යනු සාම්ප්රදායික නාමයයි. අකුරු සඳහා මේවා යුනිකේත නම් ගොඩනැගීමට පදනම් වූ “-යන්න” රටාව අනුගමනය කරයි (WP-EN, SLS Table 4). සිංහල අක්ෂර වින්යාසය මෙම අධ්යයනය සඳහා යුනිකේත/SLS රෝමානුකෘත නාමය සිංහලට හැරවූ ආකාරයයි. B-BN/B-AK එදිනෙදා භාවිතයේ වෙනත් රූපයක් දෙන තැන්වල එම රූපයද පෙන්වා ඇත. වර්ගය: SIGN = අයෝගවාහ/විවිධ ලකුණ; IV = ස්වතන්ත්ර ස්වරය; C = ව්යඤ්ජනය; VS = ස්වර ලකුණ; D = ඉලක්කම; P = විරාම ලකුණ. කට්ටලය: Ś = ශුද්ධ (එළු) කට්ටලයේ ඇත, M = මිශ්ර කට්ටලයේ පමණි, N = නූතන/NIE යුගයේ එක් කළ. තත්ත්වය: භාවිතයේ / දුර්ලභ / භාවිතයෙන් ඉවත් වූ. “සිට” = පළමු යුනිකේත අනුවාදය (CP, U-SP).
කොටසේ පවරා නොමැති ස්ථාන: 0D80, 0D84, 0D97–0D99, 0DB2, 0DBC, 0DBE–0DBF, 0DC7–0DC9, 0DCB–0DCE, 0DD5, 0DD7, 0DE0–0DE5, 0DF0–0DF1, 0DF5–0DFF (U-CH). SLS පවසන්නේ 0D97–0D99 සහ 0DC7–0DC9 අනාගත ස්වර සහ ව්යඤ්ජන සඳහා හිතාමතාම වෙන් කර තැබූ බවයි.
2a. විවිධ ලකුණු (අයෝගවාහ)
| CP | අකුරු රූපය | ID | Unicode name (= alias) | සිංහල නම | වර්ගය | කට්ටලය | තත්ත්වය |
|---|---|---|---|---|---|---|---|
| 0D81 | ඁ | - | SINHALA SIGN CANDRABINDU | චන්ද්රබින්දු (candrabindu) | SIGN | - | භාවිතයෙන් ඉවත් වූ; Unicode 13.0 (2020). පිරිවිතරයට අනුව මෙය පුරාතන සංස්කෘත පෙළ සඳහා පමණි, නූතන සිංහලට නොවේ (U-SP). |
| 0D82 | ං | - | SINHALA SIGN ANUSVARAYA (= anusvara) | අනුස්වාරය / බින්දුව | SIGN | Ś | භාවිතයේ (ඉතා බහුලයි: සිංහල, ලංකාව) |
| 0D83 | ඃ | - | SINHALA SIGN VISARGAYA (= visarga) | විසර්ගය | SIGN | M | දුර්ලභ (සංස්කෘත ණය වචන: දුඃඛ, පුනඃ) |
2b. ස්වතන්ත්ර ස්වර (ස්වර / ප්රාණාක්ෂර)
| CP | අකුරු රූපය | ID | Unicode name (= alias) | සිංහල නම | කට්ටලය | තත්ත්වය |
|---|---|---|---|---|---|---|
| 0D85 | අ | a | SINHALA LETTER AYANNA (= a) | අයන්න | Ś | භාවිතයේ |
| 0D86 | ආ | aa | AAYANNA (= aa) | ආයන්න | Ś | භාවිතයේ |
| 0D87 | ඇ | ae | AEYANNA (= ae) | ඇයන්න | Ś (සිදත් සඟරාවෙන් පසු) | භාවිතයේ |
| 0D88 | ඈ | aee | AEEYANNA (= aae) | ඈයන්න | Ś (සිදත් සඟරාවෙන් පසු) | භාවිතයේ |
| 0D89 | ඉ | i | IYANNA (= i) | ඉයන්න | Ś | භාවිතයේ |
| 0D8A | ඊ | ii | IIYANNA (= ii) | ඊයන්න | Ś | භාවිතයේ |
| 0D8B | උ | u | UYANNA (= u) | උයන්න | Ś | භාවිතයේ |
| 0D8C | ඌ | uu | UUYANNA (= uu) | ඌයන්න | Ś | භාවිතයේ |
| 0D8D | ඍ | ru | IRUYANNA (= vocalic r) | ඉරුයන්න | M | භාවිතයේ, දුර්ලභ (ඍතුව, ඍෂි) |
| 0D8E | ඎ | ruu | IRUUYANNA (= vocalic rr) | ඉරූයන්න | M | අකුරක් ලෙස භාවිතයෙන් ඉවත් වී ඇත. එහි ලකුණ වන ෲ තවමත් පවතී (SLS note 3). |
| 0D8F | ඏ | ilu | ILUYANNA (= vocalic l) | ඉලුයන්න | M | භාවිතයෙන් ඉවත් වූ (SLS: "do not occur in present usage") |
| 0D90 | ඐ | iluu | ILUUYANNA (= vocalic ll) | ඉලූයන්න | M | භාවිතයෙන් ඉවත් වූ |
| 0D91 | එ | e | EYANNA (= e) | එයන්න | Ś | භාවිතයේ |
| 0D92 | ඒ | ee | EEYANNA (= ee) | ඒයන්න | Ś | භාවිතයේ |
| 0D93 | ඓ | ai | AIYANNA (= ai) | ඓයන්න | M | භාවිතයේ, දුර්ලභ (ඓතිහාසික) |
| 0D94 | ඔ | o | OYANNA (= o) | ඔයන්න | Ś | භාවිතයේ |
| 0D95 | ඕ | oo | OOYANNA (= oo) | ඕයන්න | Ś | භාවිතයේ |
| 0D96 | ඖ | au | AUYANNA (= au) | ඖයන්න | M | භාවිතයේ, දුර්ලභ (ඖෂධ) |
2c. ව්යඤ්ජන (ව්යඤ්ජන / ගාත්රාක්ෂර)
| CP | අකුරු රූපය | ID | Unicode name (= alias) | සිංහල නම | කට්ටලය | තත්ත්වය |
|---|---|---|---|---|---|---|
| 0D9A | ක | ka | ALPAPRAANA KAYANNA (= ka) | අල්පප්රාණ කයන්න | Ś | භාවිතයේ |
| 0D9B | ඛ | kha | MAHAAPRAANA KAYANNA (= kha) | මහාප්රාණ කයන්න (“බයානු කයන්න” ලෙසද, WP-EN) | M | භාවිතයේ (ණය වචන) |
| 0D9C | ග | ga | ALPAPRAANA GAYANNA (= ga) | අල්පප්රාණ ගයන්න | Ś | භාවිතයේ |
| 0D9D | ඝ | gha | MAHAAPRAANA GAYANNA (= gha) | මහාප්රාණ ගයන්න | M | භාවිතයේ (ණය වචන: සංඝ, මේඝ) |
| 0D9E | ඞ | nga | KANTAJA NAASIKYAYA (= nga) | කණ්ඨජ නාසිකය | M | දුර්ලභ. SLS: කිසිදා ස්වරයක් නොගනී, ඞ් ලෙස පමණක් යෙදේ. |
| 0D9F | ඟ | nnga | SANYAKA GAYANNA (= nnga) | සඤ්ඤක ගයන්න | Ś (සඤ්ඤක) | භාවිතයේ (අඟල, හඟින) |
| 0DA0 | ච | ca | ALPAPRAANA CAYANNA (= ca) | අල්පප්රාණ චයන්න | Ś (නූතන); සිදත් සඟරා ලැයිස්තුවේ නැත | භාවිතයේ |
| 0DA1 | ඡ | cha | MAHAAPRAANA CAYANNA (= cha) | මහාප්රාණ චයන්න | M | භාවිතයේ (ණය වචන: ඡායා) |
| 0DA2 | ජ | ja | ALPAPRAANA JAYANNA (= ja) | අල්පප්රාණ ජයන්න | Ś | භාවිතයේ |
| 0DA3 | ඣ | jha | MAHAAPRAANA JAYANNA (= jha) | මහාප්රාණ ජයන්න | M | ඉතා දුර්ලභ (පාලි ඣාන) |
| 0DA4 | ඤ | nya | TAALUJA NAASIKYAYA (= nya) | තාලුජ නාසිකය | M | භාවිතයේ (ඤාණ, සඤ්ඤා) |
| 0DA5 | ඥ | jnya | TAALUJA SANYOOGA NAAKSIKYAYA (= jnya) | තාලුජ සංයෝග නාසිකය | M (NIE 1989 ලැයිස්තුවේ නැත; SLS/Unicode හි ඇත) | භාවිතයේ (ඥාති, විශේෂඥ, ප්රඥා) |
| 0DA6 | ඦ | nyja | SANYAKA JAYANNA (= nyja) | සඤ්ඤක ජයන්න | N (සඤ්ඤක) | භාවිතයෙන් ඉවත් වූ/කිසිදා භාවිත නොවූ (SLS: වර්තමාන ලේඛනයේ නැත) |
| 0DA7 | ට | tta | ALPAPRAANA TTAYANNA (= tta) | අල්පප්රාණ ටයන්න | Ś | භාවිතයේ |
| 0DA8 | ඨ | ttha | MAHAAPRAANA TTAYANNA (= ttha) | මහාප්රාණ ටයන්න | M | දුර්ලභ (ශ්රේෂ්ඨ) |
| 0DA9 | ඩ | dda | ALPAPRAANA DDAYANNA (= dda) | අල්පප්රාණ ඩයන්න | Ś | භාවිතයේ |
| 0DAA | ඪ | ddha | MAHAAPRAANA DDAYANNA (= ddha) | මහාප්රාණ ඩයන්න | M | ඉතා දුර්ලභ |
| 0DAB | ණ | nna | MUURDHAJA NAYANNA (= nna) | මූර්ධජ ණයන්න | Ś | භාවිතයේ (න සමඟ වෙනස අක්ෂර වින්යාසයේ පමණි) |
| 0DAC | ඬ | nndda | SANYAKA DDAYANNA (= nndda) | සඤ්ඤක ඩයන්න | Ś (සඤ්ඤක) | භාවිතයේ (කඬ, හඬ) |
| 0DAD | ත | ta | ALPAPRAANA TAYANNA (= ta) | අල්පප්රාණ තයන්න | Ś | භාවිතයේ |
| 0DAE | ථ | tha | MAHAAPRAANA TAYANNA (= tha) | මහාප්රාණ තයන්න | M | භාවිතයේ (ණය වචන: ස්ථාන, කථා) |
| 0DAF | ද | da | ALPAPRAANA DAYANNA (= da) | අල්පප්රාණ දයන්න | Ś | භාවිතයේ |
| 0DB0 | ධ | dha | MAHAAPRAANA DAYANNA (= dha) | මහාප්රාණ දයන්න | M | භාවිතයේ (ණය වචන: ධර්ම, බුද්ධ) |
| 0DB1 | න | na | DANTAJA NAYANNA (= na) | දන්තජ නයන්න | Ś | භාවිතයේ |
| 0DB3 | ඳ | nda | SANYAKA DAYANNA (= nda) | සඤ්ඤක දයන්න | Ś (සඤ්ඤක) | භාවිතයේ (සඳ; ඳ ඉතා බහුලයි) |
| 0DB4 | ප | pa | ALPAPRAANA PAYANNA (= pa) | අල්පප්රාණ පයන්න | Ś | භාවිතයේ |
| 0DB5 | ඵ | pha | MAHAAPRAANA PAYANNA (= pha) | මහාප්රාණ පයන්න | M | භාවිතයේ, දුර්ලභ (ඵල) |
| 0DB6 | බ | ba | ALPAPRAANA BAYANNA (= ba) | අල්පප්රාණ බයන්න | Ś | භාවිතයේ |
| 0DB7 | භ | bha | MAHAAPRAANA BAYANNA (= bha) | මහාප්රාණ බයන්න | M | භාවිතයේ (භාෂාව) |
| 0DB8 | ම | ma | MAYANNA (= ma) | මයන්න | Ś | භාවිතයේ |
| 0DB9 | ඹ | mba | AMBA BAYANNA (= mba) | අඹ බයන්න / සඤ්ඤක බයන්න | Ś (සඤ්ඤක) | භාවිතයේ (අඹ, තඹ) |
| 0DBA | ය | ya | YAYANNA (= ya) | යයන්න | Ś | භාවිතයේ |
| 0DBB | ර | ra | RAYANNA (= ra) | රයන්න | Ś | භාවිතයේ |
| 0DBD | ල | la | DANTAJA LAYANNA (= la; dental) | දන්තජ ලයන්න | Ś | භාවිතයේ |
| 0DC0 | ව | va | VAYANNA (= va) | වයන්න | Ś | භාවිතයේ |
| 0DC1 | ශ | sha | TAALUJA SAYANNA (= sha) | තාලුජ ශයන්න | M | භාවිතයේ (ශ්රී, ශාලා) |
| 0DC2 | ෂ | ssa | MUURDHAJA SAYANNA (= ssa; retroflex) | මූර්ධජ ෂයන්න | M | භාවිතයේ (භාෂා; ඉංග්රීසි “sh”: ෂෝ) |
| 0DC3 | ස | sa | DANTAJA SAYANNA (= sa; dental) | දන්තජ සයන්න | Ś | භාවිතයේ |
| 0DC4 | හ | ha | HAYANNA (= ha) | හයන්න | Ś | භාවිතයේ |
| 0DC5 | ළ | lla | MUURDHAJA LAYANNA (= lla; retroflex) | මූර්ධජ ළයන්න | Ś | භාවිතයේ (ල සමඟ වෙනස අක්ෂර වින්යාසයේ පමණි) |
| 0DC6 | ෆ | fa | FAYANNA (= fa) | ෆයන්න | N (1989) | භාවිතයේ (ඉංග්රීසි ණය වචන). Unicode 3.0 (1999). |
2d. හල් ලකුණ සහ ස්වර ලකුණු (පිලි / පිල්ලම්). නම් සඳහා §6 බලන්න.
| CP | අකුරු රූපය | ID | Unicode name (= alias) | වියෝජනය (U-CH) |
|---|---|---|---|---|
| 0DCA | ් | hal | SINHALA SIGN AL-LAKUNA (= virama) | - |
| 0DCF | ා | aa | VOWEL SIGN AELA-PILLA (= aa) | - |
| 0DD0 | ැ | ae | VOWEL SIGN KETTI AEDA-PILLA (= ae) | - |
| 0DD1 | ෑ | aee | VOWEL SIGN DIGA AEDA-PILLA (= aae) | - |
| 0DD2 | ි | i | VOWEL SIGN KETTI IS-PILLA (= i) | - |
| 0DD3 | ී | ii | VOWEL SIGN DIGA IS-PILLA (= ii) | - |
| 0DD4 | ු | u | VOWEL SIGN KETTI PAA-PILLA (= u) | - |
| 0DD6 | ූ | uu | VOWEL SIGN DIGA PAA-PILLA (= uu) | - |
| 0DD8 | ෘ | ru | VOWEL SIGN GAETTA-PILLA (= vocalic r) | - |
| 0DD9 | ෙ | e | VOWEL SIGN KOMBUVA (= e) | - (ව්යඤ්ජනයට පෙර ඇඳෙන රූපය) |
| 0DDA | ේ | ee | VOWEL SIGN DIGA KOMBUVA (= ee) | ≡ 0DD9 0DCA |
| 0DDB | ෛ | ai | VOWEL SIGN KOMBU DEKA (= ai) | නැත (ෙ+ෙ ≡ නොවේ) |
| 0DDC | ො | o | VOWEL SIGN KOMBUVA HAA AELA-PILLA (= o) | ≡ 0DD9 0DCF |
| 0DDD | ෝ | oo | VOWEL SIGN KOMBUVA HAA DIGA AELA-PILLA (= oo) | ≡ 0DDC 0DCA |
| 0DDE | ෞ | au | VOWEL SIGN KOMBUVA HAA GAYANUKITTA (= au) | ≡ 0DD9 0DDF |
| 0DDF | ෟ | ilu | VOWEL SIGN GAYANUKITTA (= vocalic l) | - |
| 0DF2 | ෲ | ruu | VOWEL SIGN DIGA GAETTA-PILLA (= vocalic rr) | - |
| 0DF3 | ෳ | iluu | VOWEL SIGN DIGA GAYANUKITTA (= vocalic ll) | - |
2e. ඉලක්කම් සහ විරාම ලකුණු
| CP | අකුරු රූපය | Unicode name | සටහන් |
|---|---|---|---|
| 0DE6–0DEF | ෦ ෧ ෨ ෩ ෪ ෫ ෬ ෭ ෮ ෯ | SINHALA LITH DIGIT ZERO … NINE | ජ්යොතිෂ ඉලක්කම් (“Lith Illakkam”). ස්ථානීය අගය ඇත, බිංදුවක් ඇත. Unicode 7.0 (2014). |
| 0DF4 | ෴ | SINHALA PUNCTUATION KUNDDALIYA | කුණ්ඩලිය. සසඳන්න: U+11FFF TAMIL PUNCTUATION END OF TEXT. |
2f. සිංහලට අවශ්ය, කොටසෙන් පිටත ඇති අක්ෂර
| CP | නම | සිංහලයේ කාර්යය (U-SP, U-NS, SLS §4.3/§5) |
|---|---|---|
| 200D | ZERO WIDTH JOINER | ඕනෑම සංයුක්ත අකුරක් (බැඳි අකුරු), යංශයක්, රකාරාංශයක්, රේඵයක් හෝ ස්පර්ශ අකුරක් සෑදීමට අනිවාර්ය වේ. ZWJ නැතිව හල් ලකුණ සැමවිටම පෙනේ. |
| 200C | ZERO WIDTH NON-JOINER | SLS හි පමණි: ZWNJ + ස්වර ලකුණ මගින් එම ලකුණ තනිව පෙන්වයි (ා). ZWNJ ් ZWJ ය මගින් තනි යංශයක් ලැබේ. ර ් ZWJ ZWNJ මගින් තනි රේඵයක් ලැබේ. යුනිකේත පිරිවිතරයේ සිංහල කොටස ZWNJ ගැන සඳහන් නොකරයි (U-SP). |
| 00A0 | NO-BREAK SPACE | SLS එය ලැයිස්තුගත කරයි. තනි සංයෝජන ලකුණක් පෙන්වීමට පාදය ලෙස NBSP හෝ තිත් කවය යෙදීම යුනිකේත සම්මුතියයි. |
| 0964/0965 | DEVANAGARI DANDA / DOUBLE DANDA | සිංහලට විශේෂිත නොවේ. සමහර විට පාලි පෙළවල දැකිය හැක. සිංහල පෙළවල එහි භාවිතය ප්රකාශිත මූලාශ්රයකින් තහවුරු වී නැත (විසඳා නැත). සිංහල කොටසේ කේතනය කර නැත. |
3. වගුව 2: Sinhala Archaic Numbers (U+111E0–U+111FF), “සිංහල ඉලක්කම්”
ස්ථානීය අගයක් නැත, බිංදුවක් නැත (U-AN). 111E0 සහ 111F5–111FF පවරා නැත. WP-EN අනුව Unicode 7.0 (2014). මෙම කොටස සඳහා CP පරීක්ෂා කර නැත.
| CP | නම | CP | නම |
|---|---|---|---|
| 111E1 | SINHALA ARCHAIC DIGIT ONE | 111EA | SINHALA ARCHAIC NUMBER TEN |
| 111E2 | … DIGIT TWO | 111EB | … NUMBER TWENTY |
| 111E3 | … DIGIT THREE | 111EC | … NUMBER THIRTY |
| 111E4 | … DIGIT FOUR | 111ED | … NUMBER FORTY |
| 111E5 | … DIGIT FIVE | 111EE | … NUMBER FIFTY |
| 111E6 | … DIGIT SIX | 111EF | … NUMBER SIXTY |
| 111E7 | … DIGIT SEVEN | 111F0 | … NUMBER SEVENTY |
| 111E8 | … DIGIT EIGHT | 111F1 | … NUMBER EIGHTY |
| 111E9 | … DIGIT NINE | 111F2 | … NUMBER NINETY |
| 111F3 | … NUMBER ONE HUNDRED | ||
| 111F4 | … NUMBER ONE THOUSAND |
4. නීති සහ කරුණු: සංකේත සමූහය සහ කේතනය (INV-001 … INV-014)
INV-001: යුනිකේත අකුරු සමූහය
- ප්රකාශය: සිංහල කොටස ස්වතන්ත්ර ස්වර 18ක් (0D85–0D96) සහ ව්යඤ්ජන 41ක් (0D9A–0DC6, හිඩැස් සහිතව) කේතනය කරයි. සඤ්ඤක අකුරු 5, ඥ සහ ෆ ඇතුළුව සෑම ව්යඤ්ජනයක්ම එක් කේත ලක්ෂ්යයකි.
- උදාහරණ: ඟ = U+0D9F (ඞ්+ග නොවේ); ඥ = U+0DA5 (ඤ්ජ නොවේ).
- ව්යතිරේක: නැත.
- විශ්වාසය: ඉහළ. මූලාශ්ර: U-CH, SLS §5.2.
INV-002: ස්වතන්ත්ර ස්වර තනි ඒකක වේ
- ප්රකාශය: ස්වතන්ත්ර ස්වරයක් ගබඩා කළ යුත්තේ එහිම කේත ලක්ෂ්යය ලෙසයි. කිසිවිටෙක අ + ස්වර ලකුණ ලෙස නොවේ.
- උදාහරණ: ආ යනු U+0D86 මිස 0D85 0DCF නොවේ. ඒ යනු U+0D92 මිස එ + ් නොවේ.
- ව්යතිරේක: අකුරු ලියන ආකාරය අනුව SLS ආ යන්න අ + ා ලෙසත්, ඒ යන්න එ + ් ලෙසත් විස්තර කරයි. මෙය ලියන අනුපිළිවෙළ පමණි. ගබඩා කරන රූපය තනි කේත ලක්ෂ්යය විය යුතුය.
- විශ්වාසය: ඉහළ. මූලාශ්ර: SLS §5.1 note, §6.2.
INV-003: සංයුක්ත ස්වර ලකුණු සහ සාමාන්යකරණය
- ප්රකාශය: ේ ො ෝ ෞ යන ලකුණුවලට සම්මත වියෝජන ඇත (වගුව 2d). එබැවින් ඒවා සඳහා NFC සහ NFD වෙනස් වේ. පූර්ව සංයුක්ත තනි ලකුණ ගබඩා කරන්න.
- උදාහරණ: කෝ = 0D9A 0DDD. 0D9A 0DD9 0DCF 0DCA අනුක්රමයට යුනිකේත ඉඩ දෙයි. නමුත් SLS එය නොයොදන ලෙස උපදෙස් දෙයි.
- ව්යතිරේක: ෛ (0DDB) හට වියෝජනයක් නැත. කොම්බු දෙකක් (ෙෙ) සම්මත (canonical) වශයෙන් ෛ ට සමාන නොවේ. එබැවින් ඕනෑම පරිවර්තන හෝ සාමාන්යකරණ පියවරක් “කොම්බුව දෙවරක්” යන්න සෘජුවම 0DDB වෙත සිතියම්ගත කළ යුතුය.
- විශ්වාසය: ඉහළ. මූලාශ්ර: U-CH, SLS §5.4 note 2.
INV-004: හල් ලකුණ සහ සංයුක්ත අකුරු සෑදීම
- ප්රකාශය: හල් ලකුණ (්, 0DCA) සැමවිටම පෙනේ. එය තනිවම සංයුක්ත අකුරක් නොසාදයි. ව්යඤ්ජන පොකුරක් බැඳි අකුරක් හෝ සංක්ෂිප්ත රූපයක් බවට පත් වන්නේ C + ් + ZWJ + C යෙදූ විට පමණි.
- උදාහරණ: ක්ෂ = ක ් ZWJ ෂ (kssa). න්ද = න ් ZWJ ද. ක්ව = ක ් ZWJ ව.
- ව්යතිරේක: ස්පර්ශ අකුරු වෙනත් අනුපිළිවෙළක් යොදයි (INV-005).
- විශ්වාසය: ඉහළ. මූලාශ්ර: U-SP §13.2, SLS §5.8.
INV-005: ස්පර්ශ අකුරු (බැඳි අකුරු, පාලි ශෛලිය)
- ප්රකාශය: යුනිකේත ස්පර්ශ සංයුක්ත අකුරක් කේතනය කරන්නේ C + ZWJ + ් + C ලෙසයි. මෙහි ZWJ යෙදෙන්නේ හල් ලකුණට පෙරය.
- උදාහරණ: සිංහල අකුරින් ලියූ පාලි පෙළ. උදා: ධම්මචක්ක හි ක අකුරක් තවත් ක අකුරක් ස්පර්ශ කිරීම (අකුරු රූපයේ පමණි).
- ව්යතිරේක: ගැටුම: 2004 SLS කෙටුම්පත පවසන්නේ ස්පර්ශ අකුරුද සංයුක්ත අකුරු මෙන්ම 0DCA 200D අනුපිළිවෙළ යොදන බවයි.
- විශ්වාසය: මධ්යම (යුනිකේත ඉහළ; SLS අවසාන පෙළ දැක නැත). මූලාශ්ර: U-SP, SLS §5.8 note.
INV-006: යංශය, රකාරාංශය, රේඵය සඳහා නම් කළ අනුක්රම
- ප්රකාශය: සංක්ෂිප්ත රූප තුනකට ස්ථාවර අනුක්රම ඇත:
- යංශය (ව්යඤ්ජනයකට පසු ය) = 0DCA 200D 0DBA
- රකාරාංශය (ව්යඤ්ජනයකට පසු ර) = 0DCA 200D 0DBB
- රේඵය (ව්යඤ්ජනයකට පෙර ර) = 0DBB 0DCA 200D, ඊළඟ ව්යඤ්ජනයට පෙර තබයි
- උදාහරණ: ක්ය kya. ක්ර kra. ක්රෙ kre. කර්ම karma (රේඵ රූපය).
- ව්යතිරේක:
- රේඵය විකල්ප වේ: කර්ම සහ කර්ම දෙකම වලංගුය (SLS §3.5).
- SLS පවසන්නේ ර ට පසු යංශය නොලියන බවයි. ර + යංශය සහිත තම උදාහරණ අක්ෂර වින්යාසය SLS විසින්ම වැරදි ලෙස සලකුණු කරයි.
- විශ්වාසය: ඉහළ. මූලාශ්ර: U-NS, SLS §5.6–5.7.
INV-007: ZWJ ඉවත් කිරීමට අර්ථයක් ඇත
- ප්රකාශය: ZWJ ඉවත් කළ විට හල් ලකුණ පෙනෙන අක්ෂර වින්යාසයක් ලැබේ. මෙය වරදක් නොව පිළිගත් අක්ෂර වින්යාස තේරීමකි.
- උදාහරණ: ක්ය (ZWJ නැත) සහ ක්ය.
- ව්යතිරේක: නැත.
- විශ්වාසය: ඉහළ. මූලාශ්ර: SLS §5.6 note 2.
INV-008: අයෝගවාහ පසුපසින් එන සංයෝජන ලකුණු වේ
- ප්රකාශය: ං සහ ඃ සංයෝජන ලකුණුය. ඒවා ස්වරයකට, ආවේණික “අ” ස්වරය සහිත ව්යඤ්ජනයකට, හෝ ස්වර ලකුණකට පසුව යෙදේ. ඒවා සැමවිටම අක්ෂර පොකුරේ අවසාන අක්ෂරය වේ.
- උදාහරණ:
- අං = 0D85 0D82
- කං = 0D9A 0D82
- කොං = 0D9A 0DDD 0D82 (SLS හිම උදාහරණය)
- කුඃ = 0D9A 0DD4 0D83
- ව්යතිරේක: ඒවා කිසිවිටෙක හල් කළ ව්යඤ්ජනයකට පසු නොයෙදේ.
- විශ්වාසය: ඉහළ. මූලාශ්ර: SLS §3.3, §5.5.
INV-009: සන්දර්භය අනුව වෙනස් වන ස්වර ලකුණු රූපවලට එකම කේතයක් ඇත
- ප්රකාශය: හල් ලකුණේ සහ u/uu ලකුණුවල රූප භේද සියල්ල එකම කේත ලක්ෂ්යයෙන් කේතනය වේ.
- උදාහරණ:
- ක් හි හල් ලකුණ ට හි හල් ලකුණෙන් වෙනස් ලෙස පෙනේ. නමුත් දෙකම 0DCA ය.
- කු (0D9A 0DD4) හි u රූපය නු (0DB1 0DD4) හි රූපයෙන් වෙනස්ය.
- ක ග ඟ ත භ ශ ට පසුව සහ රකාරාංශයකට පසුව u/uu විකල්ප රූප ගනී.
- ව්යතිරේක: නැත.
- විශ්වාසය: ඉහළ. මූලාශ්ර: SLS §5.4, U-SP.
INV-010: අක්රමවත් බැඳි රූප සාමාන්ය අනුක්රම වේ
- ප්රකාශය: u සහ ae ලකුණු සමඟ ර සහ ළ අක්රමවත් බැඳි රූප ගනී. නමුත් ඒවා ගබඩා කරන්නේ සාමාන්ය ව්යඤ්ජනය + ලකුණ ලෙසමයි.
- උදාහරණ: රු = 0DBB 0DD4. රූ = 0DBB 0DD6. රැ = 0DBB 0DD0. ළු = 0DC5 0DD4.
- ව්යතිරේක: පහසුව සඳහා SLS ළු (“muurdhaja lu”) වෙනම රූපයක් ලෙස ලැයිස්තුගත කරයි. නමුත් ඊට වෙනම කේතයක් නැත.
- විශ්වාසය: ඉහළ. මූලාශ්ර: SLS §5.4, §6.1.
INV-011: චන්ද්රබින්දුව නූතන සිංහලට අයත් නොවේ
- ප්රකාශය: U+0D81 භාවිත වන්නේ පුරාතන සංස්කෘත පෙළ සඳහා පමණි. සාමාන්ය නූතන පෙළ අක්ෂර පරිවර්තනයේදී එය නොයෙදිය යුතුය.
- උදාහරණ: නැත
- ව්යතිරේක: නැත.
- විශ්වාසය: ඉහළ. මූලාශ්ර: U-SP, CP.
INV-012: ඉලක්කම් ක්රම දෙකකි; නූතන පෙළ යුරෝපීය ඉලක්කම් යොදයි
- ප්රකාශය:
- සිංහල ඉලක්කම් (Sinhala Illakkam, 111E1–111F4): පුරාතන ක්රමයකි, බිංදුවක් නැත, 10–90, 100 සහ 1000 සඳහා වෙනම ලකුණු ඇත. 1815 ට පෙර භාවිත විය. උඩරට ගිවිසුමේ (Kandyan Convention) වගන්ති අංක එයට උදාහරණයකි.
- සිංහල ලිත් ඉලක්කම් (Sinhala Lith Illakkam, 0DE6–0DEF): ජ්යොතිෂ ඉලක්කම්ය, ස්ථානීය අගය ඇත, බිංදුවක් ඇත. 20 වන සියවස දක්වා කේන්දර සඳහා භාවිත විය.
- එදිනෙදා සිංහල 0–9 යොදයි.
- උදාහරණ: නැත
- ව්යතිරේක: Disanayaka (ICTA/SLSI වෙනුවෙන්, 2008) තර්ක කළේ “පුරාතන” ඉලක්කම්වලද බිංදුවක් සහ ස්ථාන දරන සංකල්පයක් තිබූ බවයි. සංයුක්ත ඉලක්කම් 11 (10…1000) කේතනය කිරීමටද ඔහු විරුද්ධ විය. කෙසේ වෙතත් යුනිකේත ඒවා කේතනය කළේය.
- විශ්වාසය: ඉහළ (කේතනය); මධ්යම (ඓතිහාසික ප්රකාශ). මූලාශ්ර: U-CH, U-AN, U-L2, WP-NUM.
INV-013: කුණ්ඩලිය
- ප්රකාශය: ෴ (කුණ්ඩලිය, 0DF4) ඓතිහාසික නැවතීමේ ලකුණක් හෝ අලංකාර ලකුණකි. අද එය යෙදෙන්නේ ප්රධාන වශයෙන් ඡේදයක් අවසන් කිරීමට හෝ අලංකාරයටය. සමාජ මාධ්යවලද මෙය දැකිය හැක. නූතන විරාම ලකුණු බටහිර ඒවාය (. , ? !).
- උදාහරණ: නැත
- ව්යතිරේක: නැත.
- විශ්වාසය: ඉහළ. මූලාශ්ර: U-SP, SLS §4.2, WP-EN.
INV-014: යුනිකේත ඉතිහාසය
- ප්රකාශය:
- සිංහල කොටස (ෆ සහ ෴ ඇතුළුව): Unicode 3.0 (1999)
- ලිත් ඉලක්කම් 0DE6–0DEF සහ Archaic Numbers කොටස: Unicode 7.0 (2014)
- චන්ද්රබින්දුව 0D81: Unicode 13.0 (2020)
- ISO/IEC 10646 හි සිංහල කොටසට පදනම වූයේ SLS 1134 සහ එහි 2001 සංශෝධනයයි.
- උදාහරණ: නැත
- ව්යතිරේක: නැත.
- විශ්වාසය: ඉහළ (0D81/0DE6/0DC6 සඳහා CP); මධ්යම (පුරාතන කොටස). මූලාශ්ර: CP, SLS Foreword.
5. වගුව 3: හෝඩිය: ඉතිහාසය පුරා හෝඩි
| අවධිය | නම | ස්වර | ව්යඤ්ජන | එකතුව | වෙනස් වූ දේ | මූලාශ්ර | විශ්වාසය |
|---|---|---|---|---|---|---|---|
| 13 වන සියවස (දඹදෙණිය) | සිදත් සඟරා හෝඩිය | 10: අ ආ ඉ ඊ උ ඌ එ ඒ ඔ ඕ | 20: ක ග ජ ට ඩ ණ ත ද න ප බ ම ය ර ල ව ස හ ළ අං | 30 | සම්භාව්ය එළු. ඇ ඈ නැත, ච නැත, ං ව්යඤ්ජනයක් ලෙස ගණන් කර ඇත. | KLN, WP-SI, B-IH, B-S4 | ඉහළ |
| (පසුව) | එළු හෝඩිය / ශුද්ධ සිංහල (අමිශ්ර) හෝඩිය | 12 (ඇ ඈ එක් කරයි) | 20 | 32 | ඇ ඈ එක් කරයි. ඇ ඈ එක් කළ බව KLN පවසයි, නමුත් තවමත් 30 ලෙස දක්වයි (අභ්යන්තර නොගැළපීමකි). | B-IH, B-S4, WP-SI; KLN ගැටෙයි | මධ්යම |
| මහනුවර යුගය | වදන් කවි (වඩන කවි) හෝඩිය | 16 | 34 | 50 | පාලි/සංස්කෘත අකුරු එක් කරයි. 20 වන සියවස දක්වා පන්සල්වල ඉගැන්වීමට භාවිත විය (“පන්සල් හෝඩිය”). | KLN, B-IH | මධ්යම |
| 1891 (A. M. Gunasekara, Comprehensive Grammar) | මිශ්ර සිංහල හෝඩිය | 18 | 36 | 54 | වදන් කවි හෝඩියට අකුරු 4ක් එක් කරයි (KLN අනුව ඍ ඎ ඏ ඐ ඓ ඖ ශ ෂ …). Gunasekara ෆ අකුරද යෝජනා කළේය. | KLN, LD, WP-SI | මධ්යම |
| 1989 (NIE, මහරගම; Sinhala Lekhana Rītiya කමිටුව) | නූතන / සම්මත සිංහල හෝඩිය | 18 | 42 | 60 | ෆ සහ සඤ්ඤක අකුරු පහ (ඟ ඦ ඬ ඳ ඹ) එක් කරයි. ං ඃ ලියන්නේ අං අඃ ලෙසයි. ඥ ඇතුළත් නැත. | KLN, WP-SI, B-S4, LD, YM, ST | මධ්යම-ඉහළ |
| 1990 (J. B. Disanayaka) | සමකාලීන සිංහල හෝඩිය | - | - | (≈60) | ඏ ඐ සහ ඦ ඉවත් කරයි; ඥ එක් කරයි. නව “සංවෘත” ස්වර සංකේත ගැනද KLN සඳහන් කරයි. විස්තර පැහැදිලි නැත. | KLN, WP-SI | අඩු |
| 2004 (SLS 1134 rev. 2) / Unicode | කේතන සම්මතය | 18 | 41 + අර්ධ ව්යඤ්ජන 2 | 61 | යුනිකේත ව්යඤ්ජන 41ම, ඥ සහ ඦ දෙකම ඇතුළුව. | SLS §3 | ඉහළ |
INV-015: ශුද්ධ සහ මිශ්ර (නූතන අර්ථය)
- ප්රකාශය: දේශීය සිංහල වචන ලිවීමට “ශුද්ධ” (එළු) අකුරු ප්රමාණවත්ය. “මිශ්ර” හෝඩිය තත්සම (සංස්කෘත/පාලි) හෝ ඉංග්රීසි ණය වචන සඳහා පමණක් අවශ්ය අකුරු එක් කරයි: මහාප්රාණ අකුරු, අමතර ඌෂ්ම අකුරු, ඍ මාලාව සහ ඏ මාලාව, ඓ ඖ, ඃ, ඞ ඤ ඥ, සහ ෆ.
- ශුද්ධ (නූතන අර්ථයෙන්) = අ ආ ඇ ඈ ඉ ඊ උ ඌ එ ඒ ඔ ඕ + ක ග ච ජ ට ඩ ණ ත ද න ප බ ම ය ර ල ව ස හ ළ + ඟ ඬ ඳ ඹ + ං
- මිශ්ර = අකුරු 60/61 කට්ටලය
- උදාහරණ: දේශීය ගඟ (ganga, “ගංගාව”) ශුද්ධ අකුරු පමණක් යොදයි. තත්සම ගංගා (gangaa) ං යොදයි. ණය වචනයක් වන ධර්මය (dharmaya) සඳහා මිශ්ර අකුරක් වන ධ අවශ්ය වේ.
- ව්යතිරේක:
- සම්භාව්ය සිදත් සඟරා ලැයිස්තුවේ ච හෝ සඤ්ඤක අකුරු නැත. WP-EN හි “ශුද්ධ” කට්ටලයට ච සහ සඤ්ඤක අකුරු 4 ඇතුළත්ය. එයට හේතුව, එය නූතන ශබ්ද ඒකක (phonemes) විස්තර කිරීමයි.
- ණ සහ ළ තවදුරටත් වෙනම ශබ්ද ඒකක නොවුණත් ශුද්ධ අකුරු වේ.
- මිශ්ර අකුරු භාවිත කිරීම අර්ධ වශයෙන් සමාජ ගෞරවය (prestige) හෝ නිරුක්තිය පිළිබඳ කාරණයකි (WP-EN).
- විශ්වාසය: මධ්යම. මූලාශ්ර: WP-EN, WP-SI, KLN.
INV-016: “60 ද 61 ද” යන්නට හේතුව
- ප්රකාශය: නූතන ගණන පහත පරිදි සමගි කළ හැක:
- NIE 60 = ස්වර 18 + ව්යඤ්ජන 42. මේ 42 යනු ව්යඤ්ජන අකුරු 40 (වර්ග අකුරු 25 + සඤ්ඤක 5 + ය ර ල ව + ශ ෂ ස හ ළ ෆ) සහ ං, ඃ යන ලකුණු දෙකයි.
- SLS 61 = ස්වර 18 + ව්යඤ්ජන 41 (එම 40 + ඥ) + අර්ධ ව්යඤ්ජන 2.
- එබැවින් SLS 61 = NIE 60 + ඥ.
- උදාහරණ: නැත
- ව්යතිරේක:
- සාරාංශ ආකාරයෙන් පරිශීලනය කළ WP-SI හි 42 ලැයිස්තුවේ එක් අකුරක් අඩුය. 1989 දී ඦ එක් කළ බව KLN පවසන නිසා, අඩු වූයේ ඦ යැයි අනුමාන කෙරේ (Q2 බලන්න).
- සමහර මූලාශ්ර “18 + 42” යැයි කියන අතරම ඥ අකුරද ලැයිස්තුගත කරයි.
- විශ්වාසය: මධ්යම. මූලාශ්ර: SLS §3, KLN, WP-SI, YM.
INV-017: හෝඩියේ අනුපිළිවෙළ
- ප්රකාශය: සාම්ප්රදායික අනුපිළිවෙළ (යුනිකේත/SLS අනුගමනය කරයි):
- ස්වර: අ ආ ඇ ඈ ඉ ඊ උ ඌ ඍ ඎ ඏ ඐ එ ඒ ඓ ඔ ඕ ඖ
- අයෝගවාහ: ං ඃ (NIE ඒවා ස්වරවලට පසුව අං අඃ ලෙස තබයි)
- වර්ග පේළි, එක් එක් පේළියට පසු එහි සඤ්ඤක අකුර: ක ඛ ග ඝ ඞ ඟ / ච ඡ ජ ඣ ඤ ඥ ඦ / ට ඨ ඩ ඪ ණ ඬ / ත ථ ද ධ න ඳ / ප ඵ බ භ ම ඹ
- ය ර ල ව ශ ෂ ස හ ළ ෆ
- උදාහරණ: අකාරාදී පිළිවෙළට සැකසීමට (collation) උදව් වීමට SLS ං ඃ කේත පිටුවේ ආරම්භයේ (0D82–0D83) තැබීය.
- ව්යතිරේක: පිළිවෙළට සැකසීමට තවමත් ඒ සඳහාම වූ ඇල්ගොරිතමයක් අවශ්ය බව SLS අවවාද කරයි.
- විශ්වාසය: ඉහළ. මූලාශ්ර: U-CH, SLS §3.3 note 2, §4.
6. වගුව 4: පිලි (ස්වර ලකුණු සහ වෙනත් ඉරි): නම්
සෑම ස්වර ලකුණක්ම මතකයේ ගබඩා වන්නේ ව්යඤ්ජනයට පසුවයි. ලකුණ ව්යඤ්ජනයට පෙර ඇඳෙන විටත් (ෙ) එසේමය. සිංහල නම් ලබා ගත්තේ SLS Table 1 සහ §6.1 (රෝමානුකෘත), යුනිකේත නම් සහ B-BN වෙතිනි. එදිනෙදා භාවිත වන විකල්ප නම් “/” මගින් වෙන් කර ඇත.
| CP | ලකුණ | ස්වර ID | සිංහල නම(නම්) | රෝමානුකෘත (SLS/Unicode) | පිහිටීම | සටහන් |
|---|---|---|---|---|---|---|
| 0DCA | ් | hal | හල් ලකුණ / හල් කිරීම / ඇල (al) | al-lakuna (virama) | උඩින් / සම්බන්ධව | “හල් කිරීම” යනු ස්වරය ඉවත් කිරීමේ ක්රියාවේ නමයි. ලකුණ ඇල/හල් ලකුණ වේ. අකුරු රූප දෙකක් ඇත (ක මත සහ ට මත), නමුත් කේතය එකකි. |
| 0DCF | ා | aa | ඇලපිල්ල | aela-pilla | දකුණේ | |
| 0DD0 | ැ | ae | කෙටි ඇදය / කෙටි ඇදපිල්ල | ketti aeda-pilla | දකුණේ පහළ | |
| 0DD1 | ෑ | aee | දිග ඇදය / දිග (දික්) ඇදපිල්ල | diga aeda-pilla | දකුණේ පහළ | |
| 0DD2 | ි | i | කෙටි ඉස්පිල්ල | ketti is-pilla | උඩින් | |
| 0DD3 | ී | ii | දිග (දික්) ඉස්පිල්ල | diga is-pilla | උඩින් | |
| 0DD4 | ු | u | කෙටි පාපිල්ල (වක් රූපය: කෙටි වක් පාපිල්ල) | ketti paa-pilla 1 / 2 | යටින් | SLS රූප දෙකක් දක්වයි (7, 7a). ක ග ත … ට පසු එන වක් රූපයට B-BN “වක් පාපිල්ල” යන නම යොදයි. |
| 0DD6 | ූ | uu | දිග පාපිල්ල (වක් රූපය: දිග වක් පාපිල්ල) | diga paa-pilla 1 / 2 | යටින් | |
| 0DD8 | ෘ | ru | ගැටපිල්ල / කෙටි ගැටපිල්ල | gaetta-pilla | දකුණේ | |
| 0DF2 | ෲ | ruu | දිග ගැටපිල්ල / ගැටපිලි දෙක | diga gaetta-pilla | දකුණේ | දුර්ලභ (පිතෲ). |
| 0DD9 | ෙ | e | කොම්බුව | kombuva | වමේ (ව්යඤ්ජනයට පෙර) | ව්යඤ්ජනයට පෙර ලියයි, නමුත් ගබඩා කරන්නේ එයට පසුවයි. |
| 0DDA | ේ | ee | කොම්බුව හා හල් ලකුණ / දිග කොම්බුව (B-BN: කොම්බුව හා උස්පිල්ල) | diga kombuva | වමේ + උඩින් | ≡ ෙ + ් |
| 0DDB | ෛ | ai | කොම්බු දෙක (ද්විත්ව කොම්බුව) | kombu deka | වමේ | |
| 0DDC | ො | o | කොම්බුව හා ඇලපිල්ල | kombuva haa aela-pilla | කොටස් දෙකකින් | ≡ ෙ + ා |
| 0DDD | ෝ | oo | කොම්බුව හා දිග ඇලපිල්ල | kombuva haa diga aela-pilla | කොටස් දෙකකින් | ≡ ො + ් |
| 0DDE | ෞ | au | කොම්බුව හා ගයනුකිත්ත | kombuva haa gayanukitta | කොටස් දෙකකින් | ≡ ෙ + ෟ |
| 0DDF | ෟ | ilu | ගයනුකිත්ත | gayanukitta | දකුණේ | තනිව යෙදූ විට එය ස්වරීය l (vocalic l) නිරූපණය කරයි. මෙම භාවිතය දැන් නැත. ෞ සහ ඖ හි කොටසක් ලෙස එය භාවිත වේ. |
| 0DF3 | ෳ | iluu | දිග ගයනුකිත්ත / ගයනුකිති දෙක | diga gayanukitta | දකුණේ | භාවිත නොවේ (SLS note 4). |
| 0D82 | ං | - | බින්දුව / අනුස්වාරය | anusvaraya | දකුණේ | අයෝගවාහ |
| 0D83 | ඃ | - | විසර්ගය | visargaya | දකුණේ | අයෝගවාහ |
| (අනුක්රමය) | ්ය | - | යංශය | yansaya | දකුණේ | “ස්වරීය නොවන ඉර” (SLS) |
| (අනුක්රමය) | ්ර | - | රකාරාංශය | rakaransaya | යටින් | |
| (අනුක්රමය) | ර් | - | රේඵය | repaya | ඊළඟ ව්යඤ්ජනයට උඩින් |
INV-018: SLS table 2 හි පිලි
- ප්රකාශය: සෑම ව්යඤ්ජනයකටම ස්වරීය රූප 17ක් සමඟ එක් විය හැක: හල්, ආවේණික “අ”, සහ ස්වර ලකුණු 15. ෟ සහ ෳ භාවිතයෙන් ඉවත් වූ නිසා බැහැර කර ඇත.
- යංශය සමඟ: වලංගු ස්වර සංයෝජන 8යි. රකාරාංශය සමඟ: 12යි.
- ං හෝ ඃ එක් කළ විට එක් ව්යඤ්ජනයකට “හැකි අකුරු 109” යන SLS සංඛ්යාව ලැබේ.
- උදාහරණ: ක් ක කා කැ කෑ කි කී කු කූ කෘ කෲ කෙ කේ කෛ කො කෝ කෞ. යංශ කට්ටලය: ක්ය ක්යා ක්යු ක්යූ ක්යෙ ක්යේ ක්යො ක්යෝ.
- ව්යතිරේක:
- SLS: සෑම සංයෝජනයක්ම සෑම ව්යඤ්ජනයකටම වලංගු නොවේ. ඞ යෙදෙන්නේ ඞ් ලෙස පමණි.
- SLS හි යංශ වගුවේ kyu/kyuu ඇත. ප්රායෝගිකව ඒවා දුර්ලභය.
- විශ්වාසය: ඉහළ (SLS අර්ථ දක්වන පරිදි). මූලාශ්ර: SLS §3.4–3.5, Tables 1–3.
7. වගුව 5: අකුරු වර්ගීකරණය
7a. ස්වර
| වර්ගය | සිංහල පදය | සාමාජිකයන් (IDs) | විශ්වාසය |
|---|---|---|---|
| කෙටි | හ්රස්ව | අ ඇ ඉ උ ඍ ඏ එ ඔ (a ae i u ru ilu e o) | ඉහළ |
| දිගු | දීර්ඝ | ආ ඈ ඊ ඌ ඎ ඐ ඒ ඕ (aa aee ii uu ruu iluu ee oo) | ඉහළ |
| ද්විස්වර (diphthong) | සන්ධ්යක්ෂර / සංයුක්ත ස්වර | ඓ ඖ (ai au). සාමාන්යයෙන් දිගු ස්වර සමඟ ගණන් කරයි. | මධ්යම |
| ඉන්දීය අක්ෂර ක්රම අතර සිංහලට පමණක් ආවේණික | - | ඇ ඈ (ae aee). SLS: "unique to the Sinhala language… since the 7th century". | ඉහළ (SLS) |
| ශබ්ද සහ අකුරු | - | SLS: සංකේත 61 මගින් ශබ්ද 40ක් නිරූපණය කරයි (ස්වර 14 + ව්යඤ්ජන 26). | ඉහළ (ප්රකාශයක් ලෙස) |
7b. ව්යඤ්ජන: වර්ග ජාලය (උච්චාරණ ස්ථානය × උච්චාරණ ආකාරය)
| වර්ගය (සිංහල) | උච්චාරණ ස්ථානය (සිංහල) | අඝෝෂ අල්පප්රාණ | අඝෝෂ මහාප්රාණ | ඝෝෂ අල්පප්රාණ | ඝෝෂ මහාප්රාණ | නාසික (වර්ගාන්ත / අනුනාසික) | සඤ්ඤක (prenasalised) |
|---|---|---|---|---|---|---|---|
| ක වර්ගය | කණ්ඨජ (velar) | ක ka | ඛ kha | ග ga | ඝ gha | ඞ nga | ඟ nnga |
| ච වර්ගය | තාලුජ (palatal) | ච ca | ඡ cha | ජ ja | ඣ jha | ඤ nya | ඦ nyja |
| ට වර්ගය | මූර්ධජ (retroflex) | ට tta | ඨ ttha | ඩ dda | ඪ ddha | ණ nna | ඬ nndda |
| ත වර්ගය | දන්තජ (dental) | ත ta | ථ tha | ද da | ධ dha | න na | ඳ nda |
| ප වර්ගය | ඕෂ්ඨජ (labial) | ප pa | ඵ pha | බ ba | භ bha | ම ma | ඹ mba |
වර්ගවලට අයත් නොවන ව්යඤ්ජන:
| වර්ගය | සිංහල පදය | සාමාජිකයන් | උච්චාරණ ස්ථානය | විශ්වාසය |
|---|---|---|---|---|
| අර්ධ ස්වර / ද්රව ව්යඤ්ජන | අන්තස්ථ | ය ya (තාලුජ), ර ra (මූර්ධජ/වර්ත්ස්ය), ල la (දන්තජ), ව va (දන්තෝෂ්ඨජ) | - | ඉහළ |
| ඌෂ්ම / ඝර්ෂණ ව්යඤ්ජන | ඌෂ්ම | ශ sha (තාලුජ), ෂ ssa (මූර්ධජ), ස sa (දන්තජ), හ ha (කණ්ඨජ/කාකලජ). B-AK ඃ සහ ෆ ද ලැයිස්තුගත කරයි (මුළු 6ක්). | - | මධ්යම (සාමාජිකයන් 4 ලැයිස්තුව ඉහළ; සාමාජිකයන් 6 ලැයිස්තුව එක් බ්ලොග් අඩවියකින්) |
| මූර්ධජ පාර්ශ්වික | - | ළ lla (මූර්ධජ). සාම්ප්රදායිකව වර්ග අකුරුවලින් වෙන් කර සලකයි. | මූර්ධජ | ඉහළ |
| දන්තෝෂ්ඨජ | දන්තෝෂ්ඨජ | ව va, ෆ fa | - | මධ්යම |
| කණ්ඨතාලුජ / කණ්ඨෝෂ්ඨජ ස්වර | කණ්ඨතාලුජ / කණ්ඨෝෂ්ඨජ | එ ඒ ඓ / ඔ ඕ ඖ (සංස්කෘත සම්ප්රදාය) | - | මධ්යම |
| ඥ jnya | තාලුජ සංයෝග නාසිකය | ඓතිහාසිකව ජ්+ඤ පොකුරයි. නූතන කථනයේ [gn]/[gɲ] ලෙස උච්චාරණය වේ. | තාලුජ | මධ්යම |
INV-019: අල්පප්රාණ / මහාප්රාණ
- ප්රකාශය: සෑම වර්ගයකම අල්පප්රාණ ස්පර්ශ ව්යඤ්ජන දෙකක් සහ මහාප්රාණ ස්පර්ශ ව්යඤ්ජන දෙකක් ඇත.
- මහාප්රාණ = ඛ ඝ ඡ ඣ ඨ ඪ ථ ධ ඵ භ (10)
- අල්පප්රාණ = ක ග ච ජ ට ඩ ත ද ප බ (10)
- නූතන සිංහල කථනයේ මහාප්රාණ ගුණය උච්චාරණය නොවේ. අකුර තෝරා ගැනීම නිරුක්තිය මත රඳා පවතී (අක්ෂර වින්යාසයේ පමණි).
- උදාහරණ: ධර්මය උච්චාරණය වන්නේ darmaya මෙනි. කථාව සහ කතාව දෙකම දැකිය හැක. නිවැරදි අක්ෂර වින්යාසය ගැන වාදයක් ඇත.
- ව්යතිරේක: නාසික, අර්ධ ස්වර, ඌෂ්ම අකුරු සහ හ මේ දෙකෙන් කිසිවකට අයත් නොවේ (සමහර ව්යාකරණවල ඒවා අල්පප්රාණ ලෙස සලකයි).
- විශ්වාසය: ඉහළ (වර්ග); ඉහළ (මහාප්රාණය ශබ්ද ඒකක මට්ටමින් නැත, WP-EN). මූලාශ්ර: B-AK, U-CH names, WP-EN.
INV-020: ඝෝෂ / අඝෝෂ (නාද ගුණය)
- ප්රකාශය:
- අඝෝෂ (නාද රහිත) = එක් එක් වර්ගයේ පළමු අකුරු දෙක (ක ඛ ච ඡ ට ඨ ත ථ ප ඵ) + ශ ෂ ස (සාදෘශ්යයෙන් + ෆ, ඃ)
- ඝෝෂ (නාද සහිත) = ඉතිරි වර්ග අකුරු, නාසික, සඤ්ඤක අකුරු, ය ර ල ව, හ, ළ, සහ සියලු ස්වර
- උදාහරණ: නැත
- ව්යතිරේක: සංස්කෘත ශබ්ද විද්යාවේ හ සාම්ප්රදායිකව ඝෝෂ අකුරකි. සිංහල මූලාශ්රද එය අනුගමනය කරයි. ප්රාථමික සිංහල පෙළපොතකින් මෙය තහවුරු වී නැත (විවෘත; Q10 බලන්න).
- විශ්වාසය: මධ්යම. මූලාශ්ර: B-AK (තහවුරු කිරීමට පමණි); සංස්කෘත සම්ප්රදාය.
INV-021: සඤ්ඤක (අර්ධ නාසික) අකුරු
- ප්රකාශය: සඤ්ඤක ස්පර්ශ ව්යඤ්ජන 5ක් ඇත: ඟ ඦ ඬ ඳ ඹ (“අර්ධ නාසික”; SLS ඒවා nng, ndj, nnd, nd, mb ලෙස රෝමානුකරණය කරයි). එක් එක් අකුර තනි අකුරක් සහ තනි කේත ලක්ෂ්යයකි. සිංහලය ඒවා සලකන්නේ එක් ඛණ්ඩයක් ලෙසයි. සම්පූර්ණ නාසිකයක් සහ ස්පර්ශයක් එක්වීමෙන් ලැබෙන ශබ්දයෙන් ඒවා වෙනස්ය.
- උදාහරණ:
- අඟල (anngala) සහ අංග (anga)
- සඳ (sanda, “චන්ද්රයා”) සහ සන්ද (sanda, පුද්ගල නාමයක්)
- කඬ / හඬ (hanndda); අඹ (amba)
- ව්යතිරේක: ඦ කිසිදා භාවිත නොවේ. දේශීය වචනවල අක්ෂර වින්යාසය ඳ ආදිය යොදයි; තත්සම වචන න්ද ආදිය යොදයි.
- විශ්වාසය: ඉහළ. මූලාශ්ර: SLS §3, U-CH, WP-EN.
8. වගුව 6: දුර්ලභ, භාවිතයෙන් ඉවත් වූ, පාලි/සංස්කෘත පමණක් වූ, සහ විදේශීය ශබ්ද සඳහා වූ අකුරු
| අකුර | ID | තත්ත්වය | සාමාන්ය භාවිත ක්ෂේත්රය | උදාහරණය | විශ්වාසය | මූලාශ්රය |
|---|---|---|---|---|---|---|
| ඏ ඐ | ilu iluu | භාවිතයෙන් ඉවත් වූ; SLS ඒවා තබා ගන්නේ “සම්පූර්ණත්වය සඳහා” පමණි; Disanayaka 1990 ඒවා ඉවත් කළේය | සංස්කෘත ව්යාකරණය | (ඏකාරය උපුටා දැක්වීමක් ලෙස පමණි) | ඉහළ | SLS, KLN, YM |
| ෟ (තනිව), ෳ | ilu iluu ලකුණු | භාවිතයෙන් ඉවත් වූ (ෟ ෞ/ඖ තුළ පවතී) | - | - | ඉහළ | SLS note 4 |
| ඎ | ruu | අකුර භාවිතයෙන් ඉවත් වී ඇත; ෲ ලකුණ සංස්කෘත වචන කිහිපයක යෙදේ | සංස්කෘත | මාතෲ (NLPC 65; මාතෘ හි ෘ වඩා සුලබය, NLPC 2,103), පිතෲ (දුර්ලභ: NLPC නිවැරදි රූපය 0, විභක්ති සහිතව 4) | මධ්යම | SLS note 3; NLPC |
| ඍ / ෘ | ru | තත්සම වචනවල භාවිතයේ | සංස්කෘත | ඍතුව, කෘෂිකර්ම, වෘක්ෂ, ගෘහ | ඉහළ | SLS, WP-EN |
| ඓ ඖ / ෛ ෞ | ai au | භාවිතයේ, සංඛ්යාතය අඩුයි | සංස්කෘත | ඓතිහාසික, වෛද්ය, ඖෂධ, පෞද්ගලික | ඉහළ | - |
| ඃ | - | දුර්ලභ | සංස්කෘත | දුඃඛ, අතඃපුර | මධ්යම | - |
| ඁ | - | නූතන සිංහලට නොවේ | පුරාතන සංස්කෘත | - | ඉහළ | U-SP |
| ඞ | nga | දුර්ලභ; කණ්ඨජ අකුරකට පෙර ඞ් ලෙස පමණි | පාලි/සංස්කෘත | වාඞ්මය, සඞ්ඝ (පාලි) | මධ්යම | SLS |
| ඤ | nya | භාවිතයේ | පාලි/සංස්කෘත + දේශීය | ඤාණ, සඤ්ඤා | ඉහළ | SLS |
| ඥ | jnya | භාවිතයේ (“විශේෂඥයා” අරුත දෙන -ඥ වචනවල සංඛ්යාතය ඉහළයි) | සංස්කෘත | ඥාති, විශේෂඥ, නීතිඥ, ප්රඥා | ඉහළ | SLS, YM |
| ඦ | nyja | කිසිදා භාවිත නොවේ | - | - | ඉහළ | SLS, WP-EN |
| ඣ ඪ | jha ddha | ඉතා දුර්ලභ | පාලි/සංස්කෘත | ඣාන (jhāna) | මධ්යම | - |
| ඨ ඵ | ttha pha | දුර්ලභ | සංස්කෘත | ශ්රේෂ්ඨ, ඵල | ඉහළ | - |
| ෆ | fa | භාවිතයේ; ඉංග්රීසි/විදේශීය /f/ | ඉංග්රීසි | ෆැෂන්, ෆ්රාන්සය | ඉහළ | LD, WP-EN |
| ඇ ඈ / ැ ෑ | ae aee | දේශීය ස්වර වේ; ඉංග්රීසි /æ/ සඳහා පෙරනිමියද මේවාය | ඉංග්රීසි ණය වචන | බැංකුව (bank), කැෆේ | ඉහළ | SLS §3 |
| ෂ | ssa | ණය වචනවල; ඉංග්රීසි /ʃ/ සඳහා සාමාන්යයෙන් යොදන අකුරද වේ | ඉංග්රීසි | ෂෝ (show, NLPC 2,006), ෂර්ට් (shirt, NLPC 2,195) | මධ්යම | NLPC (භාවිතය); ප්රකාශිත සම්මතයක සංග්රහ කර නැත |
| (නැත) | z | /z/ සඳහා අකුරක් නැත. සාමාන්යයෙන් ස යොදා ලියයි (සමහර විට ශ/ජ). | ඉංග්රීසි | සූ (zoo), සීරෝ (zero, NLPC 104) | මධ්යම | YM; NLPC (භාවිතය) |
INV-022: ෆ අකුරේ ඉතිහාසය
- ප්රකාශය: A. M. Gunasekara ෆ මුලින්ම යෝජනා කළේ ඔහුගේ 1891 ව්යාකරණ ග්රන්ථයේය. 1897 දී ඔහු එය මුද්රණයේ භාවිත කළේය. NIE ලේඛන රීති කමිටුව එය 1989 දී නිල වශයෙන් පිළිගත්තේය. ඊට පෙර ලේඛකයෝ ප යෙදූහ.
- උදාහරණ: ප්රැන්සිස් → ෆ්රැන්සිස් (Francis).
- ව්යතිරේක: රජයේ කාර්යාල තවමත් නිල ලේඛනවල ෆ පිළිනොගන්නා බව ලංකාදීප වෙබ් අඩවියේ අදහස් දැක්වූ අයෙකු කියා සිටී. නිල මූලාශ්රයකින් තහවුරු වී නැත (විසඳා නැත).
- විශ්වාසය: මධ්යම-ඉහළ. මූලාශ්ර: LD, KLN, WP-SI.
INV-023: අකුරු අතර උච්චාරණය එක් වීම
- ප්රකාශය: නූතන සිංහලයේ අකුරු යුගල කිහිපයක් එක ලෙස උච්චාරණය වේ. වෙනස ඇත්තේ අක්ෂර වින්යාසයේ පමණි:
- ණ/න සහ ළ/ල එක ලෙස උච්චාරණය වේ
- ශ/ෂ දෙකම [ʃ] ලෙස උච්චාරණය වේ
- සෑම මහාප්රාණ අකුරක්ම එහි අල්පප්රාණ යුගලය මෙන් උච්චාරණය වේ
- ඤ/ඥ එක ලෙස ඇසෙන්නේ වචනයේ මුලදී පමණි. වෙනත් තැන්වල ඥ ව්යඤ්ජන ශබ්ද දෙකක් ලෙස හැසිරේ (SLS).
- උදාහරණ: ඥාන ~ ඤාණ (වචනයේ මුලදී). ප්රඥා (මුලදී නොවේ).
- ව්යතිරේක: නැත.
- විශ්වාසය: ඉහළ (ණ/ළ/මහාප්රාණ, WP-EN, YM, SLS). මූලාශ්ර: SLS §3.2 note 2, WP-EN, YM.
9. ඉලක්කම් සහ විරාම ලකුණු (සාරාංශය)
| ක්රමය | පරාසය | බිංදුව | ස්ථානීය අගය | භාවිත කාලය | තත්ත්වය |
|---|---|---|---|---|---|
| සිංහල ඉලක්කම් (පුරාතන) | 111E1–111F4 | නැත (යුනිකේත). Disanayaka 2008 මෙයට විරුද්ධ විය. | නැත | 1815 දක්වා, සහ සමහර පුස්කොළ පොත්වල | ඓතිහාසික |
| සිංහල ලිත් ඉලක්කම් | 0DE6–0DEF | ඇත (අකුරු රූපය හල් ලකුණට සමානයි) | ඇත | 20 වන සියවස දක්වා කේන්දරවල | විශේෂඥ භාවිතය |
| යුරෝපීය ඉලක්කම් | 0030–0039 | ඇත | ඇත | නූතන | පෙරනිමිය |
| කුණ්ඩලිය ෴ | 0DF4 | - | - | ඓතිහාසික නැවතීමේ ලකුණ | අලංකාරය සඳහා |
10. රෝමානුකරණයට සහ අක්ෂර පරිවර්තනයට ඇති බලපෑම්
ලතින් අකුරින් ලියූ රෝමානුකරණයක් සහ සිංහල අකුරු අතර පරිවර්තනය කරන ඕනෑම අයෙකුට, හෝ ගබඩා කළ සිංහල පෙළ වලංගු දැයි පරීක්ෂා කරන ඕනෑම අයෙකුට මෙම කරුණු අදාළ වේ.
- තනි කේත ලක්ෂ්ය භාවිත කරන්න.
- ZWJ අක්ෂර වින්යාසයේ කොටසකි.
- රෝමානුකරණයකට පහත දේ සඳහා පැහැදිලි, පුරෝකථනය කළ හැකි අනුරූපතා අවශ්ය වේ:
- සංයුක්ත අකුරු (C ් ZWJ C)
- යංශය (C ් ZWJ ය)
- රකාරාංශය (C ් ZWJ ර)
- රේඵය (ර ් ZWJ C)
- විකල්ප ලෙස ස්පර්ශ අකුරු (C ZWJ ් C)
- පොදු නූතන භාවිතයේදී
C+ya/C+raසඳහා සහ ක්ෂ සඳහා ZWJ යොදයි. නමුත් ඕනෑම පොකුරකට එය නොයොදයි. - හල් ලකුණ පෙනෙන අක්ෂර වින්යාසයක් (ZWJ නැති) නිරූපණය කිරීමට තවමත් හැකි විය යුතුය (INV-007).
- රෝමානුකරණයකට පහත දේ සඳහා පැහැදිලි, පුරෝකථනය කළ හැකි අනුරූපතා අවශ්ය වේ:
- සඤ්ඤක සහ නාසික+ස්පර්ශ අතර වෙනස සැබෑ ප්රතිවිරෝධයකි.
nnga,nndda,nda,mbaයන්නn+g,n+d,m+bවලින් වෙන්ව තබා ගත යුතුය (INV-021).- උදාහරණයක් ලෙස, රෝමානුකරණයක් අඟල සහ අංගය අතරත්, සඳ සහ සන්ද අතරත් වෙනස හඳුනාගත යුතුය.
- අයෝගවාහ ං ස්වරයට පසුව එයි.
aṁඕනෑම ස්වර ලකුණකට පසු එන ං ට අනුරූප වේ. ං සහ ඃ කිසිවිටෙක හල් කළ ව්යඤ්ජනයකට පසු නොඑයි (INV-008). ං ඉතා බහුලයි; ඃ දුර්ලභයි. - බොහෝ අකුරු අතර වෙනස අක්ෂර වින්යාසයේ පමණි (INV-019, INV-023): මහාප්රාණ අකුරු, ණ/න, ළ/ල, ශ/ෂ.
- ආපසු හැරවිය හැකි රෝමානුකරණයකට ඒවා සඳහා වෙනම සංකේත අවශ්ය වේ (උදා:
kh,N,L,sh/Sh). එසේ නැත්නම් සිංහලට පරිවර්තනය කිරීමට ශබ්දකෝෂයක් අවශ්ය වේ. - උච්චාරණයෙන් පමණක් ඒවා නැවත හඳුනාගත නොහැක.
- ආපසු හැරවිය හැකි රෝමානුකරණයකට ඒවා සඳහා වෙනම සංකේත අවශ්ය වේ (උදා:
- සංකේත සමූහය ස්තරවලට බෙදන්න. සාමාන්ය නූතන පෙළ සඳහා භාවිතයේ ඇති කට්ටලය ප්රමාණවත්ය.
- සංඛ්යාතය අඩු: ඍ/ෘ, ඓ ඖ, ඃ, ඞ, ඣ ඪ, ෲ.
- සාමාන්ය නූතන පෙළේ අක්ෂර පරිවර්තනවල ඏ ඐ ෟ(තනිව) ෳ ඁ ඦ නොයෙදිය යුතුය (INV-011, වගුව 6). ඒවා අයත් වන්නේ පුරාතන හෝ සංස්කෘත පෙළටය.
- විදේශීය ශබ්ද.
- /f/ → ෆ
- ඉංග්රීසි /æ/ → ඇ ඈ / ැ ෑ
sh→ ෂ හෝ ශ, වචනය අනුව තීරණය වේ- /z/ ට අනුරූප අකුරක් නැත. රෝමානුකරණයක් තම ප්රතිපත්තිය පැහැදිලිව සඳහන් කළ යුතුය (උදා: ස වෙත සිතියම්ගත කිරීම). සමහර දැනට පවතින රෝමානුකරණ ක්රම ඇ සඳහා
zයොදන බව සලකන්න.
- අක්රමවත් අකුරු රූප සාමාන්ය අනුක්රම වේ. රු රූ රැ ළු සඳහා විශේෂ කේත අවශ්ය නැත. ඒවා හසුරුවන්නේ අකුරු මුහුණතයි (INV-010).
- කොම්බුව මුලින් ලියයි, නමුත් පසුව ගබඩා කරයි. රෝමානුකරණයක් ස්වභාවයෙන්ම තාර්කික අනුපිළිවෙළට පවතී (
ke= ක + ෙ). එය ගබඩා කරන අනුපිළිවෙළට ගැළපේ. - ඉලක්කම්. නූතන පෙළ යුරෝපීය ඉලක්කම් යොදයි. ලිත් ඉලක්කම් සහ ෴ විශේෂඥ හෝ අලංකාර අක්ෂර වේ.
11. විසඳා නැති ප්රශ්න / ගැටෙන මූලාශ්ර
| # | ප්රශ්නය | ගැටෙන මූලාශ්ර | තත්ත්වය |
|---|---|---|---|
| Q1 | නූතන හෝඩියේ අකුරු 60 ද 61 ද, ඥ එයට අයත්ද? | NIE 1989 = 60 (ඥ නැත, KLN/WP-SI/YM අනුව) සහ SLS 1134 = 61 (ඥ සහිතව) | INV-016 හි සමගි කළ උපකල්පනය. NIE 6 ශ්රේණියේ පෙළපොත සමඟ තහවුරු කරන්න. |
| Q2 | ඦ 60 තුළ තිබේද? | KLN: NIE 1989 සඤ්ඤක පහෙන් එකක් ලෙස එක් කළේය; WP-SI 42 ලැයිස්තුව (සාරාංශ ආකාරයෙන් පරිශීලනය කළ) එය අතහැර ඇත; Disanayaka 1990 එය ඉවත් කළ බව වාර්තා වේ | විසඳා නැත |
| Q3 | ශුද්ධ / එළු ගණන: 30 ද 32 ද? එයට ච සහ සඤ්ඤක අකුරු ඇතුළත්ද? | සිදත් සඟරා ලැයිස්තුවේ ච/සඤ්ඤක නැත (WP-SI, KLN). WP-EN හි “ශුද්ධ” කට්ටලයට ච සහ ඟ ඬ ඳ ඹ ඇතුළත්ය. ඇ ඈ එක් කළ පසුවත් එළු = 30 බව KLN පවසයි; B-IH/B-S4 32 යැයි කියයි. | මධ්යම. අර්ථ දැක්වීම් දෙකක් ඇත: සම්භාව්ය අර්ථය සහ ශබ්ද ඒකක මත පදනම් වූ අර්ථය. |
| Q4 | මිශ්ර 54 හි දැනටමත් සඤ්ඤක අකුරු තිබුණාද? | B-IH: ඔව් (ඟ ඦ ඬ ඳ ඹ). KLN: සඤ්ඤක එක් කළේ 1989 දී පමණි. | විසඳා නැත |
| Q5 | වදන් කවි හෝඩියේ අකුරු ලැයිස්තුව (16 + 34) | මූලාශ්ර දෙන්නේ ගණන් පමණි, ලැයිස්තුවක් නැත | විසඳා නැත |
| Q6 | ස්පර්ශ අකුරු කේතනය: ZWJ හල් ලකුණට පෙරද පසුද | Unicode: C ZWJ ් C. SLS 2004 කෙටුම්පත: C ් ZWJ C | යුනිකේත බලපවත්වයි. අවසාන SLS පෙළ දැක නැත. |
| Q7 | Disanayaka 1990 “සමකාලීන” හෝඩිය: නිවැරදි අන්තර්ගතය සහ “සංවෘත ස්වර” එකතු කිරීම් | KLN පමණි, එහි ලබා ගත හැකි පෙළද මේ කරුණ ගැන පැහැදිලි නැත | විශ්වාසය අඩුයි |
| Q8 | ඌෂ්ම කට්ටලය: 4 (ශ ෂ ස හ) ද 6 (+ ඃ ෆ) ද? | සංස්කෘත සම්ප්රදාය: 4. B-AK බ්ලොග් අඩවිය: 6 | විසඳා නැත (පෙළපොතකින් තහවුරු වී නැත) |
| Q9 | ඇ ඈ හි උච්චාරණ ස්ථානය, සහ පාසල් ව්යාකරණයේ ය ර ල ව සඳහා ස්ථාන නියම කර තිබේද යන්න | මූලාශ්රයක් හමු නොවීය | විසඳා නැත |
| Q10 | සිංහල පාසල් ව්යාකරණයේ හ, සඤ්ඤක අකුරු සහ නාසික ඝෝෂ/අඝෝෂ අතර කොතැනට අයත් ද | සංස්කෘත ක්රමයෙන් අනුමාන කර ඇත | විසඳා නැත |
| Q11 | සිංහල අකුරින් සාම්ප්රදායික නම් (උදා: “මහාප්රාණ කයන්න” සහ “බයානු කයන්න”; “තාලුජ නාසිකය” සහ “තාලුජ නාසික්යය”) | යුනිකේත/SLS දෙන්නේ රෝමානුකෘත රූප පමණි; වගුව 1 හි සිංහල අක්ෂර වින්යාසය මෙම අධ්යයනය සඳහා සිංහලට හැරවූ ඒවාය | මධ්යම |
| Q12 | පිලිවල විකල්ප නම්: ඇදය සහ ඇදපිල්ල; දිග සහ දික්; පෙළපොත්වල ේ “කොම්බුව හා හල් ලකුණ” ද “දිග කොම්බුව” ද යන්න | SLS/Unicode සහ B-BN | මධ්යම |
| Q13 | පුරාතන ඉලක්කම්වල බිංදුවක් තිබුණාද? | යුනිකේත වගුව: නැත. Disanayaka/ICTA 2008: ඔව් (පුස්කොළ සාක්ෂි) | ඓතිහාසික වාදයකි; කේතනය ස්ථිර කර ඇත |
| Q14 | Archaic Numbers කොටස සඳහා යුනිකේත අනුවාදය (7.0?) | WP-EN පමණි; DerivedAge සමඟ පරීක්ෂා කර නැත | බොහෝ විට 7.0 |
| Q15 | ඉංග්රීසි /z/ සහ /ʃ/ සඳහා පොදු අක්ෂර වින්යාසය | ජනප්රිය මූලාශ්ර පමණි; සම්මතයක් නැත | විසඳා නැත. පෙළ සංග්රහයකින් පරීක්ෂා කළ යුතුය. |
| Q16 | ර ් ZWJ ය දර්ශනය වන්නේ රේඵය + ය ලෙසද නැතිනම් ර + යංශය ලෙසද, සහ කාර්ය වැනි වචනවලට නිවැරදි කුමක්ද යන්න | SLS: ර ට පසු යංශය නොයෙදේ; රේඵය + යංශය සඳහා විශේෂ ZWNJ අනුක්රමයක් දෙයි. අකුරු මුහුණත අනුව හැසිරීම වෙනස් වේ. | අකුරු මුහුණත් පරීක්ෂා කළ යුතුය (Noto Sinhala, Iskoola Pota) |