03: හල් ලකුණ (al-lakuna ්) සහ ව්යඤ්ජන පොකුරු / සංයුක්ත අකුරු
විෂය පථය: සිංහල හල් ලකුණ (hal kirīma), සංක්ෂිප්ත රූප තුන (යංශය, රකාරාංශය, රේඵය), බැඳි අකුරු (bændi akuru), ස්පර්ශ අකුරු (sparśa akuru), පොකුරුවල ශබ්ද සංයෝජන නීති (phonotactics), ද්විත්ව ව්යඤ්ජන (geminates), සහ SLS 1134 සහ යුනිකේත මේවා සඳහා නියම කරන ගබඩා කළ අනුක්රම.
සම්පාදනය කළේ 2026 ඔක්තෝබර් මාසයේදීය.
මෙම ගොනුවේ භාවිත කරන සම්මුති:
- කේත ලක්ෂ්ය
U+XXXXඅනුක්රම ලෙස දී ඇත.U+200D= ZERO WIDTH JOINER (ZWJ),U+200C= ZERO WIDTH NON-JOINER (ZWNJ),U+0DCA= SINHALA SIGN AL-LAKUNA (හල් ලකුණ). - මෙම ගොනුවේ ඇති සෑම කේත ලක්ෂ්ය අනුක්රමයක්ම එය අසල ඇති සිංහල පාඨයෙන් යන්ත්රයක් මගින් ජනනය කර ඇත. එබැවින් ඒ දෙක සැමවිටම එකඟ වේ.
- අකුරු හැඳුනුම් (මෙම ගබඩාව පුරා භාවිත වේ): ka kha ga … lla fa; ස්වර a aa … au; hal.
- විශ්වාසය: ඉහළ = යුනිකේත / SLS / අකුරු හැඩගැන්වීමේ පිරිවිතරයක සෘජුවම සඳහන් වේ, නැතහොත් ස්වාධීන මූලාශ්ර දෙකක් හෝ වැඩි ගණනක් එසේ කියයි; මධ්යම = එක් හොඳ මූලාශ්රයක්, නැතහොත් හොඳ මූලාශ්රවලින් සාධාරණව නිගමනය කළ හැකි දෙයක්; අඩු = විමසූ මූලාශ්රයකින් තහවුරු නොවූ හෝ විවාදාත්මක. [විසඳා නැත] ලකුණ විමසූ කිසිදු මූලාශ්රයකින් තහවුරු නොවන ප්රකාශ පෙන්වයි; ඒවා විසඳා නැති ප්රශ්න යටතේ ලැයිස්තුගත කර ඇත. "NLPC 108" වැනි සංඛ්යා NLPC වචන මිලියන 2.1 ලැයිස්තුවේ ටෝකන ගණන්ය (reports/corpus-counts.md); "දුර්ලභ" යනු ටෝකන 20 ට අඩු බවයි.
- උදාහරණවල රෝමානුකරණය අවිධිමත්ය (
t= ට,th= ත,d= ඩ,dh= ද,sh= ශ,ss= ෂ,ə= schwa). එය යෝජනාවක් නොවේ.
0. මූලාශ්ර (පහත හැඳුනුම් අංකයෙන් උපුටා දක්වයි)
| හැඳුනුම | මූලාශ්රය | වර්ගය / අධිකාරිය |
|---|---|---|
| S1 | Unicode Standard 15.0, ch. 13 §13.2 "Sinhala": https://www.unicode.org/versions/Unicode15.0.0/ch13.pdf | අර්ධ වශයෙන් නියාමක (මූලික පිරිවිතර පාඨය) |
| S2 | Unicode NamedSequences.txt: https://www.unicode.org/Public/UCD/latest/ucd/NamedSequences.txt | නියාමක දත්ත |
| S3 | SLS 1134:2004 මහජන අදහස් සඳහා කෙටුම්පත (WG2 N2737 / L2/04-131), https://www.unicode.org/wg2/docs/n2737.pdf ; දෙවන පිටපත https://sinhala.sourceforge.net/archive/akuru.org/att-0028/sls1134.pdf | ජාතික ප්රමිතිය (කෙටුම්පත). අවසාන 2004 පිටපත සහ 2011 සංශෝධනය මාර්ගගතව ලබාගත නොහැකි විය. |
| S4 | SLSI කාර්ය කණ්ඩායම් තීරණ 2004-06-09, L2/04-231: https://www.unicode.org/L2/L2004/04231-sinhala-rep.pdf | ප්රමිති ආයතනයේ රැස්වීම් වාර්තා |
| S5 | Microsoft, "Creating and Supporting OpenType Fonts for Sinhala Script": https://learn.microsoft.com/en-us/typography/script-development/sinhala | හැඩගැන්වීමේ පිරිවිතරය (Win10 ට පෙර එන්ජිම) |
| S6 | Microsoft, "Universal Shaping Engine" පිරිවිතරය: https://learn.microsoft.com/en-us/typography/script-development/use | හැඩගැන්වීමේ පිරිවිතරය (සිංහල සඳහා වත්මන් Windows එන්ජිම) |
| S7 | HarfBuzz මූල කේතය: src/hb-ot-shaper.hh (Sinhala → USE) සහ src/hb-ot-shaper-use.cc (F_MANUAL_ZWJ), https://github.com/harfbuzz/harfbuzz | ක්රියාත්මක කිරීම |
| S8 | ICANN Sinhala Generation Panel, "Proposal for a Sinhala Script Root Zone LGR", 22 Apr 2019: https://new.icann.org/en/system/files/files/proposal-sinhala-lgr-22apr19-en.pdf | විශේෂඥ මණ්ඩලය (UCSC, J.B. Disanayaka, සහ තවත් අය) |
| S9 | M. Jansche, unicode ලැයිස්තුව, Oct 2016 (SLS 1134:2011 Table 3 සටහන උපුටා දක්වයි), https://corp.unicode.org/pipermail/unicode/2016-October/004249.html ; පිළිතුර (A. Freytag) https://unicode.org/mail-arch/unicode-ml/y2016-m10/0218.html | ප්රමිතියේ ද්විතීයික උපුටා දැක්වීමක් |
| S10 | Harshula / R. Wordingham, unicode ලැයිස්තුව, Oct 2018 "Fallback for Sinhala Consonant Clusters": https://www.unicode.org/mail-arch/unicode-ml/y2018-m10/0062.html ; https://www.unicode.org/mail-arch/unicode-ml/y2018-m10/0041.html ; https://corp.unicode.org/pipermail/unicode/2018-October/007087.html | විශේෂඥ සාකච්ඡාව; SLS 1134:2011 අන්තර්ගතය වාර්තා කරයි |
| S11 | Harshula, unicode ලැයිස්තුව, Sep 2009 "Use of ZWJ to form Sinhala Conjuncts": https://unicode.org/mail-arch/unicode-ml/y2009-m09/0011.html | විශේෂඥ සාකච්ඡාව |
| S12 | Harshula Jayasuriya, "Sinhala Orthography: Ola Leaf to the Computer", UCSC LTRL, 2007, https://ftp3.gwdg.de/pub/gnu/www/savannah-checkouts/non-gnu/sinhala/doc/presentations/sinhala-orthography-hj-20070212.pdf | විශේෂඥ ඉදිරිපත් කිරීම |
| S13 | Wasala, Weerasinghe, Gamage, "Sinhala Grapheme-to-Phoneme Conversion and Rules for Schwa Epenthesis", COLING/ACL 2006: https://aclanthology.org/P06-2114.pdf | සම-සමාලෝචිත වාග්විද්යා/NLP පර්යේෂණය |
| S14 | Wikipedia, "Sinhala language" (Phonology): https://en.wikipedia.org/wiki/Sinhala_language | ඉඟියක් පමණි |
| S15 | si.wikipedia "සිංහල හෝඩිය" සංයුක්ත අකුරු වගුව: https://si.wikipedia.org/?curid=2505 | ඉඟියක් පමණි |
| S16 | Usgoda Dhammagaru, "සිංහල භාෂාවේ අක්ෂර වින්යාසය" (ඉගැන්වීම් සටහන්, 2024): https://ia601404.us.archive.org/21/items/Index_201704/dhgra002.pdf | ඉගැන්වීම් ද්රව්ය (මධ්යම) |
| S17 | Noto Sans Sinhala මූලාශ්ර ගොනු (අක්ෂර රූප එකතුව): https://github.com/notofonts/sinhala | අකුරු මුහුණත ක්රියාත්මක කිරීම |
| S18 | SLS 1134 Part 2:2007 අනුකූලතා මට්ටම් උපුටා දක්වන fontconfig si.orth පැච් එක, https://bugs.freedesktop.org/attachment.cgi?id=22587 | ප්රමිතියේ ද්විතීයික උපුටා දැක්වීමක් |
| S19 | S. Wiles, Indology ලැයිස්තුව, June 2012 "Sinhala ligatures": https://list.indology.info/pipermail/indology/2012-June/036715.html | විද්වතෙකුගේ සටහන |
| S20 | M. Kaplan, "The subtle difference between ශ්රී ලංකාව and ශ්රීලංකාව", 2007: https://archives.miloush.net/michkap/archive/2007/10/14/5448243.html | ක්රියාත්මක කරන්නෙකුගේ බ්ලොගය |
| S21 | E. Muller (Adobe), සිංහල කෙටුම්පත පිළිබඳ අදහස්, L2/04-235: https://www.unicode.org/L2/L2004/04235-sinhala-cmt.html | UTC ලේඛනය |
| S22 | si.wikipedia "සිංහල අක්ෂර වින්යාසය": https://si.wikipedia.org/wiki/සිංහල_අක්ෂර_වින්යාසය | ඉඟියක් පමණි |
| S23 | ප්රකාශිත සිංහල අක්ෂර පරිවර්තන ක්රමයක් (nongnu.org සිංහල ව්යාපෘතියේ ලේඛන): https://www.nongnu.org/sinhala/doc/transliteration/sinhala-transliteration_2.html | පෙර පැවති රෝමානුකරණ ක්රමයක් |
| S24 | RFC 5892 (IDNA2008), Appendix A.2, ZWJ සඳහා CONTEXTJ නීතිය: https://www.rfc-editor.org/rfc/rfc5892 | IETF ප්රමිතිය (සෘජුවම විමසා නැත) |
| S25 | සිංහල විකිපීඩියා, 2026-10-01 pages-articles ඩම්පයේ ලිපි (tools/corpus_counts.py): https://dumps.wikimedia.org/siwiki/20261001/ | භාවිත නියැදියක් (ලිඛිත පාඨය) |
1. ඔබට කරදර විය හැකි කරුණු (මුලින්ම කියවන්න)
- සිංහලයේ හල් ලකුණ තනිවම කිසිවක් එකතු නොකරයි.
C + ් + Cසැමවිටම පෙනෙන හල් ලකුණක් පෙන්වයි. සංයුක්ත අකුරක්, යංශයක්, රකාරාංශයක් හෝ රේඵයක් ලැබෙන්නේ ZWJ ඇති විට පමණි. මෙහිදී සිංහල දේවනාගරී අකුරුවලින් වෙනස් වේ. (HC-001) - ZWJ පිහිටන තැන වැදගත්ය.
් + ZWJසංයුක්ත අකුරක් හෝ සංක්ෂිප්ත රූපයක් (reduced form) දෙයි.ZWJ + ්ස්පර්ශ අකුරක් දෙයි. මේවා එකම ශබ්ද සඳහා වූ වෙනස් ලිවීම් වේ. (HC-002, HC-003) - නිවැරදි අක්ෂර වින්යාසයේදී යංශය සහ රකාරාංශය අනිවාර්යය.
ක්රම(ZWJ නැතිව) krama සඳහා පිළිගත් ලිවීමක් නොවේ. රේඵය විකල්පයකි. අනෙක් බැඳි අකුරු (ක්ෂ, න්ද …) විකල්ප වන අතර බොහෝ දුරට පැරණි විලාසයට අයත් වේ. (HC-020, HC-030, HC-040) ර + ් + ZWJ + යඅපැහැදිලිය (ra + යංශය, නැතහොත් රේඵය + ya). SLS 1134 අනුව ra + යංශය භාවිත නොවේ. එබැවින් එහි තේරුම රේඵය + ya වේ. අකුරු මුහුණත් මේ ගැන එකඟ නොවේ. (HC-033)- ඥ තනි අකුරකි (U+0DA5). එය කිසිවිටෙක
ජ්ඤලෙස ගොඩනඟන්න එපා. (HC-051) - ව්යඤ්ජන ශබ්දයකින් අවසන් වන වචනයක් ලියන්නේ හල් ලකුණ සමඟය. ආවේණික ස්වරය a හෝ ə ලෙස උච්චාරණය වේ. නමුත් කුමක්දැයි අක්ෂර වින්යාසය කිසිවිටෙක නොපෙන්වයි. schwa කිසිවිටෙක හල් ලකුණක් ඇති නොකරයි. (HC-010…HC-013)
- රකාරාංශය + u/ū සඳහා æ/ǣ ලකුණු මෙන් පෙනෙන විශේෂ අක්ෂර රූප ඇත. එසේ වුවද ඒවා U+0DD4/U+0DD6 ලෙසම කේතනය කළ යුතුය. සැබෑ පෙළ සංග්රහවල වැරදි කේතනය හමු වේ. උදාහරණයක් ලෙස krūra සඳහා ක්රෑර ලියා ඇත. ඇත්තෙන්ම krūra සඳහා සුලබ ලිවීම ෲ සහිත කෲර වේ (02:VS-035). (HC-024)
- සඤ්ඤක අකුරු (ඟ ඦ ඬ ඳ ඹ) කිසිවිටෙක හල් ලකුණ නොගනී. ළ අකුරද හල් ලකුණ නොගනී. (HC-014)
- බොහෝ පද්ධති ZWJ ඉවත් කරයි හෝ විකෘති කරයි: සමහර දර්ශන මෘදුකාංග, සෙවුම් කොටු, root-zone LGR. සැබෑ පෙළ සංග්රහවල ZWJ නැති ලිවීම් බලාපොරොත්තු වන්න. ගැළපීමේදී ඒවා එකම ලෙස සලකන්න. (§10)
2. කේතන ආකෘතිය
HC-001: හල් ලකුණ තනිවම කිසිවිටෙක පොකුරක් සාදන්නේ නැත
- ප්රකාශය: ZWJ නැති විට U+0DCA සැමවිටම පෙනේ. එය කරන්නේ ආවේණික ස්වරය "මරා දැමීම" පමණි. එය කිසිවිටෙක සංයුක්ත අකුරක්, සංක්ෂිප්ත රූපයක් හෝ ස්පර්ශ රූපයක් ඇති නොකරයි.
- උදාහරණ:
ද + ් + ධ→ ද්ධ (ද මත පෙනෙන හල් ලකුණක්, ඉන්පසු සම්පූර්ණ ධ):U+0DAF U+0DCA U+0DB0. පැහැදිලි හල් ලකුණ සමඟ ලියූ ධර්ම dharma සඳහාද එසේමය:U+0DB0 U+0DBB U+0DCA U+0DB8. - ව්යතිරේක: නැත. මෙය සිංහල කේතනයේ මූලික නීතියයි. එය දේවනාගරී/දෙමළ භාවිතයෙන් වෙනස් වේ.
- අදාළ වන්නේ: hal; සියලු ව්යඤ්ජන.
- විශ්වාසය: ඉහළ.
- මූලාශ්ර: S1 (§13.2 "Virama (al-lakuna) and Consonant Forms"), S12, S11.
HC-002: ව්යඤ්ජන යුගලයක් ලිවීමේ ක්රම තුනක්
- ප්රකාශය: ව්යඤ්ජන යුගලයක් C1 C2 සඳහා (අතරේ ස්වරයක් නැති විට) කේතන ක්රම තුනක් ඇත. එක් එක් ක්රමය වෙනස් දෘශ්ය විලාසයක් දෙයි:
විලාසය අනුක්රමය භාවිතය වෙන් වූ අකුරු (නූතන) C1 ් C2සාමාන්ය නූතන ලිවීම සංයුක්ත අකුර / සංක්ෂිප්ත රූපය C1 ් ZWJ C2යංශය, රකාරාංශය, රේඵය, බැඳි අකුරු ස්පර්ශ අකුරු C1 ZWJ ් C2පාලි සහ සම්භාව්ය ග්රන්ථ (sparśa akuru) - උදාහරණ (d + dh): වෙන් වූ ද්ධ
U+0DAF U+0DCA U+0DB0; බැඳි ද්ධU+0DAF U+0DCA U+200D U+0DB0; ස්පර්ශ ද්ධU+0DAF U+200D U+0DCA U+0DB0. - ව්යතිරේක: සංක්ෂිප්ත රූපය ගන්නේ කුමන ව්යඤ්ජනයදැයි ZWJ පිහිටීම තීරණය නොකරයි. ඉන්දීය අක්ෂරවල ZWJ භාවිතයෙන් මෙය වෙනස් වේ. අනුපිළිවෙළ තෝරන්නේ විලාසය පමණි (S1).
- අදාළ වන්නේ: hal + ඕනෑම ව්යඤ්ජන යුගලයක්.
- විශ්වාසය: ඉහළ.
- මූලාශ්ර: S1, S5 (පොකුරු ව්යාකරණය
{C+H+ZWJ}+Cසහ{C+ZWJ+H}+C), S12, S11, S10.
HC-003: ස්පර්ශ අකුරු ZWJ + al-lakuna භාවිත කරයි (SLS 1134:2011, යුනිකේත)
- ප්රකාශය: ස්පර්ශ පොකුරක්
C1 + ZWJ + ් + C2වේ. යුනිකේත අනුව මෙම විලාසය නව වචනවලටද අදාළ වන (productive) එකකි. එබැවින් අකුරු මුහුණතක් එය අවස්ථාවෙන් අවස්ථාව ලැයිස්තුගත කිරීමෙන් නොව, පොදු ක්රමයකින් හැසිරවිය යුතුය. - උදාහරණ: පාලි kka ක්ක
U+0D9A U+200D U+0DCA U+0D9A(S5 හි උදාහරණය); mma ම්මU+0DB8 U+200D U+0DCA U+0DB8(S15). - ව්යතිරේක / ඉතිහාසය: 2004 SLS 1134 කෙටුම්පත (S3) සංයුක්ත අකුරු සහ ස්පර්ශ අකුරු යන දෙකටම
් + ZWJභාවිත කළේය. පාලි පිළිබඳ එහි සටහන අනුව 0DCA 200D අනුක්රමය භාවිත "කළ හැකිය". ඉන්පසු SLSI 2004 රැස්වීම් වාර්තාවලට (S4) අනුව, භාවිත කළ යුතු සම්බන්ධකය කුමක්දැයි යුනිකේතයෙන් විමසා ඇත. යෝජිත විකල්ප දෙක ZWNJ සහ ZWJ+ZWNJ+ZWJ විය. Harshula (S10) අනුව අවසාන 2004 ප්රමිතිය සහ 2011 සංශෝධනයZWJ + al-lakunaතෝරා ගත්තේය. පැරණි ලේඛනවල තවමත් කෙටුම්පතේ සම්මුතිය තිබිය හැකිය. - අදාළ වන්නේ: සියලු ව්යඤ්ජන; hal.
- විශ්වාසය: වත්මන් භාවිතය සඳහා ඉහළ; වෙනස හරියටම සිදු වූයේ කවදාදැයි යන්න සඳහා මධ්යම.
- මූලාශ්ර: S1, S5, S10, S11, S12, S3, S4.
HC-004: සංක්ෂිප්ත රූප තුන සඳහා නම් කළ අනුක්රම
- ප්රකාශය: යුනිකේත පහත නම් කළ අක්ෂර අනුක්රම නිර්වචනය කරයි:
- SINHALA CONSONANT SIGN YANSAYA =
U+0DCA U+200D U+0DBA - SINHALA CONSONANT SIGN RAKAARAANSAYA =
U+0DCA U+200D U+0DBB - SINHALA CONSONANT SIGN REPAYA =
U+0DBB U+0DCA U+200D
- SINHALA CONSONANT SIGN YANSAYA =
- අදාළ වන්නේ: ya, ra, hal.
- විශ්වාසය: ඉහළ.
- මූලාශ්ර: S2, S1 (Table 13-3).
HC-005: සිංහලයේ ZWJ/ZWNJ අර්ථය (සාරාංශය)
- ප්රකාශය:
- හල් ලකුණට පසු ZWJ: සංයුක්ත අකුරක් හෝ සංක්ෂිප්ත රූපයක් ඉල්ලයි.
- හල් ලකුණට පෙර ZWJ: ස්පර්ශ රූපයක් ඉල්ලයි.
- ZWNJ: හල් ලකුණ පෙරනිමියෙන් කිසිවක් එකතු නොකරන බැවින්, සාමාන්ය සිංහල පාඨයේ ZWNJ ට කාර්යයක් නැත. එහි ලේඛනගත භාවිත ඉතා සීමිතය:
- (a) 2004 කෙටුම්පත (S3) ස්වර ලකුණක් තනිව පෙන්වීමට ඊට පෙර ZWNJ යෙදුවේය (
U+200C U+0DCF). තනි යංශයක් (U+200C U+0DCA U+200D U+0DBA) සහ තනි රේඵයක් (U+0DBB U+0DCA U+200D U+200C) සඳහාද එය ZWNJ භාවිත කළේය. - (b) SLSI 2004 තීරණ (S4) මේවා වෙනුවට SPACE මත පදනම් වූ අනුක්රම යෙදුවේය. තනි යංශය =
U+0020 U+0DCA U+200D U+0DBA. තනි රකාරාංශය =U+0020 U+0DCA U+200D U+0DBB. තනි රේඵය =U+0DBB U+0DCA U+200D U+0020. තනි ස්වර ලකුණක් = හිස්තැන + ලකුණ, ZWJ නැතිව. - (c) සම්මත නොවන "ra + යංශය" කියවීම බලෙන් ලබාගැනීමට Jansche/Freytag (S9)
U+0DBB U+200C U+0DCA U+200D U+0DBAයෝජනා කළහ. මෙය යෝජනාවක් පමණි. විමසූ මූලාශ්රවල එය පිළිගත් බවක් සඳහන් නොවේ.
- (a) 2004 කෙටුම්පත (S3) ස්වර ලකුණක් තනිව පෙන්වීමට ඊට පෙර ZWNJ යෙදුවේය (
- USE (S6) යටතේ ZWNJ අක්ෂර දෙකක් එකට බැඳීම වළක්වයි. ZWJ පෙර පොකුර ඊළඟ අක්ෂරයට සම්බන්ධ කරයි.
- අදාළ වන්නේ: hal, ya, ra.
- විශ්වාසය: ZWJ සඳහා ඉහළ; ZWNJ සඳහා මධ්යම (තනි ලකුණු පිළිබඳ සම්මුති කෙටුම්පත සහ කාර්ය කණ්ඩායම් තීරණ අතර ගැටේ).
- මූලාශ්ර: S1, S3, S4, S6, S9.
HC-006: දර්ශන මෘදුකාංග: Windows 10+ සහ HarfBuzz හි සිංහල හැඩගන්වන්නේ USE මගිනි
- ප්රකාශය: Windows 10+ සිංහල හැඩගන්වන්නේ (shaping) Universal Shaping Engine මගිනි. එය කලින් තිබූ සිංහලයටම වෙන් වූ එන්ජිම වෙනුවට පැමිණියේය. HarfBuzz ද
HB_SCRIPT_SINHALAසිය USE හැඩගැන්වීමට යොමු කරයි. එහි මූලික USE විශේෂාංගF_MANUAL_ZWJසමඟ යෙදේ. එබැවින් ZWJ මඟ නොහැරේ. අකුරු මුහුණතේ සෙවුම් නීති (lookups) ZWJ ට පැහැදිලිවම ගැළපිය යුතුය. ප්රායෝගිකව:- සංයුක්ත අකුරක් පෙනෙනවාද යන්න සම්පූර්ණයෙන්ම රඳා පවතින්නේ අකුරු මුහුණතේ
C ් ZWJ Cසඳහා සෙවුම් නීතියක් තිබීම මතය. - අකුරු මුහුණතේ අක්ෂර රූපයක් නැති විට විකල්ප දර්ශනය වේදිකාව අනුව වෙනස් වේ. HarfBuzz පෙනෙන හල් ලකුණක් පෙන්වයි. Windows 10 සහ iOS ද හල් ලකුණ පෙන්වයි, නමුත් ස්වර වෙනස් ලෙස තබයි (S10).
- සංයුක්ත අකුරක් පෙනෙනවාද යන්න සම්පූර්ණයෙන්ම රඳා පවතින්නේ අකුරු මුහුණතේ
- නිරීක්ෂණය කළ අකුරු මුහුණත් ආවරණය: Noto Sans Sinhala (S17) හි යුනිකේත Table 13-4 කට්ටලයට හරියටම ගැළපෙන බැඳි අක්ෂර රූප සහ ඊට අමතරව ඤ්ච ඇත (අක්ෂර රූප නම්
ka_ssa, ka_va, ga_dha, tta_ttha, ta_tha, ta_va, da_dha, da_va, na_tha, na_da, na_dha, na_va, nya_ca). එහි සාමාන්යtouchඅක්ෂර රූපයක් සහ ද ඳ ඤ ඥ සඳහා සහ න්ද පොකුර සඳහා විශේෂ රකාරාංශ රූපද ඇත. - විශ්වාසය: ඉහළ (S6, S7 මූල කේතය); වේදිකා අනුව විකල්ප දර්ශනයේ විස්තර සඳහා මධ්යම (එක් තැපැල් ලැයිස්තු වාර්තාවක්).
- මූලාශ්ර: S5, S6, S7, S10, S17.
3. හල් ලකුණ භාවිතය සහ උච්චාරණය
HC-010: හල් ලකුණ ස්වරයක් නැති බව පෙන්වයි; ආවේණික ස්වරය කිසිවිටෙක ලියන්නේ නැත
- ප්රකාශය: ලකුණක් නැති ව්යඤ්ජන අකුරක ආවේණික ස්වරය ඇත. හල් ලකුණ සහිත ව්යඤ්ජනයක ස්වරයක් නැත. අක්ෂර වින්යාසය පෙන්වන එකම වෙනස එයයි. ආවේණික ස්වරය [a] ලෙස හෝ [ə] ලෙස උච්චාරණය වන්නේදැයි එය නොපෙන්වයි.
- උදාහරණ: ගම gamə "ගම":
U+0D9C U+0DB8. කර "උරහිස" /karə/ සහ කර "කරන්න" /kərə/ එක ලෙසම ලියන අවම යුගලයකි (S14). - ව්යතිරේක: අක්ෂර වින්යාසයේ නැත. අක්ෂර පරිවර්තන ක්රමයක් වන S23, රෝමානු
aසහeයන දෙකම ලකුණක් නැති ව්යඤ්ජනයට සිතියම්ගත කරයි. එනම් əeලෙස ලිවීමට එය ඉඩ දෙයි. - අදාළ වන්නේ: සියලු ව්යඤ්ජන; ස්වරය a; hal.
- විශ්වාසය: ඉහළ.
- මූලාශ්ර: S13, S14, S23.
HC-011: schwa සහ /a/ උච්චාරණ නීති (උච්චාරණය සඳහා පමණි)
ප්රකාශය: S13 මුලින්ම ලකුණක් නැති සෑම ව්යඤ්ජනයකටම /ə/ දෙයි. ඉන්පසු අනුපිළිවෙළට නීති යොදයි (අදහස් අනුව සාරාංශ කර ඇත):
- පළමු අක්ෂරයේ න්යෂ්ටිය /a/ බවට පත් වේ. ව්යතිරේක: වචනය /sv/ වලින් ආරම්භ වීම; /kər/ වලින් ආරම්භ වීම (උදා. කර-, එබැවින් කරනවා → /kərənəwaː/); නැතහොත් එය තනි CV අක්ෂරයක් වීම.
- ව්යඤ්ජනයක් + /r/ ට පසු, ව්යඤ්ජනයකට පෙර ə→a වේ; /h/ සඳහා උප නීති ඇත.
- /h/ ට පසු ස්වරයක් ඇති විට, /h/ ට පෙර ə→a වේ.
- ව්යඤ්ජන පොකුරකට පෙර (එනම් හල් ලකුණ සහිත ව්යඤ්ජනයකට පෙර) ə→a වේ.
- වචන අවසාන ව්යඤ්ජනයකට පෙර ə→a වේ (අවසාන /r/, /b/, /ɖ/, /ʈ/ හැර).
- /ji/ ට පෙර වචන අවසාන ə → a වේ.
- /kə(r|l)u/ → /ka(r|l)u/.
- kal- රූප සඳහා කුඩා ශබ්දකෝෂ නීතියක්.
පෙළ සංග්රහයේ වචන 30,000 මත මෙම නීති 98% නිරවද්යතාවක් ලබා ගත්තේය. ඉතිරි දෝෂවලින් බොහොමයක් සමාස සහ ඉංග්රීසි ණය වචන විය.
උදාහරණ: කරනවා:
U+0D9A U+0DBB U+0DB1 U+0DC0 U+0DCF→ /kərənəwaː/, නීතිය 1(b) අනුව. සටහන: S13 පළමු අක්ෂරයේද schwa එකක් දෙයි, "karanəwa" නොවේ.ඇඟවුම: හල් ලකුණ තැබීම කිසිවිටෙක schwa මත රඳා නොපවතී.
karanawa,karanewaසහkəranəwaයන රෝමානු ලිවීම් සියල්ලම එකම අකුරුවලට (ක ර න වා) අනුරූප වේ.ව්යතිරේක: ා නැතිව ලියා ඇතත් දිගු අවසාන ස්වරයක් සමඟ උච්චාරණය වන වචන කිහිපයක් S13 සොයාගත්තේය: අම්ම → /ammaː/, අක්ක, ගත්ත. මෙහිදී අක්ෂර වින්යාසය සාම්ප්රදායික ලෙස පවතී.
අදාළ වන්නේ: ස්වරය a; සියලු ව්යඤ්ජන.
විශ්වාසය: ඉහළ (සම-සමාලෝචිත); නීති සාරාංශය වෙනත් වචනවලින් කීමකි.
මූලාශ්ර: S13, S14.
HC-012: වචන අවසාන හල් ලකුණ
- ප්රකාශය: ව්යඤ්ජන ශබ්දයකින් අවසන් වන වචනයක් ලියන්නේ අවසාන හල් ලකුණක් සමඟය. නූතන සිංහලයේ මෙය සුලබය. සාමාන්ය ප්රභව:
- විභක්ති ප්රත්ය: කරණ/අපාදාන -in (මගින්, අතින්); අනියම් -ak (පොතක්); "ද" යන අර්ථයේ -t (මමත්); කොන්දේසි -nam (නම්); බහු වචන (මල්, ගස්, කන්)
- දේශීය නාම පද (පින්, බත්)
- ණය වචන (බස්, කැම්පස්)
- උදාහරණ: මගින්
U+0DB8 U+0D9C U+0DD2 U+0DB1 U+0DCA; පින්U+0DB4 U+0DD2 U+0DB1 U+0DCA; පොතක්U+0DB4 U+0DDC U+0DAD U+0D9A U+0DCA. - ව්යතිරේක / අවදානම්:
- වචන අවසාන හල් ලකුණ යෙදෙන්නේ හල් ලකුණ ගත හැකි අකුරුවල පමණි (HC-014 බලන්න).
- S14 අනුව සිංහල වචන /ŋ/ හැර වෙනත් නාසිකයකින් උච්චාරණයේදී අවසන් විය නොහැක. එබැවින් අක්ෂර වින්යාසය න් / ම් ලෙස තිබුණත් කථනයේදී අවසාන න් / ම් [ŋ] ලෙස උච්චාරණය විය හැකිය. විශ්වාසය මධ්යම; ඇත්තේ එක් ඉඟි මූලාශ්රයක් පමණි. අනුස්වාරයද (ං) /ŋ/ නිරූපණය කරයි (උදා. සිංහල). එබැවින් වචන අවසානයේ රෝමානු
ngං, න් හෝ ම් යන කුමක්දැයි අපැහැදිලිය.
- අදාළ වන්නේ: hal; ka ta tha na ma la sa pa tta ආදිය.
- විශ්වාසය: නීතිය සඳහා ඉහළ; [ŋ] සටහන සඳහා මධ්යම.
- මූලාශ්ර: S13, S14, S8 (හල් ලකුණ භාවිතයේ උදාහරණ), පෙළ සංග්රහ පිළිබඳ සාමාන්ය නිරීක්ෂණ.
HC-013: වචනය මැද හල් ලකුණ = පොකුරක් හෝ ද්විත්වයක්
- ප්රකාශය: වචනයක් ඇතුළත ඇති හල් ලකුණක් සැමවිටම අතරේ ස්වරයක් නැති ව්යඤ්ජන පොකුරක් හෝ ද්විත්ව ව්යඤ්ජනයක් පෙන්වයි (අම්මා, පත්තරය, කරන්න). ZWJද ඇත්නම්, පොකුර සංයුක්ත අකුරක් හෝ සංක්ෂිප්ත රූපයක් ලෙස ඇඳේ (HC-002).
- උදාහරණ: අම්මා
U+0D85 U+0DB8 U+0DCA U+0DB8 U+0DCF; කරන්නU+0D9A U+0DBB U+0DB1 U+0DCA U+0DB1. - විශ්වාසය: ඉහළ.
- මූලාශ්ර: S1, S3, S13.
HC-014: කිසිවිටෙක හල් ලකුණ නොගන්නා අකුරු
- ප්රකාශය:
- සඤ්ඤක අකුරු පහ (sannaka) ඟ ඦ ඬ ඳ ඹ ට පසු හල් ලකුණ යෙදිය නොහැක (S8, "constraint for Sannjakas"). ඒවා ද්විත්ව ලෙසද යෙදිය නොහැක (S14).
- මූර්ධජ ළ කිසිවිටෙක හල් ලකුණ නොගනී (S22).
- ඞ ප්රතිවිරුද්ධ අවස්ථාවයි: එය "කිසිවිටෙක ස්වරයක් සමඟ එකතු නොවේ" සහ ශුද්ධ රූපයෙන් පමණක් යෙදේ (S3, Table 3 සටහන 1; කෙටුම්පත් PDF හි පාඨය අර්ධ වශයෙන් විකෘතිය; බොහෝ දුරට අදහස් කරන්නේ ඞ් විය හැකිය).
- ව්යතිරේක: si.wikipedia (S15) ඳ්ඨ, ඳ්ධ, ඳ්ව සංයුක්ත අකුරු ලෙස ලැයිස්තුගත කරයි. එය S8 ට පටහැනිය. මෙහිදී S15 විශ්වාසදායක නොවන මූලාශ්රයක් ලෙස සැලකේ (විසඳා නැති ප්රශ්න බලන්න).
- අදාළ වන්නේ: nnga, nyja, nndda, nda, mba, lla (හල් ලකුණ නැත); nga (හල් ලකුණ සමඟ පමණි).
- විශ්වාසය: මධ්යම-ඉහළ (S8 අධිකාරී මූලාශ්රයකි, S22 ඉඟියකි).
- මූලාශ්ර: S8, S14, S22, S3.
4. යංශය, රකාරාංශය, රේඵය
HC-020: යංශය (්ය): ශුද්ධ ව්යඤ්ජනයකට පසු ya
- ප්රකාශය: ශුද්ධ ව්යඤ්ජනයකට පසු ය එන විට, එය මූලාක්ෂරයට පසුව එන යංශය ලෙස ලියැවේ. කේතනය:
C + ් + ZWJ + ය.- සාමාන්ය පාඨයේ අනිවාර්යය: SLS අනුව යංශය සහ රකාරාංශය "සාමාන්ය සිංහල පාඨයේ අවශ්යය". S8 අනුව වාක්ය (ZWJ නැතිව) වැනි රූප පිළිගැනෙන්නේ නැත.
- ZWJ ඉවත් කළ යුත්තේ, යම් හේතුවකින් යංශය හිතාමතාම අනවශ්ය වූ විට පමණි (S3 සටහන).
- උදාහරණ: වාක්ය vākya
U+0DC0 U+0DCF U+0D9A U+0DCA U+200D U+0DBA; සත්ය satyaU+0DC3 U+0DAD U+0DCA U+200D U+0DBA; විද්යාවU+0DC0 U+0DD2 U+0DAF U+0DCA U+200D U+0DBA U+0DCF U+0DC0; අවශ්යU+0D85 U+0DC0 U+0DC1 U+0DCA U+200D U+0DBA; රාජ්යU+0DBB U+0DCF U+0DA2 U+0DCA U+200D U+0DBA; මනුෂ්යU+0DB8 U+0DB1 U+0DD4 U+0DC2 U+0DCA U+200D U+0DBA; ද්රව්යU+0DAF U+0DCA U+200D U+0DBB U+0DC0 U+0DCA U+200D U+0DBA; ශය්යා (ya+යංශය)U+0DC1 U+0DBA U+0DCA U+200D U+0DBA U+0DCF. - යංශය මත ඉඩ දෙන ස්වර (SLS Table 3): a, aa, u, uu, e, ee, o, oo (පාඨයේ "7" යැයි කීවද සංයෝජන 8ක් පෙන්වයි), උදා. ක්යෝ
U+0D9A U+0DCA U+200D U+0DBA U+0DDD. ස්වරය යෙදෙන්නේ ය ට මිස පළමු ව්යඤ්ජනයට නොවේ. අනෙක් සංයෝජන භාවිත නොවන බව සඳහන් වුවද, SLS ඒවා තහනම් නොකරයි (S3 §6.3). - සීමාව: ර ට පසු කිසිවිටෙක නොයෙදේ (HC-033).
- අදාළ වන්නේ: ra හැර සියලු ව්යඤ්ජන (සහ HC-014 හි හල් ලකුණ නොගන්නා අකුරු හැර) + ya.
- විශ්වාසය: ඉහළ.
- මූලාශ්ර: S1, S2, S3, S5, S8, S9.
HC-021: රකාරාංශය (්ර): ශුද්ධ ව්යඤ්ජනයකට පසු ra
- ප්රකාශය: ශුද්ධ ව්යඤ්ජනයකට පසු ර එන විට, එය මූලාක්ෂරයට යටින් එන රකාරාංශය ලෙස ලියැවේ. කේතනය:
C + ් + ZWJ + ර. සාමාන්ය පාඨයේ එය අනිවාර්යය: S8 අනුව ක්රම වෙනුවට ක්රම පිළිගැනෙන්නේ නැත. ස්වර ලකුණු ර ට පසුව එයි:C ් ZWJ ර V. - උදාහරණ:
- ක්රම krama
U+0D9A U+0DCA U+200D U+0DBB U+0DB8 - ප්රශ්නය
U+0DB4 U+0DCA U+200D U+0DBB U+0DC1 U+0DCA U+0DB1 U+0DBA - ප්රේමය
U+0DB4 U+0DCA U+200D U+0DBB U+0DDA U+0DB8 U+0DBA - ශ්රී
U+0DC1 U+0DCA U+200D U+0DBB U+0DD3 - ග්රාමය
U+0D9C U+0DCA U+200D U+0DBB U+0DCF U+0DB8 U+0DBA - ද්රව
U+0DAF U+0DCA U+200D U+0DBB U+0DC0 - බ්රාහ්මණ
U+0DB6 U+0DCA U+200D U+0DBB U+0DCF U+0DC4 U+0DCA U+0DB8 U+0DAB - හ්රස්ව
U+0DC4 U+0DCA U+200D U+0DBB U+0DC3 U+0DCA U+0DC0 - ස්රාවය
U+0DC3 U+0DCA U+200D U+0DBB U+0DCF U+0DC0 U+0DBA - ව්රත
U+0DC0 U+0DCA U+200D U+0DBB U+0DAD
- ක්රම krama
- රකාරාංශය මත ඉඩ දෙන ස්වර (SLS Table 3): a, aa, ae, aee, i, ii, e, ee, ai, o, oo, au (සංයෝජන 12). u/uu වගුවේ නැති බව සලකන්න (නමුත් HC-024 බලන්න).
- අදාළ වන්නේ: ප්රායෝගිකව හල් ලකුණ ගත හැකි සෑම ව්යඤ්ජනයක්ම + ra. ka ga gha ta tha da dha pa ba bha va sha sa ha tta සමඟ සුලබය; ma සමඟ දුර්ලභය (HC-052); fa dda සමඟ ණය වචනවල.
- විශ්වාසය: ඉහළ.
- මූලාශ්ර: S1, S2, S3, S5, S8.
HC-022: රේඵය (ර්): ව්යඤ්ජනයකට පෙර ra
- ප්රකාශය: ව්යඤ්ජනයකට පෙර ර් එන විට, එය මූලාක්ෂරයට උඩින් එන රේඵය ලෙස ලිවිය හැකිය. කේතනය:
ර + ් + ZWJ + C. හැඩගැන්වීමේ එන්ජින් එම අක්ෂර රූපය මූල ව්යඤ්ජනයට පසුවට, යංශයක් ඇත්නම් එයටත් පසුවට ගෙන යයි (S5).- රේඵය විකල්පයකි. කර්ම සහ කර්ම යන දෙකම වලංගුය (S3 §3.5). S8 ද තර්ක සහ තර්ක යන දෙකම පිළිගනී.
- උදාහරණ:
- ධර්ම / ධර්ම dharma:
U+0DB0 U+0DBB U+0DCA U+200D U+0DB8සහU+0DB0 U+0DBB U+0DCA U+0DB8 - තර්කය
U+0DAD U+0DBB U+0DCA U+200D U+0D9A U+0DBA - මාර්ගය
U+0DB8 U+0DCF U+0DBB U+0DCA U+200D U+0D9C U+0DBA - වර්ෂය
U+0DC0 U+0DBB U+0DCA U+200D U+0DC2 U+0DBA - පූර්ව
U+0DB4 U+0DD6 U+0DBB U+0DCA U+200D U+0DC0 - අර්ථය
U+0D85 U+0DBB U+0DCA U+200D U+0DAE U+0DBA - වර්ණ
U+0DC0 U+0DBB U+0DCA U+200D U+0DAB
- ධර්ම / ධර්ම dharma:
- අදාළ වන්නේ: ra + hal + බොහෝ දුරට ඕනෑම ව්යඤ්ජනයක් (ka ga ca ja nna ta tha da dha na pa ba bha ma ya va sha ssa sa ha).
- විශ්වාසය: ඉහළ (කේතනය); ඉහළ (විකල්ප බව).
- මූලාශ්ර: S1, S2, S3, S5, S8.
HC-023: ගොඩගැසීමේ අනුපිළිවෙළ සහ සංයෝජන
- ප්රකාශය: තාර්කික අනුපිළිවෙළ සැමවිටම උච්චාරණ අනුපිළිවෙළට වමේ සිට දකුණටය. එකතු කරන සෑම හල් ලකුණකටම පසු ZWJ එයි:
- සංයුක්ත අකුර + රකාරාංශය: න්ද්රා
U+0DB1 U+0DCA U+200D U+0DAF U+0DCA U+200D U+0DBB U+0DCF(SLS 1134 §5.8 උදාහරණය) - ව්යඤ්ජනය + යංශය + රකාරාංශය (si.wikipedia රටාව): ක්ය්ර
U+0D9A U+0DCA U+200D U+0DBA U+0DCA U+200D U+0DBB(දුර්ලභය; රටාවක් පමණි) - රේඵය + ව්යඤ්ජනය + යංශය: ර්ක්ය
U+0DBB U+0DCA U+200D U+0D9A U+0DCA U+200D U+0DBA(රටාවක් පමණි) - ස්වර ලකුණු අවසානයට එයි: ක්රෝ
U+0D9A U+0DCA U+200D U+0DBB U+0DDD, ප්රේU+0DB4 U+0DCA U+200D U+0DBB U+0DDA - කොම්බුව (ෙ) මූලාක්ෂරයට පෙර ඇඳෙන අක්ෂර රූපයකි. එසේ වුවද එය කේතනය කරන්නේ මුළු පොකුරටම පසුවය.
- සංයුක්ත අකුර + රකාරාංශය: න්ද්රා
- විශ්වාසය: ඉහළ.
- මූලාශ්ර: S3 §5.6–5.8, S5, S15.
HC-024: රකාරාංශය + u / uu: විශේෂ හැඩ, සාමාන්ය කේතනය
- ප්රකාශය: රකාරාංශයට පසු u සහ uu ස්වර ලකුණු æ/ǣ ලකුණු මෙන් පෙනෙන විකල්ප හැඩ ගනී. යුනිකේත අනුව ඒවා U+0DD4/U+0DD6 ලෙස කේතනය කළ යුතුය, U+0DD0/U+0DD1 ලෙස නොවේ.
- උදාහරණ: ක්රු
U+0D9A U+0DCA U+200D U+0DBB U+0DD4, ක්රූර krūraU+0D9A U+0DCA U+200D U+0DBB U+0DD6 U+0DBB. වැරදි (නමුත් භාවිතයේ හමු වූ): ක්රෑරU+0D9A U+0DCA U+200D U+0DBB U+0DD1 U+0DBB. S13 සිය පෙළ සංග්රහයේ /u, uː/ සඳහා ැ/ෑ භාවිත කළ වචන සොයාගත්තේය. S13 සිය උදාහරණ පැරණි අකුරු මුහුණතකින් මුද්රණය කළ නිසා ඒවා විකෘතිය. බොහෝ දුරට ඒවා ශ්රැති වර්ගයේ සහ ක්රෑර වර්ගයේ ලිවීම් විය හැකිය. - තවද: ද වැනි හැඩයක් ඇති මූලාක්ෂර, යටින් එන ලකුණකට පෙර සිය වලිගය අහිමි කර ගනී. ද්ර පෙනෙන්නේ ක්ර ට වඩා වෙනස් ලෙසය, නමුත් කේතනයට බලපෑමක් නැත (S1).
- භාවිතය සහ දර්ශනය (02:VS-035): ප්රායෝගිකව /Cru/ සහ /Cruː/ බොහෝ විට ලියන්නේ C + ෘ/ෲ ලෙසය (NLPC වචන මිලියන 2.1 ලැයිස්තුවේ කෲර 1,667, ක්රූර 9, ක්රෑර 186; CC-03). Windows පද්ධති අකුරු මුහුණත් වන Nirmala UI සහ Iskoola Pota ඇතුළු අකුරු මුහුණත් කිහිපයක් විශේෂ හැඩය නොඅඳියි. ඒවා පොකුරට යටින් සාමාන්ය ු/ූ එකක් අමුණයි.
- අදාළ වන්නේ: ra (රකාරාංශය), u, uu, ae, aee.
- විශ්වාසය: ඉහළ (S1); පෙළ සංග්රහ අර්ථකථනය සඳහා මධ්යම.
- මූලාශ්ර: S1, S13, S3 §6.3 සටහන.
5. බැඳි අකුරු (bændi akuru) සහ ස්පර්ශ අකුරු (sparśa akuru)
HC-030: බැඳි අකුරු විකල්ප වන අතර බොහෝ දුරට සම්භාව්ය වේ
- ප්රකාශය: යංශය සහ රකාරාංශය හැර, නූතන සිංහල ලිවීමේ දැඩි ලෙස අනිවාර්ය බැඳි අකුරු නැත. Harshula නූතන අක්ෂර වින්යාසය "වෙන් වූ අකුරු" ලෙස විස්තර කරයි (S12). Wiles බැඳි අකුරු "විකල්ප" ලෙස හඳුන්වයි. නූතන භාවිතයේ සුලබ ඒවා ස්වල්පයකි (S19). කේතනය:
C1 ් ZWJ C2. - වර්ගීකරණය (S8):
- අදත් හමු වන සංයුක්ත අකුරු: ක්ෂ, ක්ව, න්ද, න්ධ, න්ථ, ත්ථ (S8 PDF හි අක්ෂර රූප නැති වී ඇත; නම් kSa, kva, nda, ndha, ntha, ttha ලෙස දී ඇත).
- වත්මන් ලිවීමේ භාවිත නොවන ඒවා: ද්ධ, ද්ව, ට්ඨ, ඤ්ච.
- උදාහරණ: අක්ෂරය
U+0D85 U+0D9A U+0DCA U+200D U+0DC2 U+0DBB U+0DBAසහ අක්ෂරයU+0D85 U+0D9A U+0DCA U+0DC2 U+0DBB U+0DBA; බුද්ධU+0DB6 U+0DD4 U+0DAF U+0DCA U+200D U+0DB0සහ බුද්ධU+0DB6 U+0DD4 U+0DAF U+0DCA U+0DB0; ආනන්දU+0D86 U+0DB1 U+0DB1 U+0DCA U+200D U+0DAF. - විශ්වාසය: ඒවා විකල්ප බව සඳහා ඉහළ; "තවමත් භාවිත වන" ලැයිස්තුව හරියටම සඳහා මධ්යම.
- මූලාශ්ර: S1 (Table 13-4), S8, S12, S19, S17.
HC-031: ස්පර්ශ අකුරු පාලි/සම්භාව්ය පාඨ සඳහා පමණි
- ප්රකාශය: ස්පර්ශ අකුරුවලදී ශුද්ධ ව්යඤ්ජනයක් හල් ලකුණක් වෙනුවට ඊළඟ අකුරට තදින් ඇඳේ. කේතනය:
C1 ZWJ ් C2. ඒවා පැරණි සිංහලයේ භාවිත වන අතර පාලියේ නිතර හමු වේ. නමුත් වත්මන් සිංහලයේ භාවිත නොවේ (S8, S5, S19).- සාමාන්ය යුගල (S8): kka, kkha, gga, ccha, jja, jjha, ṭṭha, ppha, mma, සහ තවත් ඒවා.
- SLS 1134 Part 2 ස්පර්ශ අකුරු අවශ්ය කරන්නේ අකුරු මුහුණත් අනුකූලතා මට්ටම 3 හිදී පමණි. 2009 වන විට දන්නා මට්ටම 3 අකුරු මුහුණතක් නොතිබිණි (S11, S18).
- උදාහරණ: ධම්ම dhamma
U+0DB0 U+0DB8 U+200D U+0DCA U+0DB8; බුද්ධU+0DB6 U+0DD4 U+0DAF U+200D U+0DCA U+0DB0. - විශ්වාසය: ඉහළ.
- මූලාශ්ර: S1, S5, S8, S11, S18, S19.
HC-032: ක්ෂ සහ ක්ෂ
ප්රකාශය: දෙකම එකම පොකුර kṣ සඳහා වලංගු කේතන වේ:
- ක්ෂ (හල් ලකුණ පෙනේ)
U+0D9A U+0DCA U+0DC2නූතන "වෙන් වූ අකුරු" ලිවීමයි; - ක්ෂ
U+0D9A U+0DCA U+200D U+0DC2සාම්ප්රදායික බැඳි අකුරයි.
S16 ඉගැන්වීම් සටහන දෙකම මිශ්ර කරයි: නිරීක්ෂණ, අක්ෂර අසලම රක්ෂණය ඇත. භාවිතයේ ඇති සිංහල පාඨ දෙකම භාවිත කරයි. සෙවීමක් හෝ අක්ෂර වින්යාස පරීක්ෂාවක් ඒවා සමාන ලෙස සැලකිය යුතුය.
- ක්ෂ (හල් ලකුණ පෙනේ)
අක්ෂර වින්යාස නීතිය (කේතනය නොවේ): kṣ ලියන්නේ ෂ (ssa) සමඟය, ශ හෝ ස සමඟ නොවේ. උදා. අක්ෂර, ලක්ෂ (S22, S16).
විශ්වාසය: ඉහළ.
මූලාශ්ර: S1, S8, S16, S22.
HC-033: ර ් ZWJ ය: රේඵය + ya, කිසිවිටෙක ra + යංශය නොවේ
- ප්රකාශය: SLS 1134 (Table 3 සටහන, 2004 කෙටුම්පතේ සහ S9 උපුටා දක්වන 2011 සංශෝධනයේ යන දෙකෙහිම) අනුව ර ට පසු යංශය භාවිත නොවේ. එය kārya හි ra+යංශය ලිවීමක් වැරදි අක්ෂර වින්යාසයට උදාහරණයක් ලෙස දෙයි. එබැවින්
ර ් ZWJ යහි අර්ථය ය මත රේඵයයි. - kārya හි පිළිගත් ලිවීම් (S8):
- සාම්ප්රදායික කාර්ය්ය: අමතර ය එකක් ඇතුළත් කරයි. එය රේඵය සහ යංශය යන දෙකම දරයි.
U+0D9A U+0DCF U+0DBB U+0DCA U+200D U+0DBA U+0DCA U+200D U+0DBA. මෙය SLSI 2004 තීරණ අංක 3 (S4) ට සහ Microsoft හි abvs උදාහරණය වන ර්ය්ය (S5) ටද ගැළපේ. - වත්මන් කාර්ය (රේඵය + ya, යංශය නැත), "මෙයද පිළිගනී"
U+0D9A U+0DCF U+0DBB U+0DCA U+200D U+0DBA - කාර්ය (රේඵය නැත, යංශය නැත)
U+0D9A U+0DCF U+0DBB U+0DCA U+0DBA, "ඉහත ලේඛන ක්රමය අනුගමනය නොකරන අය" භාවිත කරයි
- සාම්ප්රදායික කාර්ය්ය: අමතර ය එකක් ඇතුළත් කරයි. එය රේඵය සහ යංශය යන දෙකම දරයි.
- ගැටුම: 2004 කෙටුම්පත (S3 §5.7) "රේඵය සහිත යංශය"
U+0DBB U+0DCA U+200D U+200C U+0DCA U+200D U+0DBAලෙස (ZWNJ සමඟ) කේතනය කළේය. SLSI තීරණ (S4) මෙය වෙනුවටU+0DBB U+0DCA U+200D U+0DBA U+0DCA U+200D U+0DBAයෙදුවේය. අකුරු මුහුණත්ර ් ZWJ යදර්ශනය කරන ආකාරය එකිනෙකට වෙනස්ය (S9). - එකම පවුල: සූර්ය (NLPC 108), ආර්ය (179), ධෛර්ය (92), ආශ්චර්ය (62), ආචාර්ය (404). ඒවායේ පැරණි ලිවීම් දෙගුණ කළ ය්ය රූපය ගනී. එම රූපය සෑම වචනයකටම හමු වුවද අඩුවෙන් යෙදේ: ර් ට පසු ZWJ ඇති සහ නැති ලිවීම් දෙකම ගණන් කළ විට NLPC හි සූර්ය්ය 21, ආර්ය්ය 81, ධෛර්ය්ය 41, ආශ්චර්ය්ය 18 (දුර්ලභ) සහ ආචාර්ය්ය 53 ටෝකන ඇත. සාමාන්ය හල් ලකුණ සහිත ලිවීම් බෙහෙවින් සුලබය (සූර්ය 3,193, ආචාර්ය 19,206; CC-07, CC-08 සසඳන්න).
- අදාළ වන්නේ: ra, ya, hal.
- විශ්වාසය: නීතිය සඳහා ඉහළ; වඩා කැමති නූතන ප්රභේදය කුමක්දැයි යන්න සඳහා මධ්යම.
- මූලාශ්ර: S3, S4, S5, S8, S9.
HC-034: ර ් ZWJ ර
- ප්රකාශය: ra + රකාරාංශය සහ රේඵය + ra අතරද එම අපැහැදිලිතාව ඇත (S9). සැබෑ වචනවල එය ඉතා දුර්ලභය [භාවිතයේ හමු වූ වචනයක් සොයාගත නොහැකි විය]. HC-033 හා සමානව එය රේඵය + ra ලෙස සලකන්න.
- විශ්වාසය: අඩු.
- මූලාශ්ර: S9.
6. පොකුරු: දේශීය සහ ණය වචන, ද්විත්ව ව්යඤ්ජන, තුන් ගුණ පොකුරු
HC-040: දේශීය සිංහල අක්ෂර (C)V(C) වේ; පොකුරු පැමිණෙන්නේ සංස්කෘත/පාලි/ඉංග්රීසියෙනි
ප්රකාශය: දේශීය වචන (C)V(C), V̄ සහ CV̄(C) අක්ෂරවලට සීමා වේ. CC ඇත්තේ ඉතා සුළු වශයෙනි (S14). දේශීය වචනවල:
- ආරම්භක පොකුරු නැත;
- මැද පොකුරු ඇත්තේ අක්ෂර සීමාවක් හරහා අවසාන ව්යඤ්ජනය + ආරම්භක ව්යඤ්ජනය ලෙස පමණි (බොහෝ දුරට ද්විත්ව ව්යඤ්ජන සහ නාසික + ස්පර්ශ ව්යඤ්ජන).
ආරම්භක පොකුරු (ප්ර-, ක්ර-, ශ්ර-, ස්ව-, ද්ව-, ත්ර-, ස්ථ-) අයත් වන්නේ තත්සම (සංස්කෘත/පාලි) වචනවලට සහ ඉංග්රීසි ණය වචනවලටය (උදා. ස්ටේෂන් "station"). නූගත් කථනය ඒවා බිඳ දැමීමට නැඹුරු වේ (S14).
උදාහරණ: ප්රශ්නය, ක්රමය, ශ්රී, ස්වභාවය
U+0DC3 U+0DCA U+0DC0 U+0DB7 U+0DCF U+0DC0 U+0DBA, ද්වාරයU+0DAF U+0DCA U+0DC0 U+0DCF U+0DBB U+0DBA, ස්ථානයU+0DC3 U+0DCA U+0DAE U+0DCF U+0DB1 U+0DBA.විශ්වාසය: ඉහළ (ව්යුහය); මධ්යම (නිශ්චිත ලැයිස්තුව).
මූලාශ්ර: S14, S1, S8.
HC-041: ආරම්භක පොකුරු සහ ඒවාට අවශ්ය ZWJ
- ප්රකාශය: වචන ආරම්භයේ පොකුරු සඳහා:
- දෙවන සාමාජිකයා ර හෝ ය නම්: සැමවිටම සංක්ෂිප්ත රූපය භාවිත කරන්න, එනම් ZWJ අනිවාර්යය (HC-020/021);
- දෙවන සාමාජිකයා වෙනත් ඕනෑම අකුරක් නම් (ස්ව, ද්ව, ස්ථ, ස්ක, ස්ප, ශ්ව …): පැහැදිලි හල් ලකුණ, ZWJ නැත;
- ක/ත/ද/න ට පසු ව නම්: බැඳි අකුරක් ලිවිය හැකිය (ක්ව, ත්ව, ද්ව, න්ව යුනිකේත Table 13-4 හි ඇත), නමුත් එය විකල්පයකි.
- උදාහරණ: ස්ව
U+0DC3 U+0DCA U+0DC0(ZWJ නැත); ද්වාරය සහ සම්භාව්ය ද්වාරයU+0DAF U+0DCA U+200D U+0DC0 U+0DCF U+0DBB U+0DBA. - විශ්වාසය: ඉහළ.
- මූලාශ්ර: S1, S3, S8.
HC-042: ද්විත්ව ව්යඤ්ජන C ් C ලෙස ලියයි (ZWJ නැත)
- ප්රකාශය: දෙගුණ වූ ව්යඤ්ජන ලියන්නේ පළමු ව්යඤ්ජනය මත පැහැදිලි හල් ලකුණක් සමඟය. ඒවා දේශීය වචනවල ඉතා සුලබය: අම්මා, අක්කා, පත්තරය, බල්ලා, කරන්න. ස්පර්ශ රූපය (
ZWJ ්) භාවිත කරන්නේ පාලි සඳහා පමණි.- සියලු අකුරු ද්විත්ව ලෙස නොයෙදේ. ව්යතිරේක: සඤ්ඤක අකුරු, ඞ (/ŋ/), ෆ, හ සහ ශ (S14).
- රූප විද්යාව අනුව හ ද්විත්ව විය යුතු තැන, ප්රතිඵලය ස්ස වේ (S14).
- සඤ්ඤක අකුරු නාසික + ස්පර්ශ ව්යඤ්ජන බවට ආපසු හැරේ: ඳ → න්ද.
- උදාහරණ: අම්මා
U+0D85 U+0DB8 U+0DCA U+0DB8 U+0DCF; අක්කාU+0D85 U+0D9A U+0DCA U+0D9A U+0DCF; පත්තරයU+0DB4 U+0DAD U+0DCA U+0DAD U+0DBB U+0DBA; බල්ලාU+0DB6 U+0DBD U+0DCA U+0DBD U+0DCF; කණ්ණාඩියU+0D9A U+0DAB U+0DCA U+0DAB U+0DCF U+0DA9 U+0DD2 U+0DBA. - අදාළ වන්නේ: ka ga ca ja tta dda nna ta da na pa ba ma ya la va sa. lla නොවේ: ළ්ළ භාවිත නොවේ (HC-014).
- විශ්වාසය: ඉහළ.
- මූලාශ්ර: S14, S13, S8.
HC-043: තත්ත්වය සහ තත්වය (සහ සත්ත්ව සහ සත්ව)
- ප්රකාශය: සංස්කෘත භාව නාම ප්රත්යය -tva, -t න් අවසන් වන ප්රකෘතිවලට (tat, sat) එකතු වේ. නියාමක නීතිය (S16) තත්සම වචනවල t දෙකම තබා ගනී: තත්ත්වය
U+0DAD U+0DAD U+0DCA U+0DAD U+0DCA U+0DC0 U+0DBA, සත්ත්වයාU+0DC3 U+0DAD U+0DCA U+0DAD U+0DCA U+0DC0 U+0DBA U+0DCF, තත්ත්වඥ. කෙටි කළ ලිවීම් වන තත්වයU+0DAD U+0DAD U+0DCA U+0DC0 U+0DBAසහ සත්වයා නූතන රූප වන අතර ඒවාද වලංගු ලෙස පිළිගැනේ. ලිවීම් දෙකම සුලබය: තත්ත්වය NLPC 25,852, තත්වය 21,484; සත්ත්වයා 539, සත්වයා 1,451. ද්විත්ව t රූපය ව්යාකරණානුකූල (ව්යුත්පත්තිමය) රූපය ලෙස පවතී; දෙකෙන් එකක්වත් වැරදි අක්ෂර වින්යාසයක් නොවේ. - සටහන: ත්ව කොටස ත්ව
U+0DAD U+0DCA U+200D U+0DC0බැඳි අකුර ලෙසද ඇඳිය හැකිය (යුනිකේත Table 13-4). එයින් තුන්වන සහ හතරවන ලිවීමක් ලැබේ (තත්ත්වය). සෙවීම සඳහා සියල්ල සමාන ලෙස සලකන්න. - විශ්වාසය: මධ්යම. S16 ඉගැන්වීම් සටහනක් මිස නිල නියෝගයක් නොවේ. රාජ්ය භාෂා දෙපාර්තමේන්තුවේ හෝ NIE හි තීරණයක් හමු නොවීය.
- මූලාශ්ර: S16; Wiktionary සංස්කෘත तत्त्व තත්ත්ව ලෙස ලැයිස්තුගත කරයි (ඉඟියක් පමණි).
HC-044: තුන් ගුණ (සහ ඊට දිගු) පොකුරු
- ප්රකාශය: මේවා හමු වන්නේ තත්සම වචනවල පමණි. සෑම සන්ධිස්ථානයක්ම වෙන වෙනම කේතනය වේ: ZWJ යොදන්නේ සංක්ෂිප්ත රූපයක් හෝ බැඳි අකුරක් අවශ්ය තැන පමණි. අනෙක් තැන්වල යොදන්නේ සාමාන්ය හල් ලකුණයි.
- උදාහරණ:
- ස්ත්රී strī
U+0DC3 U+0DCA U+0DAD U+0DCA U+200D U+0DBB U+0DD3(s-හල්, t + රකාරාංශය) - රාෂ්ට්ර rāṣṭra
U+0DBB U+0DCF U+0DC2 U+0DCA U+0DA7 U+0DCA U+200D U+0DBB - ක්ෂේත්ර kṣetra: බැඳි රූපය
U+0D9A U+0DCA U+200D U+0DC2 U+0DDA U+0DAD U+0DCA U+200D U+0DBB; හල් රූපයU+0D9A U+0DCA U+0DC2 U+0DDA U+0DAD U+0DCA U+200D U+0DBB - ශාස්ත්ර
U+0DC1 U+0DCF U+0DC3 U+0DCA U+0DAD U+0DCA U+200D U+0DBB - ඉන්ද්රිය
U+0D89 U+0DB1 U+0DCA U+0DAF U+0DCA U+200D U+0DBB U+0DD2 U+0DBA - මන්ත්ර
U+0DB8 U+0DB1 U+0DCA U+0DAD U+0DCA U+200D U+0DBB - ලක්ෂ්ය lakṣya
U+0DBD U+0D9A U+0DCA U+200D U+0DC2 U+0DCA U+200D U+0DBA - මත්ස්ය matsya
U+0DB8 U+0DAD U+0DCA U+0DC3 U+0DCA U+200D U+0DBA - චන්ද්ර
U+0DA0 U+0DB1 U+0DCA U+0DAF U+0DCA U+200D U+0DBB
- ස්ත්රී strī
- විශ්වාසය: කේතනය සඳහා ඉහළ; වචන සඳහා ඉහළ (සුලබ වචන මාලාව).
- මූලාශ්ර: S1, S3 §5.8.
7. විශේෂ අවස්ථා
HC-050: ශ්රී
- ප්රකාශය: śrī ලියන්නේ ශ + හල් ලකුණ + ZWJ + ර + ී ලෙසය:
U+0DC1 U+0DCA U+200D U+0DBB U+0DD3. ZWJ නැතිව, ශ්රීU+0DC1 U+0DCA U+0DBB U+0DD3පෙනෙන හල් ලකුණක් පෙන්වයි. එය "සම්මත නොවේ", නමුත් ක්රමලේඛකයින් බොහෝ විට එය පිළිගනී (S20). දෙකම පුළුල්ව භාවිතයේ ඇත. එබැවින් සෙවීම ඒවා එකම ලෙස සැලකිය යුතුය. - විශ්වාසය: ඉහළ.
- මූලාශ්ර: S20, S1.
HC-051: ජ්ඤ / ඥ
- ප්රකාශය: j + ñ සංයුක්තය ඥ U+0DA5 යන තනි අකුර ලෙස කේතනය කර ඇත (S1). එය ජ ් ZWJ ඤ වලින් ගොඩනැඟිය යුතු නොවේ.
- උච්චාරණය: ඤ සහ ඥ එක ලෙස ශබ්ද වන්නේ වචන ආරම්භයේ පමණි (ඤාණ / ඥාන). වෙනත් තැන්වල ඥ ව්යඤ්ජන ශබ්ද දෙකක් ලෙස හැසිරේ, උදා. ප්රඥා (S3 §3.2 සටහන 2).
- අක්ෂර තත්ත්වය: S8 අනුව ඥ අක්ෂර රූපය j + ñ නියෝජනය කරන බව සැලකේ. එය වත්මන් සිංහලයේ සාමාන්ය අකුරක් බවද S8 කියයි.
- උදාහරණ: ඥානය
U+0DA5 U+0DCF U+0DB1 U+0DBA, ප්රඥාවU+0DB4 U+0DCA U+200D U+0DBB U+0DA5 U+0DCF U+0DC0, විඥානU+0DC0 U+0DD2 U+0DA5 U+0DCF U+0DB1. - අදාළ වන්නේ: jnya, ja, nya.
- විශ්වාසය: ඉහළ.
- මූලාශ්ර: S1, S3, S8.
HC-052: ම / න / ල ට පසු රකාරාංශය
- ප්රකාශය: රකාරාංශයක් ගත හැක්කේ කුමන ව්යඤ්ජනයටදැයි යුනිකේත, SLS හෝ හැඩගැන්වීමේ පිරිවිතර කිසිවක් සීමා නොකරයි. ඕනෑම
C ් ZWJ රවලංගු කේතනයකි. අකුරු මුහුණත් යටින් එන සාමාන්ය රූපය අඳියි.- සංස්කෘත තත්සම වචනවල ම්ර ලිඛිත පාඨයේ දුර්ලභය: තාම්ර "තඹ" (දුර්ලභ: NLPC 3) සහ ආම්ර "අඹ" (දුර්ලභ: NLPC 4, ප්රත්ය සහිතව පමණි). සාමාන්ය ලිවීම් වන තාම්ර සහ ආම්රද තනි වචන ලෙස හමු නොවේ.
- න්ර සහ ල්ර: CC-10 අනුව ඒවායේ ටෝකන 269ක් සහ 100ක් ඇති අතර, සාමාන්ය හල් ලකුණ සහිත ලිවීම්වල 10,133ක් සහ 2,786ක් ඇත. වඩාත් සුලබ බැඳි රූප සාමාන්යයෙන් හල් ලකුණෙන් ලියන වචනවල ZWJ සහිත ලිවීම්ය (හෙන්රි 36, හෙන්රි 3,058). අනෙක් සෑම න්ර හෝ ල්ර රූපයකටම ඇත්තේ ටෝකන 20 කට අඩුවෙනි.
- ලිඛිත පාඨයේ ම න ල + ර සාමාන්ය හල් ලකුණෙන් ලියැවේ. ම න ල ර හා හමු වන තැන සාමාන්යයෙන් රූපිම හෝ අක්ෂර සීමාවක් ඇත: දුම් + රිය, හෙන්රි, ඉම්රාන්, දිල්රුක්ෂි. NLPC වචන මිලියන 2.1 ලැයිස්තුවේ ම්ර ටෝකන 46,496ක් සහ ම්ර 383ක්ද, න්ර 10,133ක් සහ න්ර 269ක්ද ඇත (දුම්රිය 30,800, දුම්රිය 82). අනෙක් C + ර ටෝකනවලින් 98%ක ZWJ ලියා ඇත (CC-09, CC-10). සිංහල විකිපීඩියාවද එකඟ වේ: ම්ර ලිපි 1,148ක ද, ම්ර 63ක ද ඇත (CC-16). ZWJ යෙදුවහොත් ම යටින් රකාරාංශයක් ඇඳේ. පාඨකයෝ මෙම වචන සඳහා එම රූපය භාවිත නොකරති.
- එබැවින් HC-021 හි සාමාන්ය නීතිය (C + ර ZWJ ගනී) අක්ෂරයක් තුළ වලංගුය. ම න ල ට පසු සාමාන්ය රූපය සම්මතය වන අතර, ම්ර හිතාමතා යොදන සම්භාව්ය ශෛලියකට තබා ඇත.
- විශ්වාසය: මධ්යම (කේතනය ඉහළ; භාවිතය එක් මූලාශ්රයකින්).
- මූලාශ්ර: S1, S3, S5, S17, S25.
HC-053: ඤ්ච / ඤ්ජ (pañca, vyañjana)
- ප්රකාශය:
- Noto හි ඤ්ච සඳහා බැඳි අක්ෂර රූපයක් ඇත (
nya_ca). S8 "njca" භාවිතයෙන් ඉවත් වූ සංයුක්ත අකුරු අතර ලැයිස්තුගත කරයි. නූතන අක්ෂර වින්යාසය හල් ලකුණ භාවිත කරයි: පඤ්චU+0DB4 U+0DA4 U+0DCA U+0DA0, ව්යඤ්ජනU+0DC0 U+0DCA U+200D U+0DBA U+0DA4 U+0DCA U+0DA2 U+0DB1. - ඤ්ජ සඳහා වෙනම බැඳි අකුරක් ඇති බව විමසූ මූලාශ්රවල සඳහන් නොවේ [විසඳා නැත].
- මේ දෙකෙන් එකක්වත් ඦ (nyja) සමඟ පටලවා ගන්න එපා. එය කිසිවිටෙක හල් ලකුණ නොගන්නා පුරාතන සඤ්ඤක අකුරකි.
- Noto හි ඤ්ච සඳහා බැඳි අක්ෂර රූපයක් ඇත (
- විශ්වාසය: මධ්යම.
- මූලාශ්ර: S8, S17, S3.
HC-054: වචන ඇතුළත ය / ර ට පෙර ර්
ප්රකාශය: HC-033 සහ HC-034 බලන්න. ස්වරයකට පසු රෝමානු
r+yඑන විට, සිංහල ලිවීම් තුනක් ඇත:- රේඵය + ya (
ර ් ZWJ ය); - පැහැදිලි හල් ලකුණ (
ර ් ය); - සාම්ප්රදායික දෙගුණ රූපය (
ර ් ZWJ ය ් ZWJ ය).
ra + යංශය කිසිවිටෙක වලංගු තේරීමක් නොවේ.
- රේඵය + ya (
විශ්වාසය: ඉහළ.
මූලාශ්ර: S3, S8, S9.
8. ගබඩා කළ පාඨය සඳහා SLS 1134 නියම කරන දේ
HC-060: අභ්යන්තර නිරූපණය (ගබඩා කළ අනුක්රම)
- ප්රකාශය: SLS 1134 (§5) ගබඩා කළ අනුක්රම නියම කරයි. අනුකූල පාඨය ඒවා භාවිත කළ යුතුය:
- ශුද්ධ ව්යඤ්ජනය =
C ්; - රකාරාංශය/යංශය =
C ් ZWJ ර/ය; - රේඵය =
ර ් ZWJ C; - අනෙක් සංයුක්ත අකුරු =
C ් ZWJ C; - ස්පර්ශ =
C ZWJ ් C(2011); - සංයුක්ත ස්වර ලකුණු: තනි පූර්ව සංයුක්ත ලකුණ භාවිත කරන්න. උදාහරණයක් ලෙස කෝ යනු ක + ෝ (U+0DDD) මිස ක + ෙ + ා + ් නොවේ. වෙන් වූ ලකුණුවල අනුක්රම භාවිත නොකිරීමට එය උපදෙස් දෙයි ("discouraged", S3 §5.4 සටහන 2).
- ශුද්ධ ව්යඤ්ජනය =
- විශ්වාසය: ඉහළ.
- මූලාශ්ර: S3, S1, S10.
HC-062: අකුරු මුහුණත් අනුකූලතා මට්ටම් (SLS 1134 Part 2:2007)
ප්රකාශය: අකුරු මුහුණත් මට්ටම් තුනක් ඇත.
- මට්ටම 1 = ඏ ඐ ෟ ෳ ෴ හැර සම්පූර්ණ අක්ෂර කට්ටලය.
- ස්පර්ශ අකුරු අවශ්ය වන්නේ මට්ටම 3 හිදී පමණි.
එබැවින් ස්පර්ශ අනුක්රම සහිත පාඨය බොහෝ පද්ධතිවල බිඳුණු ලෙස පෙනෙනු ඇත.
විශ්වාසය: මධ්යම (ද්විතීයික උපුටා දැක්වීම්).
මූලාශ්ර: S18, S11.
9. දන්නා සංයුක්ත / සංක්ෂිප්ත / ස්පර්ශ රූපවල සම්පූර්ණ වගුව
සංකේත විස්තරය:
- තත්ත්වය: M = නිවැරදි නූතන අක්ෂර වින්යාසයේ අනිවාර්යය; O = විකල්ප (රූප දෙකම පිළිගනී); C = සම්භාව්ය/පාලි පමණි (අද දුර්ලභය); P = නව වචනවලටද අදාළ වන (productive) රටාව (ඕනෑම ව්යඤ්ජනයක්).
- මූලා.: U = යුනිකේත Table 13-3/13-4; N = Noto Sans Sinhala හි ඇත; I = ICANN LGR; W = si.wikipedia; S = SLS 1134; MS = Microsoft පිරිවිතරය.
- අකුරු හැඳුනුම් මෙම ගබඩාව පුරා භාවිත වන ඒවාමය.
9a. සංක්ෂිප්ත රූප (නව වචනවලටද අදාළ වේ)
| රූපය | අකුරු | තත්ත්වය | අනුක්රමය | උදාහරණය | මූලා. |
|---|---|---|---|---|---|
| ක්ය (යංශය) | C + hal + ya | M | U+0D9A U+0DCA U+200D U+0DBA | වාක්ය | U S MS I |
| ක්ර (රකාරාංශය) | C + hal + ra | M | U+0D9A U+0DCA U+200D U+0DBB | ක්රමය | U S MS I |
| ර්ක (රේඵය) | ra + hal + C | O | U+0DBB U+0DCA U+200D U+0D9A | තර්කය | U S MS I |
| ර්ය්ය (රේඵය+ya+යංශය) | ra ya ya | O (සාම්ප්රදායික) | U+0DBB U+0DCA U+200D U+0DBA U+0DCA U+200D U+0DBA | කාර්ය්ය | S(2004 WG) MS I |
| සංයුක්ත අකුර + රකාරාංශය | උදා. na da ra | -r සඳහා M | U+0DB1 U+0DCA U+200D U+0DAF U+0DCA U+200D U+0DBB | චන්ද්ර (බැඳි) | S |
| ස්ත්ර (හල් ලකුණ + රකාරාංශය) | sa ta ra | -r සඳහා M | U+0DC3 U+0DCA U+0DAD U+0DCA U+200D U+0DBB | ස්ත්රී | - |
9b. බැඳි අකුරු (C1 ් ZWJ C2): සියල්ල විකල්පය
| රූපය | හැඳුනුම් | තත්ත්වය | අනුක්රමය | උදාහරණ වචනය | මූලා. |
|---|---|---|---|---|---|
| ක්ෂ | ka+ssa | O (තවමත් සුලබය) | U+0D9A U+0DCA U+200D U+0DC2 | අක්ෂරය, ලක්ෂ | U N I W |
| ක්ව | ka+va | O | U+0D9A U+0DCA U+200D U+0DC0 | පක්ව | U N I W MS |
| ග්ධ | ga+dha | O / C | U+0D9C U+0DCA U+200D U+0DB0 | දුග්ධ, මුග්ධ | U N |
| ට්ඨ | tta+ttha | C (I අනුව වත්මන් භාවිතයේ නැත) | U+0DA7 U+0DCA U+200D U+0DA8 | අට්ඨකථා (පාලි) | U N I |
| ත්ථ | ta+tha | O / C | U+0DAD U+0DCA U+200D U+0DAE | (පාලි) අත්ථ | U N I W |
| ත්ව | ta+va | O | U+0DAD U+0DCA U+200D U+0DC0 | සත්ව, මහත්වය | U N W |
| ද්ධ | da+dha | C (I අනුව වත්මන් භාවිතයේ නැත) | U+0DAF U+0DCA U+200D U+0DB0 | බුද්ධ | U N I |
| ද්ව | da+va | C (I අනුව වත්මන් භාවිතයේ නැත) | U+0DAF U+0DCA U+200D U+0DC0 | ද්විත්ව | U N I |
| න්ථ | na+tha | O | U+0DB1 U+0DCA U+200D U+0DAE | ග්රන්ථ | U N I |
| න්ද | na+da | O | U+0DB1 U+0DCA U+200D U+0DAF | ආනන්ද, චන්ද්ර | U N I W |
| න්ධ | na+dha | O | U+0DB1 U+0DCA U+200D U+0DB0 | සන්ධි, බන්ධන | U N I W |
| න්ව | na+va | O | U+0DB1 U+0DCA U+200D U+0DC0 | අන්වය | U N |
| ඤ්ච | nya+ca | C (I අනුව වත්මන් භාවිතයේ නැත) | U+0DA4 U+0DCA U+200D U+0DA0 | පඤ්ච | N I |
| ඥ | ja+nya | M (තනි අකුර U+0DA5) | U+0DA5 | ඥානය | U I |
| ඳ්ඨ, ඳ්ධ, ඳ්ව | nda+… | සැක සහිත | U+0DB3 U+0DCA U+200D U+0DB0 | - | W පමණි (I සමඟ ගැටේ) |
9c. ස්පර්ශ අකුරු (C1 ZWJ ් C2): පාලි/සම්භාව්ය, නව වචනවලටද අදාළ වේ
| රූපය | හැඳුනුම් | අනුක්රමය | සටහන | මූලා. |
|---|---|---|---|---|
| ක්ක | ka+ka | U+0D9A U+200D U+0DCA U+0D9A | MS උදාහරණය | MS I |
| ක්ඛ | ka+kha | U+0D9A U+200D U+0DCA U+0D9B | I | |
| ග්ග | ga+ga | U+0D9C U+200D U+0DCA U+0D9C | I | |
| ච්ඡ | ca+cha | U+0DA0 U+200D U+0DCA U+0DA1 | I | |
| ජ්ජ | ja+ja | U+0DA2 U+200D U+0DCA U+0DA2 | I | |
| ජ්ඣ | ja+jha | U+0DA2 U+200D U+0DCA U+0DA3 | I | |
| ට්ඨ | tta+ttha | U+0DA7 U+200D U+0DCA U+0DA8 | I | |
| ප්ඵ | pa+pha | U+0DB4 U+200D U+0DCA U+0DB5 | I | |
| ම්ම | ma+ma | U+0DB8 U+200D U+0DCA U+0DB8 | dhamma | W I |
| ද්ධ | da+dha | U+0DAF U+200D U+0DCA U+0DB0 | යුනිකේත උදාහරණය | U |
| ඕනෑම C1 + C2 | - | C1 U+200D U+0DCA C2 | යුනිකේත: "productive" (නව වචනවලටද අදාළ වන) | U |
10. රෝමානුකරණය සහ අක්ෂර පරිවර්තනය සඳහා ඇඟවුම්
මෙම කරුණු අදාළ වන්නේ ලතින් අකුරු රෝමානුකරණයක් සහ සිංහල අකුරු අතර පරිවර්තනය කරන ඕනෑම කෙනෙකුට, නැතහොත් ගබඩා කළ සිංහල පාඨය වලංගු කරන හෝ සොයන ඕනෑම කෙනෙකුටය.
- ස්වරයක් නැති සෑම ව්යඤ්ජනයකම හල් ලකුණ ඇත. පසුව තවත් ව්යඤ්ජනයක් හෝ වචන සීමාවක් එන රෝමානු ව්යඤ්ජනයක්
C + ්ට අනුරූප වේ. schwa මත පදනම්ව හල් ලකුණ කිසිවිටෙක අනුමාන නොකෙරේ:aසහ schwa සඳහා වූə/eයන දෙකේම අර්ථය "ලකුණක් නැත" යන්නයි (HC-010, HC-011). - C + r සහ C + y ZWJ ගනී.
C + r/C + yඅනුරූප වන්නේC ් ZWJ ර/යටය (රකාරාංශය/යංශය). එය එකම පිළිගත් නූතන ලිවීමයි (HC-020, HC-021). ව්යතිරේකය: ර ට පසුryකිසිවිටෙක ra + යංශය නොවේ (HC-033). - රේඵය ව්යාකරණයක් නොව විලාස තේරීමකි.
rCඅනුරූප විය හැක්කේර් C(හල් ලකුණ) හෝර ් ZWJ C(රේඵය) ටය; දෙකම නිවැරදිය. පරිවර්තකයක් තමන් නිපදවන්නේ කුමක්දැයි ලේඛනගත කළ යුතුය; රේඵය සාම්ප්රදායික මුද්රිත රූපයට ගැළපේ. ර්ය සඳහා සාමාන්ය හල් ලකුණ සහිත විකල්පයක්ද ඇත (HC-022, HC-033). - බැඳි අකුරු විකල්පය. kṣ ක්ෂ ලෙස ලියනවාද ක්ෂ ලෙස ලියනවාද යන්න විලාස තීරණයකි, මන්ද දෙකම සුලබ බැවිනි (HC-032). අනෙක් සියලු බැඳි අකුරු (ද්ධ, න්ද, ත්ව …) සම්භාව්යය: නූතන ලිවීම සාමාන්ය හල් ලකුණයි. ZWJ යොදන්නේ හිතාමතාම සම්භාව්ය විලාසයක් අවශ්ය විට පමණි (HC-030).
- ස්පර්ශ අකුරු පාලි/සම්භාව්ය පාඨවලට අයත්ය. ඒවා
C ZWJ ්ලෙස කේතනය කරයි. SLS මට්ටම 3 ට අඩු බොහෝ අකුරු මුහුණත් ඒවා දුර්වල ලෙස දර්ශනය කරයි (HC-031, HC-062). - ඥ සඳහා වෙනම රෝමානු ලිවීමක් අවශ්යය (උදා.
GN/jny). එය කිසිවිටෙකජ ් ZWJ ඤලෙස සංයෝජනය නොකෙරේ (HC-051). - ද්විත්ව ව්යඤ්ජන: දෙගුණ වූ ව්යඤ්ජනයක් (
amma,akka,paththaraya) →C ් C, ZWJ නැත (HC-042). -tva වචන සඳහා තත්ත්වය සහ තත්වය යන දෙකම පිළිගැනේ: තත්ත්වය ව්යාකරණානුකූල රූපය වන අතර තත්වය නූතන රූපයයි (HC-043). - සඤ්ඤක අකුරු සහ ළ හල් ලකුණ ගත නොහැක. රෝමානු
nd+ ව්යඤ්ජනය න්ද… (දන්තජ n + හල් ලකුණ) ලෙස විසඳේ, ඳ් ලෙස නොවේ (HC-014). - වචන අවසාන නාසිකයේ අපැහැදිලිතාව: අවසාන
ngං, න් හෝ ම් විය හැකිය (HC-012). එය විසඳීමට ස්ථිර නීතියක් නොව ශබ්දකෝෂයක් අවශ්යය. - පොකුරුවල ස්වරය යෙදෙන්නේ අවසාන ව්යඤ්ජනයටය.
kre→ ක්රෙ (ක ් ZWJ ර ෙ).kyoo→ ක්යෝ. පූර්ව සංයුක්ත ස්වර ලකුණ භාවිත කරන්න (ෝ U+0DDD ආදිය). කිසිවිටෙක බෙදූ අනුක්රමයක් භාවිත නොකරන්න (HC-060). - රකාරාංශය සමඟ ලියූ
kru/kruuු/ූ (U+0DD4/U+0DD6) භාවිත කරයි, අක්ෂර රූපය ැ/ෑ මෙන් පෙනුණත් (HC-024). වඩා සුලබ ලිවීම C + ෘ/ෲ වේ (කෘ, කෲ; 02:VS-035). - සාමාන්යකරණය/සෙවීම: ගැළපීම සඳහා
C ් ZWJ C,C ් CසහC ZWJ ් Cඑකම ලෙස සලකන්න. ලේඛකයින් සහ දත්ත මූලාශ්ර ඒවා මිශ්ර කරයි (ශ්රී/ශ්රී, අක්ෂර/අක්ෂර). ගබඩා කළ හෝ පරිවර්තනය කළ පාඨයෙන් කිසිවිටෙක ZWJ ඉවත් නොකරන්න. IDNA හල් ලකුණකට (virama) පසු ZWJ ට ඉඩ දෙයි (S24), නමුත් root-zone LGR එය බැහැර කරයි (S8). - ZWNJ සාමාන්ය පාඨයට අයත් නොවේ (HC-005).
- ලිවීමේ අනුපිළිවෙළ සහ ගබඩා අනුපිළිවෙළ. රෝමානු ලිවීමක් ස්වභාවයෙන්ම තාර්කික අනුපිළිවෙළට ඇත. රේඵය සඳහා
rමුලින්ම එයි. ගබඩා කළ රූපය මූල ව්යඤ්ජනයට පෙරර ් ZWJවේ. රේඵය ඊළඟ ව්යඤ්ජනයට උඩින් ඇඳුණත්, මෙය දැනටමත් තාර්කික අනුපිළිවෙළයි (HC-022).
11. විසඳා නැති ප්රශ්න / ගැටෙන මූලාශ්ර
ස්පර්ශ අකුරු කේතනයේ ඉතිහාසය. 2004 SLS කෙටුම්පත සංයුක්ත අකුරු සහ ස්පර්ශ අකුරු යන දෙකටම
් ZWJභාවිත කළේය. SLSI 2004 ජූනි රැස්වීම් වාර්තාවල සම්බන්ධකය තීරණය කර නොතිබිණි (ZWNJ හෝ ZWJ+ZWNJ+ZWJ). යුනිකේත, Microsoft සහ (Harshula අනුව) SLS 1134:2011ZWJ ්භාවිත කරයි. අවසාන SLS 1134:2004 සහ 2011 පාඨ සෘජුවම තහවුරු කිරීමට ලබාගත නොහැකි විය. (S3, S4, S10)රේඵය සහිත යංශයේ කේතනය. අපේක්ෂක තුනක් ඇත:
- SLS කෙටුම්පත:
ර ් ZWJ ZWNJ ් ZWJ ය - SLSI WG 2004:
ර ් ZWJ ය ් ZWJ ය - නූතන සරල කළ රූපය:
ර ් ZWJ ය(ya මත රේඵය)
අකුරු මුහුණත්
ර ් ZWJ යඅසංගත ලෙස දර්ශනය කරයි (S9). SLS 1134:2011 අනිවාර්ය කරන්නේ කුමක්ද? මෙය විසඳා නැත: 2011 පාඨය සෘජුවම විමසා නැත.- SLS කෙටුම්පත:
තනි ලකුණු: ZWNJ මත පදනම් වූ (2004 කෙටුම්පත) සහ SPACE මත පදනම් වූ (SLSI WG 2004 තීරණය). අඛණ්ඩ පාඨයට අදාළ නැත, නමුත් ලකුණක් තනිව පෙන්වන ලේඛන සඳහා වැදගත් වේ.
ඳ + හල් ලකුණ සංයුක්ත අකුරු (ඳ්ධ ආදිය) si.wikipedia හි ඇත (S15). ICANN (S8) අනුව සඤ්ඤක අකුරු කිසිවිටෙක හල් ලකුණ නොගනී. S15 බොහෝ දුරට වැරදි හෝ පුරාතන විය හැකිය.
"තවමත් භාවිත වන" ලෙස සැලකෙන බැඳි අකුරු මොනවාද. ICANN ක්ෂ, ක්ව, න්ද, න්ධ, න්ථ, ත්ථ වත්මන් භාවිතයේ ඇති ලෙස දක්වයි, නමුත් PDF හි එහි පාඨය විකෘතිය. Harshula අනුව නූතන ලිවීමේ r/y රූප හැර දැඩි බැඳීමක් නැත. මෙම බැඳි අකුරු සඳහා පෙළ සංග්රහ සංඛ්යාත දත්ත තවම සම්පාදනය කර නැත. ඤ්ජ සඳහා වෙනම බැඳි අකුරක් තිබේද යන්නද (HC-053) විසඳා නැත.
වත්මන් NIE පෙළපොත්වල ක්ෂ සහ ක්ෂ අතර කැමැත්ත: නොදනී. S16 සටහන් දෙකම භාවිත කරයි.
තත්ත්වය සහ තත්වය: දෙකම පිළිගැනේ (HC-043). ව්යාකරණානුකූල ද්විත්ව t රූපය ලිඛිතව සඳහන් කරන්නේ ඉගැන්වීම් සටහනක් (S16) පමණි. නූතන රූපය නිල වශයෙන් අනුමත දැයි බැලීමට නිල තීරණයක් (රාජ්ය භාෂා දෙපාර්තමේන්තුව / NIE "Sinhala Lekhana Rithiya", 1989) විමසීමට ලබාගත නොහැකි විය.
වචන අවසාන න්/ම් → [ŋ] (S14) එක් ඉඟි මූලාශ්රයක් පමණි. Gair/Karunatillake සමඟ සසඳා පරීක්ෂා කර නැත.
ම්ර, න්ර, ල්ර (විසඳා ඇත). පෙළ සංග්රහ ගණනය (CC-10) අනුව ම්ර 46,496 සහ ම්ර 383, න්ර 10,133 සහ න්ර 269, ල්ර 2,786 සහ ල්ර 100 ටෝකන ඇත. බැඳි රූප බොහෝ දුරට සාමාන්ය හල් ලකුණෙන් ලියන වචනවල ZWJ සහිත ලිවීම්ය (දුම්රිය 82, හෙන්රි 36). තත්සම ම්ර වචන දුර්ලභය (තාම්ර 3). HC-052 බලන්න.
SLS Table 3 ගණන: එය යංශ සංයෝජන "7" ක් යැයි කියයි, නමුත් 8 ක් ලැයිස්තුගත කරයි. රකාරාංශය සමඟ u/uu එහි ඇතුළත් කර නැත, නමුත් යුනිකේත ක්රු/ක්රූ හැඩ පෙන්වයි. මෙය කෙටුම්පතේ සංස්කරණ දෝෂයක් විය හැකිය.
"Sinhala Lekhana Rithiya" (NIE 1989) හෝඩියේ මූලාශ්රය ලෙස S8 උපුටා දක්වයි. එය ලබාගත නොහැකි වූ අතර, පාසල් මට්ටමේ හල් ලකුණ/සංයුක්ත අකුරු නීති සඳහා හොඳම මූලාශ්රය එය විය හැකිය.
වැරදි කේතන පිළිබඳ පෙළ සංග්රහ සාක්ෂි (රකාරාංශයට පසු u/uu සඳහා ැ/ෑ). S13 හි උදාහරණ විකෘති වූ පැරණි අකුරු මුහුණතක ඇත. එබැවින් නිශ්චිත වචන අනුමාන කළ ඒවාය.
ඉවත් කළ නීති: HC-025, HC-061 (විෂය පථයෙන් පිටත බැවින් ඉවත් කරන ලදී).