कंटेंट पर जाएं

फ़ोनीम क्या है? परिभाषा और अंग्रेज़ी के 44 फ़ोनीम

लेखक
Jack Limebear
प्रकाशित
आखिरी बार अपडेट किया गया

सुनेंइस आर्टिकल को सुनें

स्वनिम किसी भाषा में ध्वनि की सबसे छोटी इकाई है, जो किसी शब्द का अर्थ बदल सकती है। एक स्वनिम बदलने पर बिल्कुल अलग शब्द बन सकता है। /æt/ के साथ /p/ और /b/ जुड़कर ‘pat’ और ‘bat’ बनाते हैं, जो दो पूरी तरह अलग शब्द हैं। 

खासकर अंग्रेज़ी में, स्वनिम ही वे कारण हैं जिनसे वर्तनी और ध्वनि अक्सर मेल नहीं खातीं। “fox” जैसे शब्द में चार अलग-अलग स्वनिम होते हैं (/f/ /ɒ/ /k/ /s/), लेकिन अक्षर केवल तीन होते हैं, जबकि ‘ship’ में चार अक्षर होते हैं लेकिन सिर्फ़ तीन स्वनिम (/ʃ/ /ɪ/ /p/)। भाषा सीखने और यह समझने के लिए कि आधुनिक टेक्स्ट टू स्पीच सिस्टम लिखे शब्दों को प्राकृतिक लगने वाली आवाज़ में कैसे बदलते हैं, स्वनिमों को समझना ज़रूरी है।

इस लेख में उदाहरणों के साथ बताया गया है कि स्वनिम क्या है, अंग्रेज़ी के सभी 44 स्वनिमों का पूरा चार्ट दिया गया है, और यह भी कि AI वॉइस तकनीक सही उच्चारण के लिए स्वनिम-स्तरीय नियंत्रण का उपयोग कैसे करती है।

सारांश:

  • स्वनिम बोली जाने वाली भाषा में ध्वनि की सबसे छोटी इकाई है, जो शब्द का अर्थ बदल सकती है।
  • अधिकांश भाषाविद् अंग्रेज़ी में 44 स्वनिम मानते हैं, जिनमें 24 व्यंजन ध्वनियां और 20 स्वर ध्वनियां शामिल हैं।
  • स्वनिम ध्वनियों का वर्णन करते हैं, जबकि ग्राफीम वे अक्षर या अक्षरों के समूह हैं जो लिखित रूप में किसी स्वनिम का प्रतिनिधित्व करते हैं।
  • अंतरराष्ट्रीय ध्वन्यात्मक वर्णमाला (IPA) स्वनिमों को दर्शाने वाले प्रतीकों को मानकीकृत करती है, ताकि इन ध्वनियों के उच्चारण में एकरूपता बनी रहे।
  • टेक्स्ट टू स्पीच टूल ऑडियो फ़ाइल बनाने से पहले ग्राफीमों को स्वनिमों में बदलते हैं।

स्वनिम क्या है?

स्वनिम ध्वनि की सबसे छोटी इकाई है जो एक शब्द को दूसरे से अलग कर सकती है। भाषाविद् ऐसे दो शब्द ढूंढकर स्वनिम पहचानते हैं जिनमें सिर्फ़ एक ध्वनि का अंतर हो। ऐसे शब्दों को न्यूनतम युग्म कहा जाता है, जैसे:

  • Pat / bat: इस न्यूनतम युग्म में /p/ और /b/ अलग-अलग स्वनिम हैं।
  • Ship / sheep: /ɪ/ और /iː/ वे स्वनिम हैं जो इन शब्दों को बदलते हैं।
  • Bat / bad: /t/ और /d/ वे अलग स्वनिम हैं जो इन शब्दों में अंतर दर्शाते हैं।

अगर किसी शब्द में एक ध्वनि बदलने से नया शब्द बनता है, तो वे दोनों ध्वनियां उस भाषा में अलग स्वनिम हैं। अगर उससे उसी शब्द का बस थोड़ा अलग सुनाई देने वाला रूप बनता है, तो वे एक ही स्वनिम के रूपांतर हैं।

“phoneme” शब्द यूनानी शब्द phōnēma से आया है, जिसका अर्थ है बोली गई या उत्पन्न ध्वनि। स्वनिमों को परिभाषित करते समय यह याद रखना उपयोगी है, क्योंकि वे ध्वनि की इकाइयां हैं, वर्तनी की जानकारी नहीं। जैसा कि आप आगे देखेंगे, स्वनिम केवल एकल अक्षरों तक सीमित नहीं हैं, बल्कि पूरी श्रव्य ध्वनियों को समेटते हैं। 

अंग्रेज़ी में कितने स्वनिम हैं?

अंग्रेज़ी में 24 व्यंजन स्वनिम और 20 स्वर स्वनिम मिलाकर 44 स्वनिम हैं। हालांकि, यह सिर्फ़ एक सामान्य अनुमान है। उच्चारण और भाषाविद् अलग-अलग ध्वनियों को कैसे परिभाषित करते हैं, इस पर निर्भर करते हुए कुछ लोग इनकी संख्या 42 और कुछ 45 तक मानते हैं। उदाहरण के लिए, सामान्य अमेरिकी उच्चारण में “car” का /r/ बोला जाता है, जबकि रिसीव्ड प्रनन्सिएशन (ब्रिटिश) में नहीं, इसलिए इन उच्चारणों में कुल संख्या अलग होती है।

अन्य उच्चारणों में स्वर आपस में मिल सकते हैं, जिससे कुल गिनती में स्वनिम कम हो जाते हैं। स्वर-विलय, जैसे कुछ अमेरिकी लोग “cot” और “caught” को एक जैसा बोलते हैं, भाषाविदों के कुल आंकड़ों के आकलन को प्रभावित करते हैं। कुछ सीमांत ध्वनियां भी संख्या बदल सकती हैं, जहां द्विस्वरों को एकल स्वनिम की बजाय संयोजन माना जाता है। उदाहरण के लिए, कुछ प्रणालियां /ʍ/ (‘which’ की शुरुआत में आने वाली सांसयुक्त ध्वनि) को अलग स्वनिम मानती हैं, जबकि दूसरी इसे /h/ और /w/ का संयोजन मानती हैं।

मानक गिनती 44-स्वनिम मॉडल की है। इसमें ठीक 24 व्यंजन, 12 एकस्वर और 8 द्विस्वर होते हैं। यही मानक ब्रिटेन में ध्वनिविज्ञान की शिक्षा और ESL निर्देश में इस्तेमाल होता है। 

अंग्रेज़ी के 44 स्वनिम: उदाहरणों के साथ पूरा चार्ट

व्यंजन स्वनिम (24)

Example words
/b/
bat, rubber
/d/
dog, add
/f/
fish, phone, laugh
/g/
go, egg
/h/
hat, who
/dʒ/
jam, bridge, giant
/k/
cat, kite, duck, school
/l/
leg, bell
/m/
map, hammer, comb
/n/
net, dinner, knee
/p/
pen, happy
/r/
rat, berry, write
/s/
sun, dress, city
/t/
top, letter, walked
/v/
van, of
/w/
wet, wheel
/j/
yes, onion
/z/
zip, fizz, rose
/θ/
thin, bath
/ð/
this, mother
/ŋ/
ring, sink
/ʃ/
ship, mission, ocean
/tʃ/
chip, match, nature
/ʒ/
measure, vision, beige
Common spellings
/b/
b, bb
/d/
d, dd, ed
/f/
f, ff, ph, gh
/g/
g, gg, gu
/h/
h, wh
/dʒ/
j, dge, g, ge
/k/
c, k, ck, ch, qu
/l/
l, ll
/m/
m, mm, mb
/n/
n, nn, kn, gn
/p/
p, pp
/r/
r, rr, wr
/s/
s, ss, c, ce, sc
/t/
t, tt, ed
/v/
v, ve, f
/w/
w, wh, u
/j/
y, i
/z/
z, zz, s, se
/θ/
th (voiceless)
/ð/
th (voiced)
/ŋ/
ng, n
/ʃ/
sh, ss, ti, ci, ch
/tʃ/
ch, tch, t
/ʒ/
s, si, ge

स्वर स्वनिम (12 एकस्वर + 8 द्विस्वर = कुल 20)

Example words
/æ/
cat, hand
/e/
bed, bread
/ɪ/
sit, gym
/ɒ/
hot, want
/ʌ/
cup, son
/ʊ/
put, book
/ə/
about, teacher (the "schwa", English's most common sound)
/iː/
sheep, key
/ɑː/
car, father
/ɔː/
door, law
/uː/
moon, blue
/ɜː/
bird, nurse
/eɪ/
day, rain
/aɪ/
my, light
/ɔɪ/
boy, coin
/aʊ/
cow, house
/əʊ/
go, boat
/ɪə/
here, deer
/eə/
hair, bear
/ʊə/
tour, pure
Type
/æ/
short vowel
/e/
short vowel
/ɪ/
short vowel
/ɒ/
short vowel
/ʌ/
short vowel
/ʊ/
short vowel
/ə/
short vowel
/iː/
long vowel
/ɑː/
long vowel
/ɔː/
long vowel
/uː/
long vowel
/ɜː/
long vowel
/eɪ/
diphthong
/aɪ/
diphthong
/ɔɪ/
diphthong
/aʊ/
diphthong
/əʊ/
diphthong
/ɪə/
diphthong
/eə/
diphthong
/ʊə/
diphthong

प्रतीक अधिकांश फॉनिक्स पाठ्यक्रमों में इस्तेमाल होने वाली ब्रिटिश अंग्रेज़ी (RP) प्रणाली के अनुसार हैं; r-रंगित स्वरों के लिए सामान्य अमेरिकी विश्लेषण में थोड़ा अंतर होता है।

स्वनिम और ग्राफीम में क्या अंतर है?

स्वनिम एक ध्वनि है, जबकि ग्राफीम उस ध्वनि का लिखित रूप है। ग्राफीम एक अक्षर (c-a-t), दो अक्षर (डाइग्राफ, जैसे sh या ea), तीन अक्षर (“night” में igh), या चार अक्षर (“though” में ough) हो सकता है।

स्वनिमों और ग्राफीमों का बेमेल होना ही अंग्रेज़ी की वर्तनी को कुख्यात रूप से कठिन बनाता है। उदाहरण के लिए:

  • एक स्वनिम, कई ग्राफीम: /iː/ ध्वनि को ee (sheep), ea (leaf), e (be), ey (key), ie (chief), या ei (ceiling) लिखा जा सकता है।
  • एक ग्राफीम, कई स्वनिम: ough अक्षर “through” (/uː/), “though” (/əʊ/), “tough” (/ʌf/) और “thought” (/ɔː/) में अलग-अलग स्वनिम दर्शाते हैं।

हालांकि अंग्रेज़ी में 44 स्वनिम हैं, लेकिन उन्हें लिखने के लिए 200 से अधिक ग्राफीम हैं। स्पेनिश जैसी अधिक ध्वन्यात्मक भाषा में, जहां मानचित्रण लगभग एक-से-एक होता है, अंग्रेज़ी बोलना और लिप्यंतरित करना बेहद जटिल हो जाता है। यही वजह है कि टेक्स्ट टू स्पीच मॉडल केवल अक्षरों को पढ़ नहीं सकता, जिस पर हम जल्द ही फिर आएंगे। 

Comparison of English what is a phonemes and graphemes highlighting spelling complexity.

स्वनिम बनाम एलोफ़ोन

एलोफ़ोन एक ही स्वनिम के अलग-अलग उच्चारण हैं, जो शब्द का अर्थ नहीं बदलते। अगर कोई ऐसा न्यूनतम युग्म नहीं है जिसमें एक स्वनिम दो अलग शब्द बनाता हो, तो वहां एलोफ़ोन होता है।

उदाहरण के लिए, “pat” में /p/ की ध्वनि “spat” में उसके बिना-प्रश्वास वाले रूप से अलग सुनाई देती है। ये अलग ध्वनियां हैं, लेकिन केवल इस प्रश्वास के आधार पर कोई अंग्रेज़ी शब्द-युग्म अलग नहीं होता, यानी अंग्रेज़ी बोलने वाले इन्हें मूलतः एक ही ध्वनि मानते हैं। थाई जैसी अन्य भाषाओं में, प्रश्वासयुक्त और बिना-प्रश्वास वाले /p/ का अंतर अलग स्वनिम बनाता है, जो शब्दों को पूरी तरह अलग कर देता है।

इसका मतलब है कि किसे स्वनिम माना जाएगा, यह पूरी तरह भाषा-विशिष्ट है। बात सिर्फ़ ध्वनिकी की नहीं, बल्कि इस बात की है कि ध्वनियां शब्दों के अर्थ के साथ क्या करती हैं। 

स्वनिम टेक्स्ट टू स्पीच को कैसे सक्षम बनाते हैं

हर टेक्स्ट टू स्पीच सिस्टम को वही समस्या हल करनी होती है जो ज़ोर से पढ़ते समय मस्तिष्क करता है: बोलने से पहले ग्राफीमों को स्वनिमों में बदलना। ग्राफीम-से-स्वनिम (G2P) रूपांतरण बहुत कठिन है और यहीं कई शुरुआती सिस्टम TTS में गलतियां करते हैं।

टेक्स्ट अस्पष्ट हो सकता है। एक ही शब्द “read” वर्तमान काल में /riːd/ और भूतकाल में /red/ हो सकता है। कुछ व्यक्तिवाचक संज्ञाएं, जैसे ब्रांड नाम या तकनीकी शब्दावली, मानक वर्तनी नियमों का बिल्कुल भी पालन नहीं कर सकतीं। Eleven v3 जैसे आधुनिक AI मॉडल इनमें से अधिकतर को संदर्भ के आधार पर समझ लेते हैं, लेकिन सुनिश्चित उच्चारण के लिए आप स्वनिमों को अधिक बारीकी से नियंत्रित भी कर सकते हैं:

  • उच्चारण शब्दकोश: पूरे प्रोजेक्ट में हर शब्द कैसे बोला जाए, यह तय करें। बार-बार आने वाले ब्रांड नामों, पात्रों के नामों, चिकित्सा शब्दों या कंपनी-विशिष्ट शब्दावली के लिए आदर्श।
  • SSML स्वनिम टैग और IPA: v2 मॉडल पर SSML स्वनिम टैग से आप उच्चारण को शब्द-स्तर पर नियंत्रित कर सकते हैं, या शब्दों को सीधे Eleven v3 ऑडियो टैग्स के साथ लिख सकते हैं।

वही स्वनिमीय परत उलटी दिशा में भी काम करती है। स्पीच टू टेक्स्ट के लिए, मॉडल को ध्वनिक पैटर्न सीखने होते हैं, ताकि वे स्वनिम क्रमों को शब्दों में जोड़ने से पहले मैप कर सकें। स्वनिमीय समझ से ही वे ऐसे शब्द का लिप्यंतरण कर पाते हैं जिसे उन्होंने शायद पहले कभी नहीं देखा हो।

Explanation of phonemes in text-to-speech, highlighting pronunciation differences and tools.

भाषा सीखने के लिए स्वनिमों का उपयोग कैसे करें

सामान्य यूज़र स्वनिमों के बारे में अधिक जानना इसलिए चाह सकते हैं क्योंकि वे भाषा सीखने में बेहद उपयोगी हैं। कम उम्र में किसी बच्चे की अलग-अलग स्वनिमों को सुनने या पहचानने की क्षमता उसके आगे के ध्वन्यात्मक ज्ञान के अर्जन को सीधे प्रभावित करती है और किशोरावस्था तक उसके भाषाई उत्पादन को भी।

नई भाषा सीखते समय आपके मस्तिष्क को उन स्वनिमों को समझना होता है जिन्हें सुनने के लिए आपके कान को कभी प्रशिक्षित नहीं किया गया था। भाषा सीखने में सुधार के लिए स्वनिमों का उपयोग करने की कुछ व्यावहारिक रणनीतियां यहां दी गई हैं:

  • IPA प्रतीक सीखें: अंतरराष्ट्रीय ध्वन्यात्मक वर्णमाला शब्दकोशों में हर शब्द का उच्चारण दिखाने के लिए दी जाती है। IPA सीखने का मतलब है कि आप हमेशा जानेंगे कि कोई शब्द कैसे पढ़ना है, भले ही आप उसे पहली बार देख रहे हों।
  • स्वनिमों को सुनें और उनका अनुकरण करें: किसी भाषा में हर स्वनिम पहचानने के लिए बोलने की गति धीमी करें और उसकी नकल करें। इससे हर ध्वनि के सही उच्चारण का संदर्भ बनता है, जो भाषा सीखते समय पूरे वाक्य दोहराने से अधिक प्रभावी है।
  • सुधार के लिए न्यूनतम युग्मों का उपयोग करें: न्यूनतम युग्मों में केवल एक स्वनिम का अंतर होता है। बोलते समय इनके उदाहरणों का अभ्यास करने से आपकी जीभ और कान को भाषाओं के बीच के सूक्ष्म अंतर भी पहचानने और दोहराने का प्रशिक्षण मिलेगा।

AI वॉइस टूल्स ने भी भाषा सीखना काफी आसान बना दिया है। टेक्स्ट टू स्पीच जनरेटर के साथ, आप दर्जनों भाषाओं और कई क्षेत्रीय उच्चारणों में किसी भी शब्द या वाक्यांश को मूल वक्ता जैसी आवाज़ में सुन सकते हैं। 

स्वनिम-स्तरीय टेक्स्ट टू स्पीच के लिए ElevenLabs आज़माएं

चाहे आप नई भाषा के ध्वनिविज्ञान को समझ रहे हों या अपनी मातृभाषा को निखार रहे हों, स्वनिमों की ठोस समझ प्रभावी और स्पष्ट अभिव्यक्ति की कला में महारत हासिल करने की कुंजी है। लेकिन भाषाविज्ञान की अकादमिक समझ ही भाषा सीखने का एकमात्र तरीका नहीं है। हम सुनकर और नकल करके भी सीखते हैं। 

टेक्स्ट टू स्पीच जनरेशन टूल स्वनिमीय जागरूकता विकसित करने और ध्वनि इकाइयों, पूरे शब्दों और बोली जाने वाली बातचीत में स्वाभाविक रूप से शामिल अन्य अलग-अलग ध्वनियों की सहज समझ बनाने में बेहद उपयोगी हैं।

शक्तिशाली टेक्स्ट टू स्पीच तकनीक के साथ ElevenLabs का इस्तेमाल शुरू करें या हमारे क्रिएटिव टूल्स के संग्रह के बारे में आज ही और जानें।

अक्सर पूछे जाने वाले सवाल

संबंधित लेख

उच्चतम गुणवत्ता वाले AI ऑडियो के साथ बनाएं