फ़ोनीम क्या है? परिभाषा और अंग्रेज़ी के 44 फ़ोनीम
- लेखक
- Jack Limebear
- प्रकाशित
- आखिरी बार अपडेट किया गया
सुनेंइस आर्टिकल को सुनें
स्वनिम किसी भाषा में ध्वनि की सबसे छोटी इकाई है, जो किसी शब्द का अर्थ बदल सकती है। एक स्वनिम बदलने पर बिल्कुल अलग शब्द बन सकता है। /æt/ के साथ /p/ और /b/ जुड़कर ‘pat’ और ‘bat’ बनाते हैं, जो दो पूरी तरह अलग शब्द हैं।
खासकर अंग्रेज़ी में, स्वनिम ही वे कारण हैं जिनसे वर्तनी और ध्वनि अक्सर मेल नहीं खातीं। “fox” जैसे शब्द में चार अलग-अलग स्वनिम होते हैं (/f/ /ɒ/ /k/ /s/), लेकिन अक्षर केवल तीन होते हैं, जबकि ‘ship’ में चार अक्षर होते हैं लेकिन सिर्फ़ तीन स्वनिम (/ʃ/ /ɪ/ /p/)। भाषा सीखने और यह समझने के लिए कि आधुनिक टेक्स्ट टू स्पीच सिस्टम लिखे शब्दों को प्राकृतिक लगने वाली आवाज़ में कैसे बदलते हैं, स्वनिमों को समझना ज़रूरी है।
इस लेख में उदाहरणों के साथ बताया गया है कि स्वनिम क्या है, अंग्रेज़ी के सभी 44 स्वनिमों का पूरा चार्ट दिया गया है, और यह भी कि AI वॉइस तकनीक सही उच्चारण के लिए स्वनिम-स्तरीय नियंत्रण का उपयोग कैसे करती है।
सारांश:
- स्वनिम बोली जाने वाली भाषा में ध्वनि की सबसे छोटी इकाई है, जो शब्द का अर्थ बदल सकती है।
- अधिकांश भाषाविद् अंग्रेज़ी में 44 स्वनिम मानते हैं, जिनमें 24 व्यंजन ध्वनियां और 20 स्वर ध्वनियां शामिल हैं।
- स्वनिम ध्वनियों का वर्णन करते हैं, जबकि ग्राफीम वे अक्षर या अक्षरों के समूह हैं जो लिखित रूप में किसी स्वनिम का प्रतिनिधित्व करते हैं।
- अंतरराष्ट्रीय ध्वन्यात्मक वर्णमाला (IPA) स्वनिमों को दर्शाने वाले प्रतीकों को मानकीकृत करती है, ताकि इन ध्वनियों के उच्चारण में एकरूपता बनी रहे।
- टेक्स्ट टू स्पीच टूल ऑडियो फ़ाइल बनाने से पहले ग्राफीमों को स्वनिमों में बदलते हैं।
स्वनिम क्या है?
स्वनिम ध्वनि की सबसे छोटी इकाई है जो एक शब्द को दूसरे से अलग कर सकती है। भाषाविद् ऐसे दो शब्द ढूंढकर स्वनिम पहचानते हैं जिनमें सिर्फ़ एक ध्वनि का अंतर हो। ऐसे शब्दों को न्यूनतम युग्म कहा जाता है, जैसे:
- Pat / bat: इस न्यूनतम युग्म में /p/ और /b/ अलग-अलग स्वनिम हैं।
- Ship / sheep: /ɪ/ और /iː/ वे स्वनिम हैं जो इन शब्दों को बदलते हैं।
- Bat / bad: /t/ और /d/ वे अलग स्वनिम हैं जो इन शब्दों में अंतर दर्शाते हैं।
अगर किसी शब्द में एक ध्वनि बदलने से नया शब्द बनता है, तो वे दोनों ध्वनियां उस भाषा में अलग स्वनिम हैं। अगर उससे उसी शब्द का बस थोड़ा अलग सुनाई देने वाला रूप बनता है, तो वे एक ही स्वनिम के रूपांतर हैं।
“phoneme” शब्द यूनानी शब्द phōnēma से आया है, जिसका अर्थ है बोली गई या उत्पन्न ध्वनि। स्वनिमों को परिभाषित करते समय यह याद रखना उपयोगी है, क्योंकि वे ध्वनि की इकाइयां हैं, वर्तनी की जानकारी नहीं। जैसा कि आप आगे देखेंगे, स्वनिम केवल एकल अक्षरों तक सीमित नहीं हैं, बल्कि पूरी श्रव्य ध्वनियों को समेटते हैं।
अंग्रेज़ी में कितने स्वनिम हैं?
अंग्रेज़ी में 24 व्यंजन स्वनिम और 20 स्वर स्वनिम मिलाकर 44 स्वनिम हैं। हालांकि, यह सिर्फ़ एक सामान्य अनुमान है। उच्चारण और भाषाविद् अलग-अलग ध्वनियों को कैसे परिभाषित करते हैं, इस पर निर्भर करते हुए कुछ लोग इनकी संख्या 42 और कुछ 45 तक मानते हैं। उदाहरण के लिए, सामान्य अमेरिकी उच्चारण में “car” का /r/ बोला जाता है, जबकि रिसीव्ड प्रनन्सिएशन (ब्रिटिश) में नहीं, इसलिए इन उच्चारणों में कुल संख्या अलग होती है।
अन्य उच्चारणों में स्वर आपस में मिल सकते हैं, जिससे कुल गिनती में स्वनिम कम हो जाते हैं। स्वर-विलय, जैसे कुछ अमेरिकी लोग “cot” और “caught” को एक जैसा बोलते हैं, भाषाविदों के कुल आंकड़ों के आकलन को प्रभावित करते हैं। कुछ सीमांत ध्वनियां भी संख्या बदल सकती हैं, जहां द्विस्वरों को एकल स्वनिम की बजाय संयोजन माना जाता है। उदाहरण के लिए, कुछ प्रणालियां /ʍ/ (‘which’ की शुरुआत में आने वाली सांसयुक्त ध्वनि) को अलग स्वनिम मानती हैं, जबकि दूसरी इसे /h/ और /w/ का संयोजन मानती हैं।
मानक गिनती 44-स्वनिम मॉडल की है। इसमें ठीक 24 व्यंजन, 12 एकस्वर और 8 द्विस्वर होते हैं। यही मानक ब्रिटेन में ध्वनिविज्ञान की शिक्षा और ESL निर्देश में इस्तेमाल होता है।
अंग्रेज़ी के 44 स्वनिम: उदाहरणों के साथ पूरा चार्ट
व्यंजन स्वनिम (24)
स्वर स्वनिम (12 एकस्वर + 8 द्विस्वर = कुल 20)
प्रतीक अधिकांश फॉनिक्स पाठ्यक्रमों में इस्तेमाल होने वाली ब्रिटिश अंग्रेज़ी (RP) प्रणाली के अनुसार हैं; r-रंगित स्वरों के लिए सामान्य अमेरिकी विश्लेषण में थोड़ा अंतर होता है।
स्वनिम और ग्राफीम में क्या अंतर है?
स्वनिम एक ध्वनि है, जबकि ग्राफीम उस ध्वनि का लिखित रूप है। ग्राफीम एक अक्षर (c-a-t), दो अक्षर (डाइग्राफ, जैसे sh या ea), तीन अक्षर (“night” में igh), या चार अक्षर (“though” में ough) हो सकता है।
स्वनिमों और ग्राफीमों का बेमेल होना ही अंग्रेज़ी की वर्तनी को कुख्यात रूप से कठिन बनाता है। उदाहरण के लिए:
- एक स्वनिम, कई ग्राफीम: /iː/ ध्वनि को ee (sheep), ea (leaf), e (be), ey (key), ie (chief), या ei (ceiling) लिखा जा सकता है।
- एक ग्राफीम, कई स्वनिम: ough अक्षर “through” (/uː/), “though” (/əʊ/), “tough” (/ʌf/) और “thought” (/ɔː/) में अलग-अलग स्वनिम दर्शाते हैं।
हालांकि अंग्रेज़ी में 44 स्वनिम हैं, लेकिन उन्हें लिखने के लिए 200 से अधिक ग्राफीम हैं। स्पेनिश जैसी अधिक ध्वन्यात्मक भाषा में, जहां मानचित्रण लगभग एक-से-एक होता है, अंग्रेज़ी बोलना और लिप्यंतरित करना बेहद जटिल हो जाता है। यही वजह है कि टेक्स्ट टू स्पीच मॉडल केवल अक्षरों को पढ़ नहीं सकता, जिस पर हम जल्द ही फिर आएंगे।

स्वनिम बनाम एलोफ़ोन
एलोफ़ोन एक ही स्वनिम के अलग-अलग उच्चारण हैं, जो शब्द का अर्थ नहीं बदलते। अगर कोई ऐसा न्यूनतम युग्म नहीं है जिसमें एक स्वनिम दो अलग शब्द बनाता हो, तो वहां एलोफ़ोन होता है।
उदाहरण के लिए, “pat” में /p/ की ध्वनि “spat” में उसके बिना-प्रश्वास वाले रूप से अलग सुनाई देती है। ये अलग ध्वनियां हैं, लेकिन केवल इस प्रश्वास के आधार पर कोई अंग्रेज़ी शब्द-युग्म अलग नहीं होता, यानी अंग्रेज़ी बोलने वाले इन्हें मूलतः एक ही ध्वनि मानते हैं। थाई जैसी अन्य भाषाओं में, प्रश्वासयुक्त और बिना-प्रश्वास वाले /p/ का अंतर अलग स्वनिम बनाता है, जो शब्दों को पूरी तरह अलग कर देता है।
इसका मतलब है कि किसे स्वनिम माना जाएगा, यह पूरी तरह भाषा-विशिष्ट है। बात सिर्फ़ ध्वनिकी की नहीं, बल्कि इस बात की है कि ध्वनियां शब्दों के अर्थ के साथ क्या करती हैं।
स्वनिम टेक्स्ट टू स्पीच को कैसे सक्षम बनाते हैं
हर टेक्स्ट टू स्पीच सिस्टम को वही समस्या हल करनी होती है जो ज़ोर से पढ़ते समय मस्तिष्क करता है: बोलने से पहले ग्राफीमों को स्वनिमों में बदलना। ग्राफीम-से-स्वनिम (G2P) रूपांतरण बहुत कठिन है और यहीं कई शुरुआती सिस्टम TTS में गलतियां करते हैं।
टेक्स्ट अस्पष्ट हो सकता है। एक ही शब्द “read” वर्तमान काल में /riːd/ और भूतकाल में /red/ हो सकता है। कुछ व्यक्तिवाचक संज्ञाएं, जैसे ब्रांड नाम या तकनीकी शब्दावली, मानक वर्तनी नियमों का बिल्कुल भी पालन नहीं कर सकतीं। Eleven v3 जैसे आधुनिक AI मॉडल इनमें से अधिकतर को संदर्भ के आधार पर समझ लेते हैं, लेकिन सुनिश्चित उच्चारण के लिए आप स्वनिमों को अधिक बारीकी से नियंत्रित भी कर सकते हैं:
- उच्चारण शब्दकोश: पूरे प्रोजेक्ट में हर शब्द कैसे बोला जाए, यह तय करें। बार-बार आने वाले ब्रांड नामों, पात्रों के नामों, चिकित्सा शब्दों या कंपनी-विशिष्ट शब्दावली के लिए आदर्श।
- SSML स्वनिम टैग और IPA: v2 मॉडल पर SSML स्वनिम टैग से आप उच्चारण को शब्द-स्तर पर नियंत्रित कर सकते हैं, या शब्दों को सीधे Eleven v3 ऑडियो टैग्स के साथ लिख सकते हैं।
वही स्वनिमीय परत उलटी दिशा में भी काम करती है। स्पीच टू टेक्स्ट के लिए, मॉडल को ध्वनिक पैटर्न सीखने होते हैं, ताकि वे स्वनिम क्रमों को शब्दों में जोड़ने से पहले मैप कर सकें। स्वनिमीय समझ से ही वे ऐसे शब्द का लिप्यंतरण कर पाते हैं जिसे उन्होंने शायद पहले कभी नहीं देखा हो।

भाषा सीखने के लिए स्वनिमों का उपयोग कैसे करें
सामान्य यूज़र स्वनिमों के बारे में अधिक जानना इसलिए चाह सकते हैं क्योंकि वे भाषा सीखने में बेहद उपयोगी हैं। कम उम्र में किसी बच्चे की अलग-अलग स्वनिमों को सुनने या पहचानने की क्षमता उसके आगे के ध्वन्यात्मक ज्ञान के अर्जन को सीधे प्रभावित करती है और किशोरावस्था तक उसके भाषाई उत्पादन को भी।
नई भाषा सीखते समय आपके मस्तिष्क को उन स्वनिमों को समझना होता है जिन्हें सुनने के लिए आपके कान को कभी प्रशिक्षित नहीं किया गया था। भाषा सीखने में सुधार के लिए स्वनिमों का उपयोग करने की कुछ व्यावहारिक रणनीतियां यहां दी गई हैं:
- IPA प्रतीक सीखें: अंतरराष्ट्रीय ध्वन्यात्मक वर्णमाला शब्दकोशों में हर शब्द का उच्चारण दिखाने के लिए दी जाती है। IPA सीखने का मतलब है कि आप हमेशा जानेंगे कि कोई शब्द कैसे पढ़ना है, भले ही आप उसे पहली बार देख रहे हों।
- स्वनिमों को सुनें और उनका अनुकरण करें: किसी भाषा में हर स्वनिम पहचानने के लिए बोलने की गति धीमी करें और उसकी नकल करें। इससे हर ध्वनि के सही उच्चारण का संदर्भ बनता है, जो भाषा सीखते समय पूरे वाक्य दोहराने से अधिक प्रभावी है।
- सुधार के लिए न्यूनतम युग्मों का उपयोग करें: न्यूनतम युग्मों में केवल एक स्वनिम का अंतर होता है। बोलते समय इनके उदाहरणों का अभ्यास करने से आपकी जीभ और कान को भाषाओं के बीच के सूक्ष्म अंतर भी पहचानने और दोहराने का प्रशिक्षण मिलेगा।
AI वॉइस टूल्स ने भी भाषा सीखना काफी आसान बना दिया है। टेक्स्ट टू स्पीच जनरेटर के साथ, आप दर्जनों भाषाओं और कई क्षेत्रीय उच्चारणों में किसी भी शब्द या वाक्यांश को मूल वक्ता जैसी आवाज़ में सुन सकते हैं।
स्वनिम-स्तरीय टेक्स्ट टू स्पीच के लिए ElevenLabs आज़माएं
चाहे आप नई भाषा के ध्वनिविज्ञान को समझ रहे हों या अपनी मातृभाषा को निखार रहे हों, स्वनिमों की ठोस समझ प्रभावी और स्पष्ट अभिव्यक्ति की कला में महारत हासिल करने की कुंजी है। लेकिन भाषाविज्ञान की अकादमिक समझ ही भाषा सीखने का एकमात्र तरीका नहीं है। हम सुनकर और नकल करके भी सीखते हैं।
टेक्स्ट टू स्पीच जनरेशन टूल स्वनिमीय जागरूकता विकसित करने और ध्वनि इकाइयों, पूरे शब्दों और बोली जाने वाली बातचीत में स्वाभाविक रूप से शामिल अन्य अलग-अलग ध्वनियों की सहज समझ बनाने में बेहद उपयोगी हैं।
शक्तिशाली टेक्स्ट टू स्पीच तकनीक के साथ ElevenLabs का इस्तेमाल शुरू करें या हमारे क्रिएटिव टूल्स के संग्रह के बारे में आज ही और जानें।



