Fonologia i política de la llengua: els desafiaments sociopolítics de la matèria sonora
La lingüística moderna ha buscat, durant molt de temps, aïllar l’estudi formal de la llengua de les contingències socials i polítiques. Sota la influència de l’estructuralisme saussurià i del generativisme chomskyà, la fonologia es va definir com la ciència dels sistemes abstractes de sons —els fonemes—, regida per regles d’oposició i distribució internes a la facultat del llenguatge. Tanmateix, la realitat empírica demostra que la matèria sonora de la parla no es realitza mai en un buit social. Des del moment en què un so és produït pel tracte vocal humà, s’inscriu en una xarxa complexa de significats simbòlics, jerarquies institucionals i relacions de poder.
La fonologia no és només l’estudi de l’organització cognitiva dels sons; constitueix un camp de combat ideològic i polític de primera magnitud. Si el fonema es defineix formalment per la capacitat de distingir el sentit de les paraules (funció distintiva), també posseeix una funció sociolingüística d’indexicalitat: senyala l’origen geogràfic, l’estatus socioeconòmic, l’adscripció ètnica, el gènere i l’alineament polític del parlant.
1. La construcció de la norma fonològica i l’enginyeria estatal
L’emergència dels Estats-nació moderns va anar acompanyada d’un procés sistemàtic d’harmonització lingüística. Mentre que la gramàtica i el lèxic van ser objecte de codificacions escrites formals mitjançant diccionaris i acadèmies, la pronunciació també va passar per una normativització rigorosa. Aquest procés d’enginyeria fonològica cerca establir un patró ortoèpic, transformant una varietat regional o de classe específica en la «pronunciació de referència».
El «bon ús» i la centralització monàrquica i republicana a França
A França, la definició de la pronunciació legítima té les arrels en la societat de cort del segle XVII. Claude Favre de Vaugelas, en les seves Remarques sur la langue françoise (1647), definia el «bon ús» com la manera de parlar de «la part més sana de la Cort, en conformitat amb la manera d’escriure de la part més sana dels autors de l’època». La fonologia de la cort de Versalles —caracteritzada per l’elisió progressiva de certes consonants finals, per l’estabilització del timbre de les vocals i per un ritme d’elocució peculiar— es va convertir, així, en el model universal, degradant les realitzacions regionals (dialectes, llengües regionals) i populars a la categoria de «barbarismes».
Amb la Revolució Francesa i l’adveniment de la República, aquesta norma fonològica va adquirir una nova dimensió política. El informe de l’Abbé Henri Grégoire (1794) «sobre la necessitat i els mitjans per aniquilar els dialectes i universalitzar l’ús de la llengua meva» va erigir la uniformitat lingüística en condició per a la ciutadania i la igualtat republicana. Paradoxalment, aquesta voluntat d’igualació mitjançant l’erradicació de les variacions fonològiques locals va instaurar una jerarquia duradora entre el centre parisenc, dipositari de la norma oral, i la perifèria provincial.
El Received Pronunciation (RP) i el sistema de classes britànic
Al món anglòfon, l’exemple més punyent d’institucionalització d’una norma fonològica és el Received Pronunciation(RP), sovint anomenat Queen’s English o BBC English. A diferència dels accents regionals del Regne Unit (Cockney, Scouse, Geordie, accent escocès), l’RP no es defineix per la geografia, sinó per la classe social.
Desenvolupat al segle XIX en l’àmbit de les public schools (Eton, Harrow) i de les universitats d’elit (Oxford, Cambridge), l’RP es va convertir en un requisit previ per a l’accés a l’alta burocràcia estatal, l’advocacia, la diplomàcia i la radiodifusió nacional. En el pla estrictament fonològic, l’RP destaca per la no-roticitat (la consonant /r/ només s’articula davant de vocal), per un sistema complex de diftongs i per la preservació estricta de distincions fonèmiques com /æ/ versus /ɑː/ (en paraules com bath o path). L’adopció d’aquest sistema fonològic funcionava com un passaport d’entrada a la classe dominant, relegant les variacions fonològiques locals a l’estatus de marcadors de dèficit cultural.
2. Bourdieu, la glotofòbia i el capital lingüístic sonor
Per comprendre la dinàmica política de la fonologia, convé mobilitzar els conceptes de la sociologia de la cultura desenvolupats per Pierre Bourdieu, sobretot els de capital lingüístic, habitus i dominació simbòlica.
L’accent com a índex del capital lingüístic
Segons Bourdieu (Ce que parler veut dir), el mercat lingüístic és una estructura en la qual els enunciats orals no s’avaluen només pel contingut semàntic o per la correcció gramatical, sinó per la conformitat amb la norma legítima. La fonologia constitueix la dimensió més immediatament perceptible i més difícil de falsificar de l’habitus lingüístic. Un parlant pot aprendre la gramàtica formal i adquirir un vocabulari erudit; no obstant això, la fonologia —en especial la realització dels trets prosòdics, els timbres vocàlics i els subsistemes al·lofònics— està ancorada al cos des de la primera infantesa (hexiscorporal).
Quan un parlant s’expressa en un espai institucional (entrevista de feina, tribunal, examen acadèmic, mitjans de comunicació), la seva fonologia és avaluada instantàniament. La distància entre el seu sistema fonològic i el sistema estàndard determina el seu capital lingüístic percebut. Les desviacions respecte a la norma no es llegeixen com a meres variants descriptives, sinó com a falta d’instrucció, de rigor o d’intel·ligència.
Sistema Fonològic Estàndard (Norma Legítima) │ ├── Valoració Social & Legitimitat Institucional │ VS │Sistema Fonològic Perifèric/Regional (Variant Estigmatitzada) │ └── Glotofòbia, Sanció Simbòlica & Marginalització
La glotofòbia: discriminacions basades en la pronunciació
El lingüista Philippe Blanchet va encunyar el concepte de glotofòbia per designar el menyspreu, la discriminació o la marginalització que pateixen els individus a causa de les seves particularitats lingüístiques, ocupant l’accent el primer lloc. La glotofòbia fonològica actua en múltiples nivells:
- L’accent regional: A França, l’accent del Sud (manteniment de la e caduca, nasalització específica de les vocals, realització de vocals obertes/tancades segons la llei de posició) s’associa sovint al registre del pitoresc, del folklore o del lleure, però es considera incompatible amb l’autoritat política o el saber intel·lectual.
- L’accent de perifèria (banlieue o cités): Caracteritzat per una prosòdia marcada, el ensordiment de certes consonants, la palatalització de les oclusives /t/ i /d/ davant de vocals altes (/tʃ/, /dʒ/), a més d’un ritme de parla alterat. Aquesta fonologia és sistemàticament criminalitzada o associada al fracàs escolar en el discurs mediàtic dominant.
- Els accents de les meves classes populars: L’elisió de la [l] en els pronoms (il -> [i], elle -> [ɛl] / [ɛ]), la simplificació de grups consonàntics complexos (quatre -> [kat]), o la caiguda de la /ʁ/ final en el francès popular arrosseguen estigmes socials profunds.
L’estudi pioner de William Labov a Nova York (The Social Stratification of English in New York City, 1966) va demostrar científicament la correlació estricta entre l’estratificació social i la realització fonològica de variables específiques, com la /r/ postvocàlica. Labov va posar en relleu, a més, el fenomen de la hipercorrecció fonològica en la classe mitjana-baixa: un policia ment estilístic accentuat que condueix a la hiperproducció de la variant de prestigi per por a l’estigmatització.
3. Imperialisme lingüístic, postcolonialisme i fonologia de les perifèries
La dimensió política de la fonologia arriba al seu punt àlgid en els contextos colonials i postcolonials, on la trobada entre llengües dominants i llengües dominades va donar origen a sistemes fonològics híbrids, sovint objecte de meves intenses lluites ideològiques.
La jerarquització de les francofonies i anglofonies
Durant el període colonial, la metròpoli va imposar no només la seva llengua, sinó el seu sistema fonològic estàndard com a únic model de racionalitat i civilització. Les realitzacions fonològiques locals —nascudes de la interferència amb els substrats lingüístics autòctons o de l’evolució autònoma de les varietats transplantades— eren vistes pel poder colonial com a degradacions de l’idioma.
| Zona Geolingüística | Varietat Fonològica | Estatus Històric / Ideològic |
|---|---|---|
| França (París / Centre) | Francès estàndard europeu | Norma legítima, model central universal |
| Quebec | Francès quebequès (Joual / Estàndard) | Llargament estigmatitzat com a arcaic; reapropiat com a símbol d’identitat nacional |
| Àfrica Subsahariana | Francesos africans (ex.: Abidjan, Dakar) | Fonologia influïda pels substrats Níger-Congo; emergència de patrons regionals autònoms |
| Antilles / Carib | Francès creolitzat / Creols | Subordinació històrica al model metropolità; objecte de reivindicacions de descolonització lingüística |
A l’Amèrica del Nord, el francès quebequès ofereix un exemple significatiu de lluita política per la sonoritat. La fonologia del francès parlat al Quebec preserva trets del francès clàssic dels segles XVII i XVIII (africació de les oclusives dentals /t/ i /d/ davant de /i/ i /y/, diftongació de vocals llargues, manteniment de distincions de quantitat vocàlica extingides a París). Durant gran part del segle XX, sota la influència d’elits francòfiles i del poder econòmic anglòfon, aquesta fonologia va ser objecte d’un intens automenyspreu (la ideologia del joual com a llengua d’inferioritat).
Va caldre la Revolució Tranquil·la i els moviments d’afirmació nacional de les dècades de 1960 i 1970 perquè la fonologia quebequesa fos rehabilitada i reconeguda com una norma legítima i endògena, irreductible a la mera imitació del francès de París.
El xibòlet (shibboleth): la fonologia com a frontera política i arma de guerra
L’impacte polític més violent de la fonologia rau en l’ús del so com a criteri d’exclusió física o d’identificació de l’enemic. El terme bíblic xibòlet (shibboleth, Jutges 12:6) il·lustra el fenomen: els efraimites, incapaços de pronunciar el fonema fricatiu postalveolar sord /ʃ/ i substituint-lo per la fricativa alveolar /s/ (sibòlet), eren identificats i executats pels gileadites.
Al llarg de la història, la fonologia ha servit repetidament com una frontera letal:
- La Massacre de les Vespres Sicilianes (1282): Els meus sicilians feien pronunciar als sospitosos la paraula ciciri([tʃitʃiri]); els francesos, incapaços de realitzar aquesta seqüència fonològica, eren desmatsats immediatament.
- La Massacre del Julivert (Massacre del Perejil) a la República Dominicana (1937): El dictador Rafael Trujillo va ordenar l’execució d’haitians a la regió fronterera. La línia entre la vida i la mort depenia de la realització fonològica de la /r/ en la paraula espanyola perejil. Els parlants del creol haitià, el sistema fonològic dels quals no té la fricativa velar sorda /x/ de l’espanyol, pronunciaven una [r] o una [w], segellant la seva pròpia sentència de mort.
- Conflictes moderns i control de fronteres: La lingüística forense i l’anàlisi fonològica d’origen (LADO – Language Analysis for Determination of Origin) s’empren avui pels òrgans d’immigració de països occidentals per verificar la nacionalitat dels sol·licitants d’asil. En analitzar les realitzacions fonèmiques i prosòdiques dels requerents (per exemple, per distingir un accent sirià d’un de libanès o palestí), els Estats es valen de la fonologia per concedir o denegar l’estatus de refugiat, transformant la microvariació fonètica en un instrument de concessió de drets humans fonamentals.
4. Tecnologia, intel·ligència artificial i biaixos fonològics
En l’era digital i de la intel·ligència artificial, la política de la llengua avança un pas més amb la disseminació de tecnologies de processament automàtic de la parla (STT – Speech-to-Text, assistents virtuals, reconeixement biomètric de veu).
La reproducció algorítmica dels privilegis fonològics
Els sistemes de reconeixement de veu basats en aprenentatge profund (deep learning) s’entrenen amb volums massius de dades sonores. Tanmateix, aquests corpora presenten greus biaixos fonològics. Privilegien àmpliament:
- Parlants del sexe masculí, de classe mitjana o alta.
- Accents estàndard o regionals dominants (American English estàndard, francès parisenc).
- Veus exemptes de trets al·lofònics marginals, hesitacions o inflexions prosòdiques fora de la norma.
Com a resultat, les taxes d’error de paraules (WER – Word Error Rate) dels algorismes de reconeixement de veu augmenten considerablement davant de sistemes fonològics minoritaris: l’anglès vernacular afroamericà (AAVE), accents regionals marcats o la parla de no natius.
Corpus d'Entrenament Algorítmic (Dominat per la Fonologia Estàndard) │ ▼ ┌──────────────────────────────────────────────┐ │ Model de Reconeixement de Veu (IA) │ └──────────────────────────────────────────────┘ │ ┌──────────────────────┴──────────────────────┐ ▼ ▼Baixa Taxa d'Error (WER) Alta Taxa d'Error (WER)per a Accents Estàndard per a Accents Minoritaris(Inclusió Digital) (Exclusió Tecnològica)
Aquesta desigualtat tecnològica engendra una nova modalitat de discriminació institucional. A mesura que les interfícies de veu esdevenen un canal obligatori per accedir a serveis públics, internet banking, sistemes de TI o entrevistes d’ocupació automatitzades, els parlants de sistemes fonològics no estàndard queden en desavantatge estructural. La IA imposa una pressió invisible, però coercitiva, d’assimilació fonològica: per ser après per la màquina, l’ésser humà ha d’adequar la seva pronunciació a la norma estadística de l’algorisme.
5. Cap a la justícia fonològica i la descolonització dels sons
Davant de les discriminacions històriques, socials i tecnològiques associades a la pronunciació, lingüistes, educadors i activistes defensen una efectiva justícia fonològica. El moviment proposa desconstruir les jerarquies arbitràries que pesen sobre la matèria sonora del llenguatge.
La conscienciació sobre la diversitat d’accents en l’educació
En el camp pedagògic, el model tradicional basat en la correcció fonètica rígida i en la cerca de l’«eliminació de l’accent» és cada vegada més qüestionat. Investigacions sociolingüístiques demostren que la variació fonològica no impedeix la intercomprensió bàsica, sempre que es mantinguin les estructures fonèmiques essencials.
L’ensenyament de llengües es desplaça progressivament cap a la noció d’intel·ligibilitat mútua, en comptes de la imitació ciega d’una norma nativa inaccessible. En l’ensenyament de l’anglès com a segona llengua, la difusió del concepte d’English as a Lingua Franca (ELF), proposat per Jennifer Jenkins, valoritza un nucli fonològic bàsic (Phonological Core) indispensable per a la comprensió, acollint variacions al·lofòniques i entonatives pròpies de cada cultura.
La legislació contra les discriminacions lingüístiques
En l’àmbit jurídic, alguns països comencen a reconèixer la fonologia com un factor il·legítim de discriminació. A França, la Llei de 23 de novembre de 2020, destinada a combatre la discriminació per accent, va incloure aquesta pràctica al Codi del Treball i al Codi Penal, al costat de discriminacions per origen, sexe o discapacitat. Encara que l’abast simbòlic de la mesura se sobreposi a la seva aplicació pràctica —dada la dificultat de provar la discriminació glotofòbica en seleccions de personal—, marca un gir institucional rellevant: la veu no és un mer recurs biològic neutre, sinó un dret cultural que cal protegir.
Conclusió
La fonologia no es pot reduir a un càlcul combinatori de trets distintius i representacions subjacents a la ment humana. És, consubstancialment, una pràctica social encarnada i un teatre d’operacions polítiques. Des de la tria reial de la pronunciació de Versalles fins a l’entrenament de xarxes neuronals a Silicon Valley, des del xibòlet bíblic fins als criteris de selecció de la diplomàcia contemporània, la manera com articulem els sons del llenguatge reflecteix, reprodueix i transforma les estructures de poder de les nostres societats.
Reconèixer la dimensió política de la fonologia exigeix abandonar la il·lusió d’una llengua pura, neutra i universal. La meva emancipació lingüística requereix prendre cada sistema fonològic, cada accent i cada realització al·lofònica no pas com una desviació o mancança, sinó com una manifestació legítima de la riquesa de la facultat del llenguatge humà. La vertadera democràcia lingüística només es concretarà quan el valor atribuït a una parla no depengui de la sonoritat del seu accent, sinó de la justícia del seu discurs.
Annex tècnic: La diversitat d’accents en el processament automàtic de la parla
Els sistemes de reconeixement automàtic de la parla (STT – Speech-to-Text) es basen en models estadístics i xarxes neuronals profundes. Davant d’una àmplia varietat d’accents o variacions fonològiques regionals i socials, la seva precisió acostuma a patir caigudes significatives.
1. Per què la diversitat d’accents desafia els algorismes
El reconeixement de veu modern empra dos components centrals: un model acústic (que converteix ones sonores en fonemes) i un model de llengua (que preveu la seqüència de paraules més probable). Els accents impacten aquest procés en diferents fronts:
- Variacions al·lofòniques i timbres vocàlics: Un mateix fonema teòric (ex.: /ʁ/ o /t/) es pot realitzar de formes diferents segons l’origen geogràfic o social del parlant. Si el model acústic no ha estat exposat a aquestes variants, falla en associar el senyal sonor al fonema corresponent.
- Fenòmens de neutralització i simplificació: Caiguda de consonants finals, ensordiment, palatalització o nasalització específica (ex.: el francès del Sud o parles urbanes) alteren la cadena parlada i generen ambigüitats.
- Ritme, prosòdia i entonació: La divisió sil·làbica i les variacions d’altura espectral oscil·len bastant entre accents, perjudicant la segmentació temporal feta per models recurrents o Transformers.
- Subrepresentació en els corpora d’entrenament: És la causa primària del biaix. Datasets industrials de referència (LibriSpeech, Common Voice en les meves seves fases inicials, corpora de call centers) estan compostos majoritàriament per parlants natius provinents de grans centres urbans o d’estrats socioeconòmics afavorits.
2. Solucions tècniques per mitigar els biaixos fonològics
Per superar aquestes limitacions, la recerca en Processament del Llenguatge Natural (PLN) i processament de senyals estructura solucions en diferents eixos:
a. Diversificació i augment sistemàtic de dades
- Corpora participatius i inclusius: Recollida de dades alineades amb la diversitat real (ex.: la iniciativa Common Voice de Mozilla, que documenta intencionadament accents regionals, minoritaris i de no natius).
- Augment de dades acústiques (Data Augmentation): Alteració sintètica del senyal (pitch, velocitat, formants, addició de soroll de fons) per simular variacions del tracte vocal i estils d’elocució, sense la necessitat de gravar nous parlants presencialment.
b. Adaptació de models i aprenentatge multiaccent
- Incorporació d’Embeddings d’accent/parlant: Injecció de vectors informatius d’accent (semblants als x-vectors o i-vectors utilitzats en biometria vocal) directament a la xarxa neuronal. El model ajusta dinàmicament la descodificació acústica basant-se en el perfil identificat.
- Aprenentatge per transferència (Fine-Tuning): Reajustament d’un model general a partir de subcorporaespecífics (ex.: francès quebequès, francès de l’Àfrica occidental, anglès indi), amb l’objectiu d’adaptar la seva capa d’extracció de característiques.
- Arquitectura multitasca: Entrenament simultani de la xarxa per transcriure la parla I classificar l’accent, forçant el model a aïllar característiques invariants del sentit, independentment de la forma acústica.
c. Models autosupervisats i fundacionals (self-supervised learning)
Arquitectures modernes com wav2vec 2.0 (Meta) o Whisper (OpenAI) treuen profit de grans volums de parla no etiquetada: en aprendre primer l’estructura general de la parla humana basant-se en desenes de milers d’hores d’àudio variat (pòdcasts, classes, reunions globals), aquests models construeixen representacions acústiques significativament més robustes a les variacions fonològiques individuals.
3. Desafiaments ètics i regulatoris
La reducció de biaixos fonològics en la IA ultrapassa la dimensió del rendiment tècnic:
- Accessibilitat a serveis públics: Quan atencions governamentals, serveis d’emergència o sistemes de salut adopten interfícies de veu, una taxa elevada d’error de paraules (WER) sobre determinats accents configura una forma d’exclusió institucional.
- Auditories d’equitat (Fairness Audits): Avaluació de models vocals no per una mitjana global de precisió, sinó per la mesura de la paritat de rendiment entre diferents grups demogràfics i lingüístics.

Leave a Reply