by Gabriela Pérez Báez and Terrence Kaufman and Christian Brendel
Para la introducción en su versión en español, pulse aquí.
| Compilers | Gabriela Pérez Báez, Terrence Kaufman and Christian Brendel |
|---|---|
| With | Rosaura López Cartas, Javier López Cartas, Rosalino Gallegos Luis and Víctor Cata |
This Didxazá – Spanish – English Dictionary (Xquiaapà' ró' diidxa' xtì' didxazá) aims to provide the most extensive documentation of the lexicon of Didxazá to date. This dictionary is the result of efforts over decades to document Didxazá as spoken in the communities of La Ventosa, Santa María Xadani and Juchitán de Zaragoza in the Isthmus of Tehuantepec, Oaxaca, Mexico. The dictionary has 9012 lexical entries with meaning descriptions in Mexican Spanish and US English. Among other categories, the dictionary includes:
To optimize your searches within the dictionary, please consult the recommendations at https://dictionaria.clld.org/help.
Many of the entries have example phrases illustrating use. It should be noted, however, that the bulk of the example phrases were chosen from a larger corpus to reflect phonological, morphological, syntactic and/or lexical tests needed for the optimal representation of headwords.
This dictionary complements the specialized La Ventosa Didxazá Lexico-Botanical Dictionary which contains 952 ethnobotanical entries (Pérez Báez et al 2019). It also includes some entries from the ethnobotanical dictionary that would be expected in a general dictionary.
The primary objective of this project is to contribute to the preservation of Didxazá as a vital language for the Zapotec communities of the Isthmus of Tehuantepec in Mexico and for those in the diaspora. While dictionaries are often regarded as authorities on language use, it is essential not to view this work in that light, for several reasons. First, the synthesis done for this dictionary was carried out by linguists who are not members of the Didxazá language community; as humans external to that community, they will have undoubtedly made errors or omissions. Second, although the compilers worked with numerous members of the language community, they by no means fully captured the language's dialectal diversity. The compilers ask every reader and user to bear in mind that if a discrepancy arises between the speech of a community member and the dictionary, it should be attributed to dialectal diversity. Thus, the speech of a community member, if it diverges from what is presented in this dictionary, should not be considered invalid. On the contrary, the speech of all members of the Didxazá-speaking communities should be prioritized over the content presented in this dictionary.
The research for this dictionary began in the context of the Project for the Documentation of the Languages of Mesoamerica (PDLMA). Its aim was to document the lexicon of languages whose cultures developed an epigraphic system. Over 30 languages were documented for the purposes of comparative analysis and reconstruction of proto-languages that would facilitate the decipherment of epigraphic systems. Terrence Kaufman† began the Didxazá lexical documentation with Javier López Cartas in 1995 and 1996 relying on elicitation tasks and text collection. Marilyn Feke carried out elicitation with Rosalino Gallegos Luis in 2000 yielding most of the sound symbolic entries. Data from published sources was digitized and entered into the database with corresponding attributions. Mark Sicoli contributed to this effort. Gabriela Pérez Báez joined the PDLMA in 2003 and became the sole compiler for Didxazá from then on. Within the PDLMA, she worked with Rosalino Gallegos Luis in 2003 and with Rosaura López Cartas from 2004 onwards, carrying out elicitation tasks, collecting and analyzing texts, and doing data verification. Kaufman remained active in the supervision of the dictionary through the last summer of the PDLMA in 2010. He passed away on March 3, 2022.
Pérez Báez carried out additional field research under the auspices of two projects. The first is the Spatial Language and Cognition in Mesoamerica project (NSF Award No. BCS-0723694, PI J. Bohnemeyer) which involved experimental communicative tasks exploring body part terms, spatial language, metaphor and metonymy. Results were published in Pérez Báez (2011, 2018, 2019), Bohnemeyer et al (2015), Alsehri et al (2018), inter alia. The second is an extensive ethnobotanical documentation project funded by the Smithsonian Institution, and which Pérez Báez directed from 2012 to 2019. This project focused on botanical research (collecting, photographing and processing plant samples) and linguistic and cultural data collection in the form of brief oral descriptions of plants. The results were published as the La Ventosa Didxazá Lexico-Botanical Dictionary and in pedagogical materials disseminated free of charge within the Didxazá-speaking communities.
The collaborations with contributors to the dictionary emerged in a variety of ways. A representative of the PDLMA, Beningno Robles, accompanied on one occasion by Pérez Báez, visited La Ventosa and Santa María Xadani calling for interested parties. Some contributions emerged from other long-standing collaborations. Word of mouth facilitated the participation of numerous other contributors. Thus, this dictionary encompasses knowledge about Didxazá shared over the years by more than 20 speakers of the language. Table 1 lists the names of all the contributors of Didxazá knowledge, along with the corresponding codes used in the dictionary to credit them, and their community of origin. In the dictionary, each of these codes is followed by two digits for the year in which the language data was provided.
| EJG | Eustaquio Jiménez Girón |
| FSL | Fernando Sánchez López |
| GB | Gabina Vásquez Luis |
| JAR | Javier Aragón Ríos |
| JLC | Javier López Cartas |
| ND | Jiménez Jiménez & Marcial Cerqueda |
| RGL | Rosalino Gallegos Luis |
| RLC | Rosaura López Cartas |
| RLL | Reyna Guadalupe López López |
| VC | Víctor Cata |
| VOT | Velma Orozco Trujillo |
| VP | Velma Pickett |
Three published sources were consulted: Jiménez Girón 1979 [EJG], Jiménez Jiménez & Marcial Cerqueda 2000 [ND], and Pickett et al 2001 [VP]. Any description that relies on information from one of these sources includes the corresponding attribution. In particular, Jiménez Girón 1979 provides valuable language use and cultural information not available otherwise. When appropriate, it is quoted with the appropriate citation.
| ISO 639-3 | zai |
|---|---|
| Language names | Didxazá, Isthmus Zapotec, Juchitán Zapotec, Juchiteco |
| Classification | Otomanguean > Zapotecan > Zapotec |
| Location | Isthmus of Tehuantepec, Oaxaca, Mexico |
| Varieties represented in the dictionary | La Ventosa, Juchitán de Zaragoza and Santa María Xadani |
Didxazá is spoken on the southern coast of the Isthmus of Tehuantepec in southern Mexico, and it is endangered. Marcial Cerqueda (2014) based on the Índice de Remplazo Etnolingüístico (Ordorica 2009) shows that Didxazá is undergoing extinción lenta (‘slow extinction’) to extinción acelerada (‘accelerated extinction’). The Endangered Languages Project classifies Didxazá as vulnerable with a speaker population of 80,000. The Instituto Nacional de Lenguas Indígenas (INALI) classifies it at a mediano riesgo de desaparición (‘medium/moderate risk of extinction’). Of the 22 municipalities where Didxazá is spoken, only in Santa María Xadani and San Blas Atempa are children growing up as speakers of the language (Marcial Cerqueda 2014). In the town of La Ventosa, where most of the documentation has been carried out, the youngest speakers tend to be in their thirties. According to the 2000 census, in Tehuantepec which was once the capital of Zapotec communities in the Isthmus, only some 4,000 speakers remain in a population of over 50,000. Given the advanced language shift, there are local efforts underway to reclaim domains of language use for Didxazá. It is the hope that the this dictionary will become a resource that supports such efforts.
Didxazá is a verb-subject-object (VSO) and head marking language. Its complex phonology includes contrastive tone and three different types of syllabic nuclei which interact with stress. Tones can be low, rising, or high, and have both lexical and grammatical functions. The vowel inventory consists of the five cardinal vowels /i, e, a, o, u/, which can each be modal (V), checked (Vʔ), or rearticulated (VV), with the last occurring only in the stressed syllables of roots. Word roots are canonically monosyllabic or bisyllabic, the majority having the structure CV(CV). Didxazá is considered to be a conservative Central Zapotec variety because it preserves pre- and post-tonic vowels which have elided in many other Central Zapotec languages such as those in the Central Valleys of Oaxaca (see Campbell 2017 and Smith-Stark 2007 inter alia for details on the complexity of diversification in Zapotec languages). In Didxazá, stress is consistently assigned to the first syllable of roots.
The consonantal inventory of Didxazá using relevant International Phonetic Alphabet symbols is given in Table 3.
| Bilabial | Alveolar | Palato-alveolar | Palatal | Velar | Labio-velar | Glottal | |
|---|---|---|---|---|---|---|---|
| Plosive | p | t | k | kʷ | |||
| b | d | g | |||||
| Nasal | m | n | ɲ | ||||
| Trill | r | ||||||
| Tap or Flap | ɾ | ||||||
| Fricative | s | ʃ | f | ||||
| z | ʒ | ||||||
| Affricate | t͡ʃ | ||||||
| d͡ʒ | |||||||
| Approximant | w | j | w | ||||
| Lateral approximant | l |
All headwords in this dictionary are written in the field Headword following the guidelines set in the 2016 draft of the Norma del sistema de escritura de la lengua zapoteca (henceforth Norma, Cata et al 2016 ms) which itself is based on the Alfabeto popular del zapoteco del Istmo (henceforth Alfabeto Popular, Anonymous 1956). In addition, the dictionary includes a field labeled PDLMA under the tab Words Extra with the orthographic representation used in the PDLMA which is more faithful to the phonology of Didxazá in avoiding idiosyncracies of the Spanish orthography. It also documents stress and morphological composition. Further, it is compatible with some 30 other Mesoamerican language databases produced by by the PDLMA and therefore allows for comparative analysis across databases.
The two representation systems are given in Table 4. When the graphemes of the Norma and the PDLMA systems are identical, only one grapheme is given. When they differ, the grapheme from the Norma appears first on the left of the equals symbol, while the grapheme from the PDLMA appears second and to the right of the equals symbol.
| Bilabial | Alveolar | Palato-alveolar | Palatal | Velar | Labio-velar | Glottal | |
|---|---|---|---|---|---|---|---|
| Plosive | p | t | c, qu = k | cu = kw | |||
| b | d | g, gu = g | |||||
| Nasal | m | n = n, nn | ñ = ny | ||||
| Trill | rr | ||||||
| Tap or Flap | rr | ||||||
| Fricative | s | x, xh = x | f | ||||
| z | x = zh | ||||||
| Affricate | ch | ||||||
| dx | |||||||
| Approximant | hu, u = w | i = y | hu, u = w | ||||
| Lateral approximant | l = l, ll |
In the Alfabeto Popular, tones are not systematically represented because it is argued that speakers of the language can disambiguate without the need for tonal representation. Instead, an acute accent is used to mark the phonetic prominence of a vowel segment, which is sometimes the result of a high tone and sometimes of the predictable lengthening of a vowel. Consequently, the use of the acute accent in the Alfabeto Popular compromises the principle of use of a diacritic to represent one and only one phonological feature.
The Norma (Cata et al 2016 ms) proposes a way to represent tones that follows the aforementioned principle. This is consistent with the recommendation of the Alfabeto Popular regarding the use of diacritics for the purpose of comprehensive language documentation. Furthermore, it is compatible with the PDLMA orthography. In both the Norma and the PDLMA orthography, a low tone is unmarked because it is the most frequent tone. A high tone is marked with an acute accent in the Norma and with an exclamation point in the PDLMA. A rising tone is marked with a grave accent in the Norma and with an asterisk in the PDLMA. This is shown in Table 5.
| Tone | Norma | PDLMA | ||
|---|---|---|---|---|
| Low | Not represented | nanda ‘cold’ | Not represented | nanda ‘cold’ |
| High | Represented with acute accent | nandá' ‘hot’ | Represented with ! | nanda!7 ‘hot’ |
| Rising | Represented with grave accent | nandà ‘hanging’ | Represented with * | nanda* ‘hanging’ |
The PDLMA orthography differs from the Norma in a number of ways. Glottalized vowels are represented with a number 7 after the vowel, as in gye7 ‘flower’, while the Norma uses an apostrophe, as in guie’ ‘flower’. It should be noted that most of the data in the dictionary were provided by members of the La Ventosa community. In their variant of Didxazá, laryngealization in the first syllable of a disyllabic root predicts laryngealization in the vowel of the following syllable. This was documented in the PDLMA orthography to avoid repeating the marker of predictable glottal closure. However, the Norma (Cata et al. 2016 ms) does not use this convention because not all variants of Didxazá exhibit the same phonotactics. This results in what might appear to be a discrepancy between the orthographic representation of the Norma and the PDLMA, as in the case of gui’xhi’ ‘mountain, hill, forest’ according to the Norma and gi7xi in the PDLMA.
A considerable challenge for the lexicography of Didxazá is the representation of lexical compounds. This is because no segmental or phonological properties, nor any phonological rules, have been found that formally distinguish lexical compounds from any other sequence of lexemes (Pérez Báez et al., 2015). Extensive syntactic tests (ibid.) were carried out in this dictionary to determine whether a sequence of lexemes constitutes a lexical compound that should be represented as a single orthographic word, a phrase lexeme with two or more orthographic words, or simply a compositional sequence of lexemes that does not require a lexical entry. Not all tests yielded clear results, and not all sequences could be subjected to this diagnostic process.
To the extent that these tests clarified which lexical entries were composed of lexical compounds, these presented an additional challenge. In rapid speech, the laryngealization of vowels is often reduced; therefore, any compound with laryngilized vowels, as well as any sequence of lexemes with the same vowels, has the same phonetic realization, resulting in a simplified laryngealization. The Alfabeto Popular and the Norma stipulate that this simplification must be represented in lexical compounds, resulting in the representation of glottalized and rearticulated vowels as modal vowels. However, this presents a considerable difficulty for the lexicography of the language.
First, the orthographic distinction stipulated by the Alfabeto Popular and the Norma suggests a distinction in the phonetic realization of word sequences compared to compounds, which, as already established, does not appear to exist (Pérez Báez et al., 2015). Second, this stipulation does not adhere to the different lexeme structures that the empirical evidence has revealed. Third, considering the decline in the vitality of Didxazá, presenting two orthographic representations of the same root without a supporting phonological rule considerably complicates any literacy instruction process for heritage speakers.
Considering all of this, and consistent with the principle of fully documenting the language as outlined in the Alfabeto Popular, Pérez Báez has proposed an orthographic representation of compound words that adheres to the empirical evidence available to date, even if it differs from the Alfabeto Popular and the Norma. Pérez Báez has made this decision, aware that the final word rests with the language community. Therefore, anticipating the formal adoption of the Norma in the future, the data presented in the dictionary has been prepared with the greatest possible consistency so that, if necessary, automated modifications can be made should the Norma, once formally adopted, so stipulate.
Regarding word structure and prosodic stress, the PDLMA orthography rigorously documents both. Prosodic stress is predictable based on root structure. However, it is represented in the PDLMA orthography to provide the most comprehensive documentation possible, as this may be necessary for a variety of interests among speakers, students, and language analysts. A hyphen marks a boundary between a root and other extrametrical affixes. A plus sign marks a clitic. A dot marks a boundary between morphemes within the same CV(CV) syllable or prosodic unit. These and other symbols used in the dictionary are listed in Table 6.
| Symbol | Description |
|---|---|
| . | morpheme boundary |
| + | clitic |
| = | marks the affixation of a bound morpheme to a free one, or the compounding of two free morphemes |
| - | root boundary |
| # | word boundary |
| ~ | alternation between forms |
| () | In Didxazá data, the parentheses frame forms that are optional and do not need to be said in order for the form to be grammatical or acceptable. |
| In English and Spanish translations of examples, there are two instances in which parentheses might be used. First, in order to reflect parentheses used in a Didxazá example. Second, when the parentheses are not included in the Didxazá example, in the English and/or Spanish translations the parentheses add information to clarify or disambiguate the translation and ensure an accurate understanding of the Didxazá utterance. |
Now, the name given to the language by its communities, as stipulated in the Norma, is Didxazá. This representation contains two analytical elements that empirical evidence does not support. The first is the aforementioned process of vowel simplification in compounds. Didxazá is a compound comprised of diidxa ‘word’ and za, a morpheme whose gloss presents an analytical challenge. Currently, za can represent two homophones, ‘cloud’ and ‘lard’. However, as Oudijk (2012) explains, the morpheme has a possible etymology that does not confirm the glosses ‘cloud’ nor ‘lard’, and that opens the possibility of glosses pointing to concepts of reciprocity and social relationship. Regardless of this analysis, which remains inconclusive, the morpheme is monosyllabic, with a low-tone modal vowel. In a syllable of this structure word-final, the vowel's resonance creates the perception of a prolonged duration. In the Alfabeto Popular, this phonetic realization refers to point “j) For the accentuation of Zapotec words, the orthographic accent will be used as employed in Spanish, when the case requires it.” (my translation). However, no phonological or orthographic rules are detailed to determine when such use would be required. Furthermore, as already established, the prosodic accent of Didxazá and that of Spanish obey a series of phonotactic and lexical aspects that are not at all compatible with each other. Since any modal vowel at the end of a word has an extended resonance, the prominence of said vowel is predictable and does not require any orthographic representation. Moreover, the use of the acute accent in this case would compete with the representation of the high tone, which is not predictable and requires consistent orthographic representation.
Given the above, this dictionary would have preferred to represent the name of the language as Diidxaza. However, although the empirical evidence presented in this dictionary is not compatible with the orthographic representation didxazá, the latter is favored here in respectful consideration of the decades of use it has had among the language communities and the fact that it is the representation stipulated by both the Alfabeto Popular and the Norma.
A final topic to address in this section is the representation of loanwords, especially those introduced from Spanish in recent times. The Norma stipulates that loanwords that have been adapted to the phonology of the language should be written following the Didxazá orthographic system, while loanwords that have not yet been adapted should be written according to the orthographic rules of the source language. The research conducted for this dictionary shows that every loanword from Spanish, whether recent or from centuries past, has been adapted to the Didxazá phonology in one way or another. Contemporary loanwords often include consonants not present in the Didxazá phonological inventory and even retain Spanish syllabic structures that are not part of the phonotactics of Didxazá. This is why more recent loanwords may give the impression of not being adapted. However, in these loanwords, the Spanish prosodic accent is consistently adapted by speakers to the Didxazá tonal system: the stressed syllable is assigned a rising tone. This demonstrates a process of phonological adaptation or Zapotecization, which is why in this dictionary we have chosen to adapt all loanwords to the orthography of Didxazá. The exception is the case of official names of people and places.
Definitions were drafted with different audiences in mind. The primary audience of the Spanish meaning descriptions is the language community including the full spectrum of community members from those with high competency to those with receptive competency as well as learners at all levels. The Spanish meaning descriptions avoid technical linguistic terminology to increase accessibility to the content. These descriptions include translation equivalents in Spanish, as well as all cultural knowledge presented in a way that is informative to readers outside the language community, and not redundant to members of the language community. The English meaning descriptions are written for an audience outside the language community and may have more detail in order to contextualize cultural knowledge. These also include technical linguistic terminology when needed. It should be clarified that the Spanish and English meaning descriptions are not translations of each other but are written with the different audiences in mind.
The following sections provide concise descriptions of the most relevant aspects of the grammar of Didxazá as they relate to this dictionary. However, these notes are not intended as a full descriptive grammar.
Entries are coded for any of the parts of speech listed in Table 7. Entries are also coded for a variety of properties of the particular part of speech category. For instance, verbs are coded for valence and class and adjectives are coded for the derivational paradigm in which they participate. These codes are presented after a colon following the part of speech code and they are listed in the Additional Information column under Words Extra. Table 8 lists all Additional Information codes used.
Didxazá is a language that frequently lexicalizes sequences of more than one phonological word. Thus, the dictionary includes numerous multi-word entries defined as follows:
| Part of Speech | Description |
|---|---|
| a | adjective |
| av | adverb |
| clq | unclassified colloquial expression |
| cnj | conjunction |
| dem | demonstrative |
| dsp | (dis)positional root/stem that predicates on the relation between a figure and a ground (Bohnemeyer & Brown 2007) |
| enf | emphasis marker |
| int | interrogative |
| itj | interjection |
| n | proper name |
| ndf | indefinite article |
| neg | marker of negation |
| nmr | nominalizer |
| nn | nickname |
| nom | nominalized form |
| num | numeral |
| pcp | participle |
| pl | plural marker |
| prfp | perfective particple |
| prn | pronoun |
| prp | preposition |
| prt | particle |
| q | quantifier |
| rlc | relative clause |
| quo | quotative |
| s | noun |
| smb | sound symbolism |
| sr | relational noun |
| v | verb |
| voc | vocative |
| xpl | expletive |
| Part of Speech | Description |
|---|---|
| a:ctf | counterfactual form of a verb used as an adjective |
| a:dv1a | deverbalized adjective derived from a verbal root and marked by a rising tone that is fully realized |
| a:dv1b | deverbalized adjective derived from a verbal root and marked by a rising tone that splits and surfaces as a high tone and vowel glottalization |
| a:dv1sim | deverbalized adjective derived from a verbal root, marked by a high tone, and prefixed by na- |
| a:dvsim | deverbalized adjective derived by prefixation of na- |
| a:sim | similitive adjective derived from a noun or a basic adjective |
| dem:dir | demonstrative with directional function |
| dem:hum | demonstrative with exclusively human referent |
| n:ani | proper name of an animal |
| n:fam | surname, last name |
| n:fem | female name |
| n:mas | male name |
| nn:fam | family nickname |
| nn:fem | female nickname |
| nn:mas | male nickname |
| num:ord | ordinal number |
| prn:1 | pronoun first person |
| prn:1rfl | pronoun first person reflexive |
| prn:2 | pronoun second person |
| prn:2rfl | pronoun second person reflexive |
| prn:3ch | pronoun third person specific for children |
| prn:3i | pronoun third person inanimate |
| prn:3m | pronoun third person male |
| prn:3n | pronoun third person specific for someone who one pities |
| prn:3n-r | pronoun third person nonrational/non-human animal |
| prn:3r | pronoun third person rational/human |
| prn:3rfl | pronoun third person reflexivo |
| prn:4I | pronoun first person plural inclusive |
| prn:4Irfl | pronoun first person plural inclusive reflexive |
| prn:4X | pronoun first person plural exclusive |
| prn:5 | pronoun second person plural |
| prn:ndf | pronoun indefinite |
| prn:ndf-a | pronoun indefinite animate |
| prn:ndf-i | pronoun indefinite inanimate |
| prn:pos | pronoun possessive |
| prn:rel | pronoun relative |
| prn:ri-a | pronoun relative interrogative |
| q:int | quantifier with interrogative function |
| q:med | quantifier describing a measurement |
| q:set | quantifier denoting a set |
| q:tmp | quantifier of time |
| rlc:lf | phrasal lexeme with relative clause construction |
| s:der | derived noun |
| s:lf | noun with phrasal structure |
| s:med | noun denoting a measurement |
| s:pos | possessed noun |
| s:rel | relational noun |
| smb:s | sound symbolism tamed and with nominal function |
| v:and | verb in andative form |
Verbs are listed in the dictionary in their habitual form, prefixed by the habitual marker ri-. This is one of seven inflectional categories of verbs in the language and the standard used as the citation form of verbs in Zapotec lexicography. Table 9 lists the inflectional categories documented in the language, mainly aspectual and mood categories. Didxazá has one of the largest inventories of verbal inflection categories among Zapotec languages. A detailed morphophonological analysis about Didxazá verb classes can be found in Pérez Báez and Kaufman 2016. An analysis of valence in Didxazá can be found in Pérez Báez 2015 and also in Pérez Báez and Kaufman 2016.
| Function | Abbreviation | Morphemes |
|---|---|---|
| Habitual | HAB | ri= |
| Completive | CMP | be=, gu= |
| Potential | POT | |
| Counterfactual | CTF | |
| Progressive | PRG | |
| Perfect | PRF | way= |
| Future | FUT | za= |
Verbs in Didxazá can be divided into four verb classes based on the habitual aspect, completive aspect, and potential mood forms. The habitual form allows for the isolation of the root. The allomorphs in the completive elucidate the classification of Class A verbs. A replacive stem-initial consonant in the completive identifies verbs in Class D. The consonant interaction between the potential marker and the root in the completive identify verbs belonging to Class C and D. Table 10 shows the morphological forms associated with each verb class.
| Class A | Class B | Class C | Class D | |
|---|---|---|---|---|
| Initial Segment | -C; -u, -e | -C, -V | -C, -V | -C, -V |
| Habitual | ri= | ri= | ri= | ri= |
| Completive | be= | gu= | gu= | gu= with replacive stem-initial consonant |
| Potential | gǐ= | gǐ= | gˇ= where gˇ+C>#CC | gˇ= where gˇ+C>#CC |
Verbal entries in the dictionary include documentation of the potential, habitual and completive forms in order to determine the class that each verb belongs to. The verb class is coded in the Additional information column under Words Extra. Table 11 lists the codes used in the documentation of verb class.
| Verb Class | Description |
|---|---|
| vA | class A verb |
| vA irr | class A verb with irregular inflection |
| vA~C | verb that alternates between class A and C verbo que alterna entre inflecciones de inflection |
| vB | class B verb |
| vB irr | class B verb with irregular inflection |
| vC | class C verb |
| vC irr | class C verb with irregular inflection |
| vD (k > ch) | class D verb with consonantal replacement (k > ch) in the completive |
| vD (k > l) | class D verb with consonantal replacement (k > l) in the completive |
| vD (k > t) | class D verb with consonantal replacement (k > t) in the completive |
| vD (p > l) | class D verb with consonantal replacement (p > l) in the completive |
| vD (p > r) | class D verb with consonantal replacement (p > r) in the completive |
| vD (0 > t) | class D verb with consonantal replacement (0 > t) in the completive |
Didxazá has a class of adjectives defined based on distributional properties: as part of a noun phrase adjacent (whether preceding or following) to the head noun which it modifies by encoding the properties of the referent of the noun. In Didxazá, two types of adjectives can be discerned: basic and derived. Basic adjectives are those that are not derived from any other root or stem. This is in contrast with derived modifiers. Some modifiers are derived from verb roots, do not take any inflectional prefixes, and are formally marked by a change in the tonal pattern of the root. The resulting derived form generally exhibits the canonical CVCV shape of the verb root but will display a tonal pattern involving a rising tone that may surface as such, or as a high tone and glottalization of the tone-bearing vowel. These derived forms are considered derived adjectives in the dictionary and coded as such. An additional derivational pattern generates modifiers marked by the prefix na-. This process has been documented in many other Zapotec languages and the na- forms have generally been described as stative verbs, that is, as inflectional forms. However, the Didxazá data have shown that na- forms do not have the same distributional patterns as verbs but rather follow the patterns of basic and derived adjectives. Also, while the na- prefix can indeed attach to a verb stem to derive a versive modifier, they can also attach to nouns and underived adjectives to derive a similitive modifier. In all cases, these derived forms are marked by the fact that they do not exhibit any changes to the tonal pattern of the stem. To capture this complexity, the following classification is proposed:
Entries have been coded for one or more semantic domain. Table 12 lists the codes used.
| Category | Semantic Field |
|---|---|
| activity | actions |
| travel and transportation | |
| environment | animals |
| bodies of water | |
| fungi | |
| insects | |
| phenomena | |
| plants | |
| sky | |
| topography | |
| household | construction |
| furnishings | |
| processes | |
| tools and implements | |
| person | behavior |
| body parts | |
| character attributes | |
| clothing and adornment | |
| cognition | |
| emotion | |
| perception | |
| physical attributes | |
| spirituality | |
| wellness | |
| quantification | measure and quantity |
| numerals | |
| reference | demonym |
| meronym | |
| metaphor | |
| name | |
| toponym | |
| social life | communication |
| cultural practices | |
| experience | |
| games and toys | |
| government | |
| kinship | |
| life stages | |
| music and dance | |
| names and designations | |
| social categories | |
| speech acts | |
| values | |
| states | change of state |
| color | |
| location | |
| manner | |
| motion | |
| position | |
| shape | |
| size | |
| state | |
| time | |
| sustenance | beverages |
| commerce | |
| cultivation | |
| food | |
| occupations | |
| subsistence | |
| other | sound symbolism |
The documentation carried out by the PDLMA sought a scope of documentation that goes well beyond what most efforts would aim for. Two domains included in this dictionary that the reader might find unusual are personal names and nicknames, and sound symbolic forms. These domains are worthy of documentation for a couple of reasons. First, names and nicknames reflect aspects of social relations such as kinship, profession, experiences, and individual characteristics –whether positive or negative. Second, names and nicknames as well as sound symbolic forms exhibit aspects of the phonology of the language that may be missed entirely if these domains are not documented. Third, it is the hope that the more than 600 sound symbolic forms included in this dictionary will motivate their analysis. The value of documenting and studying sound symbolic forms has been stated since Hinton et al 1994. Nevertheless, it remains an understudied domain, and no works have been published on sound symbolism in Didxazá.
The fact that sound symbolism forms are not often documented probably owes to how challenging it is to represent them orthographically. The PDLMA developed conventions for their representation which are followed in this dictionary. Table 13 lists PDLMA notation conventions relevant to Didxazá sound symbolic forms as they appear in the dictionary’s PDLMA field of the Words Extra screen. In addition to these, it should be noted that long consonants are written in capital letters, voiceless consonants are followed by an h, and voiceless vowels are written in capital letters. Table 13 also lists these notation equivalents in the International Phonetic Alphabet (IPA, International Phonetic Association 2018) as well as in the Extensions to the International Phonetic Alphabet (ExtIPA, Ball et al 2018). These are used in the Headword field of the Words screen to complement the conventions of the Norma. It should be noted that despite the fact that the ExtIPA characters included in Didxazá sound symbolic forms are considered by the International Phonetic Association as belonging to disordered speech, they do not at all represent disordered speech in Didxazá.
| Category | Description | PDLMA | IPA, ExtIPA |
|---|---|---|---|
| Consonants | velar nasal | 9 | ŋ |
| voiced bilabial trill | b~ | ʙ | |
| Vowels | high/closed central unrounded | 3 | ɨ |
| mid central | 6 | ə | |
| low/open front | 4 | a | |
| Pitch | low pitch (resulting from a drop after a high pitched phone) | ` | ◌̀ |
| falling pitch | ^ | ◌̂ | |
| Other | syllabic consonant | | | ◌̩ |
| ingressive air flow | J! | ↓ | |
| egressive air flow (whistle) | F! | w͎ | |
| breathy voice | H | ◌̤ | |
| nasalization | & | ◌̃ | |
| lip rounding | W | ◌̹ | |
| smack, or kissing sound | Wp! | ʘ | |
| creaky voice | ' | ◌̰ | |
| pharyngeal/laryngeal stricture | : | ◌ˤ | |
| overlength | :: | ːː |
Pérez Báez would like to acknowledge the many people and entities that have made this work possible. At the same time, it must be clear that any error or omission is ultimately the responsibility of the lead compiler.
This research began as part of the PDLMA. Additional data generated within the Spatial Language and Cognition in Mesoamerica project (https://www.acsu.buffalo.edu/~jb77/Mesospace.htm) (NSF Award No. BCS-0723694, PI J. Bohnemeyer) were added at different times. Data cleaning was a multi-year process that began in 2010 and was funded by the Smithsonian Institution and its Recovering Voices initiative, the Summer Stipend for Humanities and Creative Arts Faculty at the University of Oregon, and the 2023 Oregon Humanities Center Diversity, Equity, Inclusion, and Accessibility Faculty Research Fellowship. Editing the meaning descriptions in both Spanish and English was made possible by a sabbatical year at the University of Oregon and a grant from the National Endowment for the Humanities Documenting Endangered Languages Fellowship (award # FN-298418). Regrettably, the grant was illegally canceled on April 3, 2025, by the U.S. Department of Government Efficiency. This eliminated the funding intended to establish a collaboration with members of the Didxazá community to proofread approximately 10,000 examples. In response, the Instituto de Lenguas Originarias de Oaxaca (ILEO), under the direction of Víctor Cata, provided the necessary support for the participation of Nelson Guerra, who made it possible to proofread most of the examples in both Didxazá and Spanish.
This mostly digital borne dictionary was developed alongside the evolution of digital tools for language documentation. As a result, it is witness and a reflection of innumerable and rapid changes over the course of 30 years. Christian Brendel worked tirelessly to overcome the countless data legacy issues stemming from this long history. He has been a dedicated partner in bringing this dictionary to light through expert data management.
Numerous members of the Didxazá community have shared knowledge of their language and culture for this dictionary. Special acknowledgement is due to Rosaura López Cartas, Javier López Cartas, and Rosalino Gallegos Luis who spent 9 weeks each summer for two summers in the case of Javier and Rosalino, and countless summers in the case of Rosaura. These periods often implied time away from family and friends, long work sessions in sedentary conditions and unfamiliar settings. However, all three gave their best to ensure that the documentation of Didxazá would be of the highest quality.
Over the years, Víctor Cata has shared specialized philological and cultural knowledge about the language stemming from his decades of documentation of his language and the history of the Binniza the Zapotec peoples of the Isthmus of Tehuantepec.
Developing Spanish and English meaning descriptions required at times expertise in these two languages that went above my own. Víctor Cata and Olivia Garral Pérez consulted with me on especially challenging entries. Olivia Garral Pérez also produced the English translation of this Introduction based on the Spanish version.
This dictionary contains approximately 10,000 examples with Spanish translations based on translations provided by the community members who originally gave the examples. The Didxazá examples were meticulously reviewed along with their Spanish translations, and were also translated into English for the dictionary. The Didxazá examples and their Spanish versions were proofread primarily by Nelson Guerra, as well as by Pérez Báez. Most of the English translations of the examples were done by Olivia Garral Pérez based on the Spanish translations and subsequently reviewed by Pérez Báez to ensure compatibility with the Didxazá examples.
Many undergraduate students have assisted on research, coding and editing tasks. Chiara Tornabene and Devin Shiple coded entries corresponding to Spanish loanwords. Anne Musica conducted numerous editing tasks aimed at ensuring consistency in notation and structure of data presentation. Olivia Garral Pérez contributed to the development of the semantic field categories, and implemented the coding for throughout the dictionary. Further, she drafted meaning descriptions for personal names and sound symbolic forms. She also proofread the entire dictionary with the aim to correct typographic errors and improve translations as needed.
Thanks are due to the editors and staff of Dictionaria for providing a scholarly, peer-reviewed venue for the publication of this dictionary. The care and patience by Johannes Englisch was especially critical during the final editorial work.
The last two years of lexicographic work were particularly demanding. Pérez Báez required support to counter the physical toll that resulted from hundreds of work sessions typing at a computer. She therefore wishes to thank Grégoire Ohlmann of the Cabinet de kinésithérapie Vibe, as well as the fitness and wellness staff at the Bains Municipaux de Strasbourg. Without them, the work towards this dictionary would have had to be interrupted indefinitely.
A few words of gratitude are due to my husband and my daughter. Much of my time documenting Didxazá also implied time and attention away from them, and I thank them for their patience and for considering this work as important as I think it is.
| Compiladores | Gabriela Pérez Báez, Terrence Kaufman y Christian Brendel |
|---|---|
| Con | Rosaura López Cartas, Javier López Cartas, Rosalino Gallegos Luis y Víctor Cata |
Este diccionario Didxazá – Castellano – Inglés (Xquiaapà' ró' diidxa' xtì' didxazá) tiene como objetivo de proveer la documentación más extensa del léxico del didxazá a la fecha. Este diccionario es el resultado de esfuerzos durante décadas para documentar didxazá como es hablado en las comunidades de La Ventosa, Santa María Xadani y Juchitán de Zaragoza en el Istmo de Tehuantepec, Oaxaca, México. El diccionario tiene entradas léxicas con descripciones de significado en castellano de México e inglés estadounidense. Entre otras categorías, el diccionario incluye:
Muchas de las entradas incluyen frases de ejemplo que ilustran su uso. Cabe señalar, no obstante, que estas frases fueron seleccionadas de un corpus más amplio con el fin de documentar pruebas fonológicas, morfológicas, sintácticas y/o léxicas que se realizaron para una representación óptima de las entradas.
Este diccionario complementa el diccionario especializado Diccionario léxico-botánico del diidxazá en La Ventosa, que contiene 952 entradas etnobotánicas (Pérez Báez et al 2019). Este diccionario también incluye entradas del diccionario etnobotánico cuando éstas representan léxico que uno esperaría encontrar en un diccionario general.
El objetivo principal de este proyecto es el de contribuir a la conservación del didxazá como lengua vital de las comunidades zapotecas del Istmo de Tehuantepec en México y de aquellos que se encuentren en la diáspora. Ahora bien, es común que los diccionarios se consideren como una autoridad en materia del uso de una lengua. Sin embargo, es indispensable no tomar este trabajo como tal, por varias razones. La primera es que la labor de síntesis fue realizada por parte de lingüistas que no son parte de la comunidad de habla del didxazá. Como humanos, y como personas externas a la comunidad de habla, seguramente habrán cometido errores y/o omisiones. La segunda es que, aunque se trabajó con numerosos miembros de la comunidad de habla, de ninguna manera se cubrió la diversidad dialectal de las comunidades de habla en toda su extensión. Los compiladores de este diccionario le ruegan a todo lector y usuario de éste que en cualquier momento en que se pudiera tener una duda entre el habla de una persona de la comunidad de habla y el diccionario, ésta debe atribuirse a la diversidad dialectal de la lengua. Por lo tanto, el habla de la persona no debe invalidarse. Al contrario, el habla de todos quienes conforman las comunidades de habla del didxazá debe validarse como prioritaria por encima del contenido que presenta este diccionario.
La investigación para este diccionario empezó dentro del Proyecto para la documentación de las lenguas de Mesoamérica (PDLMA). El objetivo de este proyecto era documentar el léxico de lenguas cuyas culturas habían desarrollado un sistema de epigrafía. Más de 30 lenguas fueron documentadas con el propósito de llevar a cabo un análisis comparativo y de reconstrucción de las proto-lenguas correspondientes que pudieran facilitar el desciframiento de los sistemas de epígrafía. Terrence Kaufman† inició la documentación del léxico del didxazá con Javier López Cartas en 1995 y 1996 apoyándose en trabajos de elicitación y de recolección de textos. Marilyn Feke se encargó de la elicitación con Rosalino Gallegos Luis en 2000, consiguiendo el material para la mayor parte de las entradas de simbolismo fonológico. Los datos de las fuentes publicadas fueron digitalizadas e ingresadas en la base de datos con las atribuciones correspondientes. Mark Sicoli contribuyó a este esfuerzo. Gabriela Pérez Báez se unió al PLDMA en 2003 y a partir d entonces fue la única compiladora hasta ahora. Dentro del PLDMA, Pérez Báez trabajó con Rosalino Gallegos Luis en 2003 y con Rosaura López Cartas de 2004 en adelante, ocupándose de la elicitación, recolectando y analizando textos y verificando datos. Kaufman siguió activo en la supervisión del diccionario hasta el último verano de PLDMA en 2010. Falleció el 3 de marzo de 2022.
Pérez Báez se encargó de la investigación de campo adicional bajo el patrocinio de dos proyectos. El primero es el proyecto Spatial Language and Cognition in Mesoamerica (NSF Award No. BCS-0723694, PI J. Bohnemeyer), que involucró trabajos experimentales de comunicación explorando términos para las partes del cuerpo, lenguaje espacial, metáforas y metonimia. Los resultados fueron publicados en Pérez Báez (2011, 2018, 2019), Bohnemeyer et al (2015), Alsehri et al (2018), inter alia. El segundo es un proyecto extenso de documentación etnobotánica financiado por la Institución Smithsonian y que Pérez Báez dirigió de 2012 a 2019. Este proyecto se enfocó en recolectar datos botánicos (recolección, fotografía y procesamiento de muestras de plantas) y datos culturales y lingüísticos en la forma de descripciones orales de plantas. Los resultados fueron publicados bajo el nombre Diccionario léxico-botánico del diidxazá en La Ventosa y los materiales pedagógicos fueron diseminados de manera gratuita dentro de las comunidades de hablantes del didxazá.
Las colaboraciones con los contribuidores al diccionario emergieron de varias maneras. Un representante de PDLMA, Benigno Robles, acompañado en una ocasión por Pérez Báez, visitó La Ventosa y Santa María Xadani buscando interesados. Algunas contribuciones resultaron de otras colaboraciones pre-existentes. La información de boca en boca facilitó la participación de numerosos otros contribuidores. Así, el diccionario engloba conocimientos de didxazá compartidos a través de los años por más de 20 hablantes de la lengua. El Cuadro 1 contiene una lista de todos los nombres de los contribuidores de conocimientos en didxazá, así como los códigos correspondientes usados para reconocerlos a ellos y a sus comunidades de origen. Cada uno de estos códigos están seguidos por dos números para representar el año en cual los datos fueron proporcionados.
| EJG | Eustaquio Jiménez Girón |
| FSL | Fernando Sánchez López |
| GB | Gabina Vásquez Luis |
| JAR | Javier Aragón Ríos |
| JLC | Javier López Cartas |
| ND | Jiménez Jiménez & Marcial Cerqueda |
| RGL | Rosalino Gallegos Luis |
| RLC | Rosaura López Cartas |
| RLL | Reyna Guadalupe López López |
| VC | Víctor Cata |
| VOT | Velma Orozco Trujillo |
| VP | Velma Pickett |
Tres fuentes previamente publicadas fueron consultadas: Jiménez Girón 1979 [EJG], Jiménez Jiménez & Marcial Cerqueda 2000 [ND], and Pickett et al 2001 [VP]. Cualquier descripción que se apoye en información de alguna de estas fuentes incluye la atribución correspondiente. En particular, Jiménez Girón 1979 proporciona información cultural y sobre el uso de la lengua que resulta de gran valor y que estaría inaccessible sin su contribución. Cuando es apropiado, se cita a Jiménez Girón con las convenciones de reconocimiento adecuadas.
| ISO 639-3 | zai |
|---|---|
| Nombres | didxazá, zapoteco del Istmo, zapoteco de Juchitán, juchiteco |
| Classificación | Otomangue > Zapoteco > Zapoteco |
| Ubicación | Istmo de Tehuantepec, Oaxaca, México |
| Variedades representadas en el diccionario | La Ventosa, Juchitán de Zaragoza and Santa María Xadani |
El didxazá se habla en la costa sur del Istmo de Tehuantepec en el sur de México y se considera que está en riesgo. Marcial Cerqueda (2014) demostró que, con base el Índice de Remplazo Etnolingüístico (Orodica 2009), el diixaza se encuentra en un proceso de extinción lenta a extinción acelerada. El Endangered Languages Project clasifica el didxazá como lengua vulnerable con una población de hablantes de 80,000 personas. El Instituto Nacional de Lenguas Indígenas (INALI) clasifica al diidxaxa en situación de mediano riesgo de desaparición. De las 22 municipalidades donde se habla didxazá, solo en Santa María Xadani y en San Blas Atempa crecen los niños hablando la lengua (Marcial Cerqueda 2014). En la comunidad de La Ventosa, donde se ha llevado a cabo la mayor parte de la investigación, los hablantes más jóvenes tienen alrededor de 30 años. Según el censo del 2000, en Tehuantepec, que antes era la capital de las comunidades zapotecas en el Istmo, solo quedan alrededor de 4,000 hablantes de una población de más de 50,000. Dada la progresión avanzada del remplazo lingüístico, existen esfuerzos locales para retomar dominios para el uso del didxazá. Esperamos que este diccionario sea una fuente de información sobre la lengua para apoyar estos esfuerzos.
El didxazá es una lengua de verbo-sujeto-objeto (VSO) y marcaje de núcleo. Su fonología compleja incluye tono contrastivo y tres tipos distintos de núcleos silábicos que interactúan con patrones prosódicos. Los tonos pueden ser bajos, ascendentes o altos, y tienen a la vez funciones léxicas y gramaticales. El inventario de vocales consiste de cinco vocales cardinales /i, e, a, o, u/ que pueden ser modales (V), glotalizadas (Vʔ), o rearticuladas (VV), con esta última opción ocurriendo únicamente en las sílabas tónicas de las raíces. Las raíces de las palabras son canónicamente monosilábicas o bisilábicas, la mayoría teniendo una estructura CV(CV). Didxazá se considera como una variante conservadora de la rama central porque conserva las vocales que preceden o le siguen a las sílabas tónicas, las cuales se han elidido en muchas otras lenguas de la rama central como las de los valles centrales de Oaxaca (see Campbell 2017 and Smith-Stark 2007 inter alia para detalles sobre la complejidad de la diversificación dentro de las lenguas zapotecas). En didxazá, la primera sílaba de una raíz es consistentemente prosódica.
El inventario de consonantes del didxazá representado con el Alfabeto fonético internacional (AFI) se presenta en el Cuadro 3.
| Bilabial | Alveolar | Postalveolar | Palatal | Velar | Labio-velar | Glotal | |
|---|---|---|---|---|---|---|---|
| Oclusiva | p | t | k | kʷ | |||
| b | d | g | |||||
| Nasal | m | n | ɲ | ||||
| Vibrante múltiple | r | ||||||
| Vibrante simple | ɾ | ||||||
| Fricativa | s | ʃ | f | ||||
| z | ʒ | ||||||
| Africada | t͡ʃ | ||||||
| d͡ʒ | |||||||
| Aproximante | w | j | w | ||||
| Aproximante lateral | l |
Todo lema en el diccionario están escritos en el campo Headword según las Norma del sistema de escritura de la lengua zapoteca de 2016 (Norma, Cata et al 2016 ms), que en sí se basa en el Alfabeto popular del zapoteco del Istmo (Alfabeto Popular, Anonymous 1956). Adicionalmente, el diccionario incluye un campo etiquetado PDLMA bajo la cejilla de Words Extra con la representación ortográfica del PLDMA que es más fiel a la fonología del didxazá en cuanto a que evita las idiosincrasias de la ortografía del castellano y documenta la composición morfológica y prosódica de cada lema. Además, es compatible con unas 30 bases de datos sobre lenguas mesoamericanas producidas por el PDLMA y permite entonces un análisis comparativo entre todas ellas.
| Bilabial | Alveolar | Postalveolar | Palatal | Velar | Labio-velar | Glotal | |
|---|---|---|---|---|---|---|---|
| Oclusiva | p | t | c, qu = k | cu = kw | |||
| b | d | g, gu = g | |||||
| Nasal | m | n = n, nn | ñ = ny | ||||
| Vibrante múltiple | rr | ||||||
| Vibrante simple | rr | ||||||
| Fricativa | s | x, xh = x | f | ||||
| z | x = zh | ||||||
| Africada | ch | ||||||
| dx | |||||||
| Aproximante | hu, u = w | i = y | hu, u = w | ||||
| Aproximante lateral | l = l, ll |
En el Alfabeto Popular, los tonos no son representados sistemáticamente pues se argumenta que los hablantes de la lengua pueden desambiguar sin necesidad de la representación tonal. En vez de representar cada tono, un acento agudo se usa para marcar la prominencia fonética de un segmento vocálico la cual es a veces el resultado de un tono agudo y a veces del alargamiento predecible de una vocal. Por consecuencia, el uso del acento agudo en el Alfabeto Popular resulta en un uso que no es consistente con una representación de una característica fonológica única.
La Norma (Cata et al 2016 ms) hace una propuesta para la representación de los tonos que sigue el principio de función única de los diacríticos. Esto es consistente con la recomendación que hace el Alfabeto Popular sobre el uso de diacríticos para efectos de una documentación completa de la lengua. Además, es compatible con la ortografía del PDLMA. Tanto en la Norma como en la ortografía del PDLMA, un tono bajo no tiene marca por ser el tono más frecuente. Un tono alto es marcado con acento agudo en la Norma y con un punto de exclamación en el PDLMA. Un tono ascendente es marcado con un acento grave en la Norma y con un asterisco en el PDLMA. Esto se muestra en el Cuadro 5.
| Tono | Norma | PDLMA | ||
|---|---|---|---|---|
| Bajo | No se representa | nanda ‘frío’ | No se representa | nanda ‘frío’ |
| Alto | Representado con un acento agudo | nandá' ‘caliente’ | Representado con ! | nanda!7‘caliente’ |
| Ascendente | Representado con un acento grave | nandà ‘colgado’ | Representado con * | nanda* ‘colgado’ |
La ortografía del PDLMA se diferencia de la Norma de varias maneras. Las vocales glotalizadas son representadas con un número 7 después de la vocal como en gye7 ‘flor’ mientras que la Norma usa un apóstrofe como en guie’ ‘flor’. Hay que aclarar que la mayor parte de los datos en el diccionario fueron proporcionados por miembros de la comunidad de La Ventosa. En su variante del didxazá, la laringización en la primera sílaba de una raíz bisilábica predice la laringización en la vocal de la siguiente sílaba. Esto fue documentado en la ortografía PDLMA a manera de evitar la repetición de la marca del cierre glotal predecible. Sin embargo, la Norma (Cata et al 2016 ms) no usa esa convención porque no todas las variantes del didxazá presentan las misma fonotáctica. Esto resulta en lo que podría aparecer como una discrepancia entre las representaciones ortográficas de la Norma y del PDLMA, como en el caso de gui’xhi’ ‘montaña, monte, bosque’ según la Norma y gi7xi en el PDLMA.
Un reto considerable para la lexicografía del didxazá es la representación de los compuestos léxicos. Esto se debe a que no se han encontrado propiedades segmentales ni fonológicas, ni tampoco reglas fonológicas que marquen una distinción formal entre los compuestos léxicos y cualquier otra secuencia de lexemas (Pérez Báez et al 2015). En este diccionario se han llevado a cabo extensas pruebas sintácticas (idem) para determinar si una secuencia de lexemas constituye un compuesto léxico que deba representarse como una sola palabra ortográfica, si constituye un lexema de frase con dos o más palabras ortográficas, o simplemente una secuencia de lexemas de carácter composicional que no requiera de una entrada léxica. No todas las pruebas dieron resultados claros, y no todas las secuencias se pudieron someter a este diagnóstico.
En la medida en que dichas pruebas dejaron en claro aquellas entradas léxicas constituidas por compuestos léxicos, estas representaron un reto adicional. En el habla rápida, la laringización de las vocales suele reducirse por lo cual, cualquier compuesto con vocales laringizadas así como cualquier secuencia de lexemas con las mismas, tienen la misma realización que resulta en una laringización simplificada. El Alfabeto Popular y la Norma estipulan que dicha simplificación debe representarse en los compuestos léxicos resultando en la representación de vocales glotalizadas y rearticuladas como vocales modales. Sin embargo, esto representa una dificultad considerable para la lexicografía de la lengua.
En primer lugar, la distinción ortográfica estipulada por el Alfabeto Popular y la Norma sugiere una distinción en la realización fonética de las secuencias de palabras en comparación con los compuestos la cual, como ya se ha establecido, no parece existir (Pérez Báez et al 2015). En segundo lugar, dicha estipulación no se apega a las distintas estructuras de lexemas que la evidencia empírica ha arrojado. En tercer lugar, y considerando la situación de desplazo lingüístico al que se enfrenta la lengua, el presentar dos representaciones ortográficas de una misma raíz sin tener una regla fonológica que la avale complica considerablemente cualquier proceso de enseñanza de la lectoescritura a hablantes de herencia.
Considerando todo esto, y de manera compatible con el principio de documentar la lengua de manera completa como se menciona en el Alfabeto Popular, Pérez Báez se ha permitido proponer una representación ortográfica de los compuestos que se apega a la evidencia empírica disponible hasta el momento, aún si difiere del Alfabeto Popular y la Norma. Pérez Báez ha tomado la decisión, consciente de que la última palabra la tiene la comunidad de lengua. Por lo tanto, anticipando la adopción formal de la Norma en un futuro, los datos presentados en el diccionario han sido preparados con la mayor consistencia posible de manera que de ser necesario, se puedan hacer modificaciones automatizadas si la Norma, una vez adoptada formalmente, así lo estipulara.
Con respecto a la estructura morfológica de una palabra y del acento prosódico, la ortografía del PDLMA documenta los dos rigurosamente. El acento prosódico es predecible con base en la estructura de la raíz. Sin embargo, se representa en la ortografía PDLMA para proporcionar la documentación más completa posible sobre la estructura de las palabras ya que esto puede ser necesario para una diversidad de intereses entre hablantes, estudiantes y analistas de la lengua. Un guión marca un límite entre una raíz y otros afijos extramétricos. Un signo de más marca un clítico. Un punto marca un límite entre morfemas entre una misma sílaba CV(CV) o unidad prosódica. Estos y otros símbolos usados en el diccionario se encuentran en el Cuadro 6.
| Símbolo | Descripción |
|---|---|
| . | separación de morfemas |
| + | clítico |
| = | marca la unión de un morfema libre y uno dependiente, o de dos morfemas libres en un compuesto |
| - | marcasión de raíz |
| # | separación de palabras |
| ~ | alternancia de formas |
| () | En los datos del didxazá, los paréntesis señalan elementos que no son necesarios para que la oración sea gramatical o aceptable. |
| En las traducciones en castellano o en inglés de los ejemplos en el didxazá, los paréntesis se usan en dos contextos. En el caso en que los paréntesis están presentes en el ejemplo en didxazá, los paréntesis en el castellano o en el inglés reflejan la información en los paréntesis en el didxazá. En los casos donde los paréntesis no aparecen en el ejemplo en didxazá, éstos señalan información que no está incluída en el ejemplo en didxazá pero que es necesaria para desambiguar o agregar claridad a las traducciones para asegurarse de que el lector entienda el significado del didxazá con la mayor precisión posible. |
Ahora bien, la autodenominación de la lengua tradicionalmente y en la Norma está estipulada como didxazá. Esta representación contiene dos elementos analíticos que la evidencia empírica no respalda. El primero es el ya mencionado proceso de simplificación vocálica de los compuestos. Didxazá es un compuesto que comprende diidxa ‘palabra’ y za, un morfema cuya glosa representa un reto analítico. En la actualidad, za puede representar dos sustantivos homófonos, ‘nube’ y ‘manteca’. Sin embargo, como lo explica Oudijk (2012), el morfema tiene una posible etimología que no confirma las glosas ‘nube’ ni mucho menos ‘manteca’, y que abre la posibilidad de glosas que apuntan hacia conceptos de reciprocidad y relación social. Independientemente de este análisis inconcluso hasta hoy, el morfema es monosilábico, de vocal modal con tono bajo. En una sílaba de esta estructura al final de la palabra, la resonancia de la vocal genera la percepción de duración alargada. En el Alfabeto Popular, dicha realización fonética remite al punto “j) Para la acentuación de las palabras del zapoteco se usará el acento ortográfico tal como se emplea en español, cuando el caso lo requiera”. Sin embargo, no se detallan reglas fonológicas u ortográficas para determinar cuándo se requeriría tal uso, además que como ya se ha establecido, el acento prosódico del didxazá y el del castellano obedecen a una serie de aspectos fonotácticos y léxico que no son compatibles entre ellos en lo absoluto. Dado que cualquier vocal modal a final de palabra tiene una resonancia extendida, la prominencia de dicha vocal es predecible y no requiere de representación ortográfica alguna, además de que el uso del acento agudo competiría en este caso con la representación del tono alto el cual no es predecible y requiere de representación ortográfica consistente.
Dado lo explicado, este diccionario hubiera preferido representar la autodenominación de la lengua como diidxaza. Sin embargo, aunque la evidencia empírica que se presenta en este diccionario no es compatible con la representación ortográfica didxazá, ésta última se favorece para respetar las décadas que lleva en uso entre las comunidades de lengua y el hecho de que es la representación que estipulan tanto el Alfabeto Popular como la Norma.
Un último tema a tratar en este apartado es el de la representación de los préstamos, sobre todo aquellos de reciente inserción a partir del castellano. La Norma estipula que aquellos préstamos que se han zapotequizado deberán escribirse como palabras del didxazá mientras que los préstamos que no se hayan zapotequizado aún deberán escribirse según las normas ortográficas del idioma de origen. La documentación que se ha realizado para este diccionario muestra que todo préstamo del castellano, sea reciente o de siglos atrás, ha sido zapotequizado de una u otra manera. Los préstamos contemporáneos suelen incluir consonantes que no está presentes en el inventario fonológico del didxazá e incluso conservan estructuras silábicas del castellano y que no forman parte de la fonotáctica del didxazá. Es por esto que los préstamos más recientes pueden dar la impresión de no estar zapotequizados. Sin embargo, en dichos préstamos el acento prosódico del castellano se adapta consistentemente al sistema tonal del didxazá: a la sílaba tónica se le asigna un tono ascendente. Esto demuestra un proceso de adaptación fonológica o de zapotequización, por lo cual en este diccionario se ha optado por adaptar todo préstamo a la ortografía del didxazá, salvo en los casos de nombres oficiales de personas o lugares.
Las descripciones de significado fueron escritas con distintos públicos en mente. El público principal de las descripciones en castellano es la comunidad de la lengua, lo cual incluye el espectro entero de miembros de la comunidad desde los que tienen hablan de manera cómoda y fluida hasta los que tienen capacidad receptiva, así como los estudiantes de todos niveles. Las descripciones en castellano evitan términos técnicos de lingüística para mantener el contenido accesible. Estas descripciones incluyen traducciones equivalentes en castellano así como todo el saber cultural presentado de una manera que es informativa a los lectores fuera de la comunidad lingüística sin ser redundante a los miembros de esa comunidad. Las descripciones en inglés se escribieron para un público fuera de la comunidad lingüística y puede tener más detalle para contextualizar el saber cultural. Estas pueden incluir terminología técnica lingüística si es necesario. Hay que aclarar que las descripciones de significado en inglés y en castellano no son traducciones directas de una lengua a la otra, sino que fueron escritas con públicos distintos en mente.
Las siguientes secciones proporcionan descripciones concisas de los aspectos más relevantes de la gramática del didxazá según sean relevantes al diccionario. Sin embargo, estas notas no tienen la intención de ser una gramática descriptiva completa.
Las entradas del diccionario se codifican según las categorías gramaticales enumeradas en el Cuadro 7. Las entradas también están codificadas con base en una diversidad de propiedades de su categoría gramatical. Por ejemplo, los verbos están codificados por clase y valencia y los adjetivos están codificados según el paradigma derivacional en el que participan. Estos códigos se presentan después de los dos puntos que le siguen al código gramatical y se encuentran en la columna de Additional Information (‘información adicional’) bajo la cejilla Words Extra. El Cuadro 8 enumera todos los códigos usados en la columna de Additional Information.
Didxazá es una lengua que frecuentemente lexicaliza frases con más de una palabra fonológica. Por esta razón, el diccionario incluye numerosas entradas de varias palabras que se definen de esta manera:
| Parte de la Oración | Descripción |
|---|---|
| a | adjetivo |
| av | adverbio |
| clq | expresión coloquial sin clasificación |
| cnj | conjunción |
| dem | demostrativo |
| dsp | raíz o base (dis)posicional que predica sobre la relación entre una figura y un fondo (Bohnemeyer & Brown 2007) |
| enf | enfatizador |
| int | marcador de interrogación |
| itj | interjección |
| n | nombre propio |
| ndf | artículo indefinido |
| neg | marca de negación |
| nmr | nominalizador |
| nn | apodo |
| nom | nominalización |
| num | número |
| pcp | participio |
| pl | marcador de plural |
| prfp | participio perfecto |
| prn | pronombre |
| prp | preposición |
| prt | partícula |
| q | cuantificador |
| rlc | cláusula relativa |
| quo | marcador de cita |
| s | sustantivo |
| smb | simbolismo fonológico |
| sr | sustantivo relacional |
| v | verbo |
| voc | vocativo |
| xpl | expletivo |
| Parte de la Oración | Descripción |
|---|---|
| a:ctf | forma contrafactual de un verbo utilizada como adjetivo |
| a:dv1a | adjetivo deverbalizado derivado de una raíz verbal y marcado mediante un tono ascendente fonéticamente realizado |
| a:dv1b | adjetivo deverbalizado derivado de una raíz verbal y marcado mediante un tono ascendente que se surge fonéticamente como un tono alto en una vocal cortada |
| a:dv1sim | adjetivo deverbalizado derivado de una raíz verbal y marcado mediante un tono alto y el prefijo -na |
| a:dvsim | adjetivo deverbalizado derivado mediante el prefijo -na |
| a:sim | adjetivo similitivo derivado de un sustantivo o de un adjetivo básico |
| dem:dir | demostrativo con función direccional |
| dem:hum | demostrativo cuyo referente es estríctamente humano |
| n:ani | nombre propio de animal |
| n:fam | apellido |
| n:fem | nombre de mujer |
| n:mas | nombre de hombre |
| nn:fam | apodo, sobrenombre de familia |
| nn:fem | apodo de mujer |
| nn:mas | apodo de hombre |
| num:ord | número ordinal |
| prn:1 | pronombre de primera persona |
| prn:1rfl | pronombre reflexivo de primera persona |
| prn:2 | pronombre de segunda persona |
| prn:2rfl | pronombre reflexivo de segunda persona |
| prn:3ch | pronombre de tercera persona específico para niños |
| prn:3i | pronombre de tercera persona inanimado |
| prn:3m | pronombre de tercera persona masculino |
| prn:3n | pronombre de tercera persona específico para alguien a quien se le tiene lástima |
| prn:3n-r | pronombre de tercera persona no racional/animal no humano |
| prn:3r | pronombre de tercera persona racional/humano |
| prn:3rfl | pronombre de tercera persona reflexivo |
| prn:4I | pronombre de primera persona plural inclusiva |
| prn:4Irfl | pronombre reflexivo de primera persona plural inclusiva |
| prn:4X | pronombre de primera persona plural exclusiva |
| prn:5 | pronombre de segunda persona plural |
| prn:ndf | pronombre indefinido |
| prn:ndf-a | pronombre indefinido animado |
| prn:ndf-i | pronombre indefinido inanimado |
| prn:pos | pronombre posesivo |
| prn:rel | pronombre relativo |
| prn:ri-a | pronombre relativo interrogativo |
| q:int | cuantificador con función interrogativa |
| q:med | cuantificador que describe una medida |
| q:set | cuantificador que denota un conjunto |
| q:tmp | cuantificador de tiempo |
| rlc:lf | lexema de frase con construcción de cláusula relativa |
| s:der | sustantivo derivado |
| s:lf | sustantivo con estructura de frase |
| s:med | sustantivo que denota una medida |
| s:pos | sustantivo poseído |
| s:rel | sustantivo relacional |
| smb:s | simbolismo fonológico adaptado y con función nominal |
| v:and | verbo en su forma andativa |
Los verbos se presentan en el diccionario en su forma aspectual del habitual, con el prefijo marcador habitual ri-. Esta es una de las siete categorías de inflexión verbal en la lengua y el estándar que se utiliza para citar los verbos en la lexicografía zapoteca. El Cuadro 9 enumera las categorías de inflexión verbal documentadas en la lengua, principalmente las categorías de aspecto y modo. El didxazá tiene uno de los inventarios de categorías de inflexión verbal más grandes entre las lenguas zapotecas. Un análisis morfofonológico detallado sobre las clases verbales en didxazá se puede consultar en Pérez Báez and Kaufman 201. Un análisis de valencia en didxazá se puede consultar en Pérez Báez 2015 y también en Pérez Báez and Kaufman 2016.
| Función | Abreviación | Morfemas |
|---|---|---|
| Habitual | HAB | ri= |
| Completivo | CMP | be=, gu= |
| Potencial | POT | |
| Contrafactual | CTF | |
| Progresivo | PRG | |
| Perfectivo | PRF | way= |
| Futuro | FUT | za= |
Los verbos en didxazá se pueden dividir en cuatro clases verbales basados en sus aspectos habitual y completivo, y en el modo potencial. La forma habitual permite el aislamiento de la raíz. Los alomorfos en el completivo permiten la clasificación de los verbos de clase A. Una consonante de reemplazo en el tema en la forma completiva identifica los verbos de clase D. La interacción consonántica entre el marcador del potencial y la raíz en el completivo identifica los verbos pertenecientes a las clases C y D. El Cuadro 10 muestra las formas morfológicas asociadas con cada clase verbal.
| Clase A | Clase B | Clase C | Clase D | |
|---|---|---|---|---|
| Segmento inicial | -C; -u, -e | -C, -V | -C, -V | -C, -V |
| Habitual | ri= | ri= | ri= | ri= |
| Completivo | be= | gu= | gu= | gu= con remplazo de la consonante inicial del tema |
| Potencial | gǐ= | gǐ= | gˇ= donde gˇ+C>#CC | gˇ= donde gˇ+C>#CC |
Las entradas verbales en el diccionario incluyen documentación sobre las formas potenciales, habituales, y completivas para determinar la clase de cada verbo. La clase verbal está codificada en la columna de Additional Information bajo la cejilla de Words Extra. El Cuadro 11 enumera los códigos usados en la documentación de clases verbales.
| Clase Verbale | Descripción |
|---|---|
| vA | verbo de clase A |
| vA irr | verbo de clase A con inflección irregular |
| vA~C | clase A y clase C |
| vB | verbo de clase B |
| vB irr | verbo de clase B irregular con inflección irregular |
| vC | verbo de clase C |
| vC irr | verbo de clase C con inflección irregular |
| vD (k > ch) | verbo de clase D con remplazo de consonante (k > ch) en el completivo |
| vD (k > l) | verbo de clase D con remplazo de consonante (k > l) en el completivo |
| vD (k > t) | verbo de clase D con remplazo de consonante (k > t) en el completivo |
| vD (p > l) | verbo de clase D con remplazo de consonante (p > l) en el completivo |
| vD (p > r) | verbo de clase D con remplazo de consonante (p > r) en el completivo |
| vD (0 > t) | verbo de clase D con remplazo de consonante (0 > t) en el completivo |
El didxazá tiene una clase de adjetivos definidos según sus propiedades de distribución: como parte de una frase nominal que sigue o precede al núcleo nominal al que modifica al codificar las propiedades del referente del sustantivo. En didxazá, se pueden ver dos tipos de adjetivos: básicos y derivados. Los adjetivos básicos son los que no son derivados de raíces o de bases. Esto es en contraste con los modificadores derivados. Algunos modificadores se derivan de las raíces de verbos, no toman prefijos de inflexión, y están marcados por un cambio en el patrón tonal de la raíz. La forma derivada que resulta de esto generalmente muestra la forma canónica CVCV de la raíz verbal pero exhibe un patrón tonal con un tono ascendente que puede manifestarse como tal, o como un tono alto con glotalización de la vocal portadora del tono. Estas formas derivadas se consideran adjetivos derivados en el diccionario y son codificados de esa manera. Un patrón derivacional adicional genera modificadores marcados por el prefijo na-. Este proceso ha sido documentado en varias otras lenguas zapotecas y las formas na- generalmente se han descrito como verbos de estado, o sea como formas de inflección verbal. Sin embargo, los datos del didxazá han demostrado que las formas na- no tienen los mismos patrones de distribución que los verbos, sino que siguen los patrones de los adjetivos básicos y derivados. Además, mientras que el prefijo na- puede agregarse a una base verbal para derivar un modificador versivo, también se puede agregar a un sustantivo o adjetivo básico para derivar un modificador similitivo. En todos los casos, las formas derivadas están marcadas por el hecho de que no exhiben ningún cambio al patrón tonal del tema. Para demostrar esta complejidad, se proponen las siguientes clasificaciones.
Las entradas han sido codificadas con base en uno o más campos semánticos. El Cuadro 12 enumera los códigos utilizados.
| Categoría | Campo semántico |
|---|---|
| actividad | acciones |
| viajes y transportes | |
| medioambiente | animales |
| cuerpos de agua | |
| hongos | |
| insectos | |
| fenómenos | |
| plantas | |
| cielo | |
| topografía | |
| hogar | construcción |
| muebleario | |
| procesos | |
| herramientas y utensilios | |
| persona | comportamiento |
| partes del cuerpo | |
| carácter | |
| ropa y accesorios | |
| cognición | |
| emoción | |
| percepción | |
| características físicas | |
| espiritualidad | |
| bienestar | |
| cuantificación | medidas y cantidades |
| números | |
| referencia | gentilicios |
| merónimos | |
| metáforas | |
| nombres | |
| topónimos | |
| vida social | comunicación |
| prácticas culturales | |
| experiencia | |
| juegos y juguetes | |
| gobierno | |
| parentesco | |
| etapas de la vida | |
| música y baile | |
| nombres y designaciones | |
| categorías sociales | |
| actos comunicativos | |
| valores | |
| estados | cambios de estado |
| color | |
| locación | |
| manera | |
| movimiento | |
| posición | |
| forma | |
| tamaño | |
| estado | |
| tiempo | |
| sustento | bebidas |
| comercio | |
| cultivo | |
| alimentos | |
| ocupaciones | |
| sustento | |
| otros | simbolismo fonológico |
La documentación llevada a cabo por el PDLMA tiene como propósito de llegar a un alcance de documentación más allá de los objetivos de la mayoría de los esfuerzos. Dos campos semánticos que se incluyen en este diccionario y que se podrían considerar como inusuales para un diccionario son los nombres personales, los apodos, y el simbolismo fonológico. Estos campos semánticos se valoran en la documentación por varias razones. Primero, los nombres y apodos reflejan aspectos de relaciones sociales como profesiones, experiencias, lazos familiares y características individuales – ya sea positivas o negativas. Segundo, los nombres y apodos, así como el simbolismo fonológico, demuestran aspectos de la fonología de la lengua que se podrían pasar por alto si no se documentan estos dominios. Tercero, se espera que las más de 600 formas de simbolismo fonológico que se incluyen en el diccionario motiven su análisis. El valor de documentar y estudiar el simbolismo fonológico se puso en valor en Hinton et al (1994). El estudio del simbolismo fonológico puede informar nuestra comprensión de la convencionalización de las relaciones forma-significado incluyendo el nivel de detalle estructural de la forma que pudiera ser convencionalizada. También contribuye a acrecentar nuestra comprensión acerca del papel de la iconicidad en la lengua, en contraste con la supuesta predominancia de la relación arbitraria entre forma y significado, sobre todo cuando se estudia el simbolismo fonológico dentro de un marco comparativo.
A pesar de esto, el simbolismo fonológico sigue siendo un tema poco estudiado, y ninguna publicación existe sobre el simbolismo fonológico en didxazá. El hecho de que este tema rara vez sea documentado probablemente viene del hecho que la representación ortográfica de las formas en cuestión es un reto. PDLMA ha creado convenciones para su representación que se siguen en este diccionario. El Cuadro 13 enumera las convenciones del PDLMA relevantes para el simbolismo fonológico en didxazá como aparecen en el campo PDLMA de la cejilla Words Extra del diccionario. Adicionalmente, se debería notar que las consonantes largas se han escrito en mayúsculas, las consonantes sordas son seguidas de una h, y las vocales sordas se representan con mayúsculas. El Cuadro 13 enumera también las convenciones equivalentes en el Alfabeto Fonético Internacional (IPA, IPA, International Phonetic Association 2018) así como en las Extensiones del Alfabeto Fonético Internacional (ExtIPA, Ball et al 2018). Estos se usan en el campo Headword de la cejilla Words de manera complementaria a las convenciones de la Norma. Cabe aclarar que aunque los caracteres ExtIPA incluidos en la documentación del simbolismo fonológico en didxazá están considerados por la Asociación Fonética Internacional como caracteres que representan trastornos del habla. Sin embargo, ese no es el caso en lo absoluto en el didxazá.
| Categoría | Descripción | PDLMA | IPA, ExtIPA |
|---|---|---|---|
| Consonantes | velar nasal | 9 | ŋ |
| vibrante múltiple bilabial sorda | b~ | ʙ | |
| Vocales | cerrada central no redondeada | 3 | ɨ |
| semicerrada central | 6 | ə | |
| abierta anterior | 4 | a | |
| Tono | bajo (como resultado de la caída posterior a un tono alto | ` | ◌̀ |
| descendiente | ^ | ◌̂ | |
| Otros | consonante silábica | | | ◌̩ |
| flujo de aire ingresivo | J! | ↓ | |
| flujo de aire egresivo (silbido) | F! | w͎ | |
| voz murmurada/de hálito | H | ◌̤ | |
| nasalización | & | ◌̃ | |
| redondeo labial | W | ◌̹ | |
| tronido de beso | Wp! | ʘ | |
| voz rota | ' | ◌̰ | |
| constricción laríngea/faríngea | : | ◌ˤ | |
| duración extra larga | :: | ːː |
Pérez Báez quisiera reconocer las muchas personas y entidades que hicieron posible este trabajo. Al mismo tiempo, debe quedar claro que cualquier error u omisión es ultimadamente la responsabilidad de la compiladora principal.
Esta investigación se inició como parte del PDLMA. En momentos distintos se agregaron datos adicionales generados dentro del proyecto Spatial Language and Cognition in Mesoamerica (https://www.acsu.buffalo.edu/~jb77/Mesospace.htm) (NSF Award No. BCS-0723694, PI J. Bohnemeyer). La limpieza de los datos fue un proceso de muchos años que empezó en 2010 y fue financiado por la Institución Smithsonian y su iniciativa Recovering Voices, el Summer Stipend for Humanities and Creative Arts Faculty de la University of Oregon y la 2023 Oregon Humanities Center Diversity, Equity, Inclusion, and Accessibility Faculty Research Fellowship. La edición de las descripciones de significado tanto en castellano como en inglés fue posible gracias a un año sabático de la University of Oregon y una beca del programa National Endowment for the Humanities Documenting Endangered Languages Fellowship (award # FN-298418). Lamentablemente, la beca fue cancelada ilegalmente el 3 de abril de 2025 por el Department of Government Efficiency del gobierno de los Estados Unidos. Esto eliminó los fondos destinados a entablar una colaboración con miembros de la comunidad de lengua para realizar la corrección de estilo de alrededor de 10,000 ejemplos. Ante la situación, el Instituto de Lenguas Originarias de Oaxaca (ILEO) bajo la dirección del maestro Víctor Cata otorgó el apoyo necesario para la participación del maestro Nelson Guerra quien hizo posible la mayor parte de la corrección de estilo de los ejemplos tanto en didxazá como en castellano.
Este diccionario desarrollado mayormente en formato digital evolucionó al mismo tiempo que las herramientas digitales para la documentación de lenguas de principios del siglo XXI. Consecuentemente, es testigo y reflejo de los innumerables y rápidos cambios en los últimos 30 años. Christian Brendel trabajó incansablemente para superar los innumerables retos que nos representó el legado de datos producto de la larga historia de este proyecto y ha sido un colega dedicado en el proceso de abrir el diccionario al mundo a través de su manejo cuidadoso de los datos.
Numerosos miembros de la comunidad de lengua del didxazá han compartido sus conocimientos sobre la lengua y cultura para este diccionario. Entre ellos, merecen un reconocimiento especial Rosaura López Cartas, Javier López Cartas, y Rosalino Gallegos Luis quienes pasaron 9 semanas cada verano durante dos años en el caso de Javier y Rosalino, e innumerables veranos en el caso de Rosaura. Estos periodos frecuentemente significaban tiempo lejos de su familia y amigos, largas sesiones de trabajo en condiciones sedentarias y en ambientes desconocidos. Sin embargo, los tres dieron su mejor esfuerzo para que la documentación del didxazá fuera de la más alta calidad.
A través de los años, Víctor Cata ha compartido sus gran acervo cultural y filológico sobre la lengua proveniente de su propia labor de documentación de su lengua y de la historia del pueblo Binniza del Istmo de Tehuantepec.
Las descripciones de significado tanto en inglés como en castellano requirieron en ciertos momentos de una especialización en las dos lenguas que sobrepasaba mis conocimientos. Víctor Cata y Olivia Garral Pérez consultaron conmigo en entradas particularmente difíciles. También se le agradece a Olivia Garral Pérez por esta traducción al castellano de la introducción al diccionario.
Este diccionario cuenta con unos 10,000 ejemplos con traducciones al castellano redactadas con base en traducciones proporcionadas por los colaboradores que contribuyeron los ejemplos mismos. Los ejemplos en didxazá fueron minuciosamente revisados junto con sus traducciones al castellano además de que para el diccionario se tradujeron también al inglés. La labor de revisión de estilo de los ejemplos en didxazá y su versión en castellano fue realizada en su gran mayoría por el Maestro Nelson Guerra, así como por Pérez Báez. La mayoría de las traducciones de los ejemplos al inglés fue realizada por Olivia Garral Pérez a partir de la traducción de los ejemplos en castellano, y revisada posteriormente por Pérez Báez para asegurar la compatibilidad con los ejemplos en didxazá.
Varios estudiantes de licenciatura han asistido en la investigación, codificación, y trabajos de edición. Chiara Tornabene y Devin Shiple codificaron entradas correspondientes a préstamos del castellano. Anne Musica se ocupó de numerosos trabajos de edición con el objetivo de asegurar la consistencia de la estructura de la representación de los datos. Olivia Garral Pérez contribuyó al desarrollo de las categorías semánticas, e implementó la codificación a través del diccionario. Igualmente escribió las descripciones de significado para los nombres propios y simbolismos fonológicos además de revisar el diccionario entero con el propósito de corregir errores tipográficos y mejorar las traducciones si fuese necesario.
Cabe agradecer a los editores y al equipo de Dictionaria por ofrecer un espacio académico y sometido a revisión por pares para la publicación de este diccionario. El esmero y la paciencia de Johannes Englisch fueron fundamentales durante la fase final de la labor editorial.
Los últimos dos años de trabajo lexicográfico fueron particularmente exigentes. Pérez Báez requirió de apoyo para contrarrestar el impacto físico del tiempo frente a la computadora tecleando durante cientos de sesiones de trabajo continuo. Por lo tanto, agradece a Grégoire Ohlmann del Cabinet de kinésithérapie Vibe, así como al personal de acondicionamiento físico y de bienestar de los Bains Municipaux de Strasbourg. Sin estos, el trabajo hubiera tenido que ser detenido indefinidamente.
Y de manera muy personal, deseo expresar mi agradecimiento a mi esposo y mi hija. Mucho de mi tiempo documentando el didxazá significaba atención desviada y tiempo lejos de ellos. Por esto mismo, les agradezco su paciencia y el que le hayan dado a este trabajo la importancia que pienso que merece.
| Full Entry | Headword | Part of Speech | Meaning Description | Spanish | Semantic Domain | Examples |
|---|---|---|---|---|---|---|
| Full Entry | Headword | Part of Speech | Meaning Description | Additional Information | PDLMA |
|---|---|---|---|---|---|
| Primary Text | Translation | Spanish | IGT |
|---|---|---|---|