Cargando aplicación...
Preparando tu experiencia meskeIA
4.000 años organizando el conocimiento humano: de las tablillas cuneiformes sumerias a la inteligencia artificial
Haz clic en un período para ver sus detalles. La línea abarca de 2000 a.C. a Presente.
4.000 años organizando el conocimiento humano: de las tablillas cuneiformes sumerias a la inteligencia artificial
De las primeras listas de palabras en tablillas de arcilla sumerias (~2000 a.C.) a la Wikipedia con 60 millones de artículos en 332 idiomas: la historia de los diccionarios y enciclopedias es la historia del deseo humano de organizar, preservar y democratizar el conocimiento. Cada época generó sus propias formas de sistematizar el saber, desde la oralidad y la escritura cuneiforme hasta la IA generativa, pasando por la imprenta, las academias nacionales y la edición colaborativa en internet.
| Período | Fecha | Categoría | Figura clave | Aportación principal |
|---|---|---|---|---|
| Etymologiae — Isidoro de Sevilla | ~630 d.C. | enciclopedia | Isidoro de Sevilla | 20 libros que sintetizan todo el conocimiento cristiano y clásico; copiados en miles de manuscritos medievales; primera gran enciclopedia cristiana de Occidente |
| Encyclopédie — Diderot y d'Alembert | 1751-1772 | ilustracion | Denis Diderot, Jean le Rond d'Alembert | 28 volúmenes, 71.818 artículos, 140 colaboradores; árbol del conocimiento en Memoria, Razón e Imaginación; acto político e intelectual de la Ilustración |
| Oxford English Dictionary | 1884-1928 | diccionario | James Murray y miles de voluntarios | 414.825 palabras con ~2 millones de citas textuales; primera documentación de cada palabra en inglés; 71 años de trabajo colectivo |
| Britannica 11ª Edición | 1911 | enciclopedia | Hugh Chisholm (editor jefe) | 29 volúmenes, ~44 millones de palabras; artículos de Einstein y Bertrand Russell; cumbre de la enciclopedia impresa generalista |
| Wikipedia | 2001-presente | digital | Jimmy Wales, Larry Sanger | 60 millones de artículos en 332 idiomas; modelo colaborativo NPOV; gratuita, universal y actualizable en tiempo real |
| ChatGPT y LLMs | 2022-presente | digital | OpenAI, Anthropic, Google | IA generativa que sintetiza conocimiento de miles de fuentes sin citar ni garantizar veracidad; acceso conversacional al saber acumulado |
En 1857, la Philological Society de Londres decidió hacer el diccionario más completo del inglés. Su método: miles de lectores voluntarios leyeron libros durante décadas marcando cada palabra en contexto y enviando fichas por correo. James Murray recibió millones de fichas en su scriptorium (un cobertizo en Oxford). El proyecto tardó 71 años. El resultado: 414.825 palabras con 1.827.306 citas textuales, desde el inglés del año 1000 hasta 1928. Hoy el OED tiene ~600.000 palabras y se actualiza online cada trimestre.
En 1752, el Consejo Real de Francia prohibió los dos primeros volúmenes de la Encyclopédie por "subvertir la autoridad real". En 1759, el Papa Clemente XIII la añadió al Index. ¿Cómo siguió publicándose? El rey Luis XV necesitaba los impuestos; el censor real Malesherbes era un admirador secreto; Diderot ocultó los manuscritos en casa del propio Malesherbes. Los 4.000 suscriptores ya habían pagado por adelantado, creando un incentivo económico irresistible. La Encyclopédie demostró que el conocimiento distribuido es muy difícil de suprimir.
Wikipedia tiene tres pilares: Neutralidad (NPOV), Verificabilidad (citar fuentes publicables) y No investigación original. Los artículos controvertidos tienen "páginas de discusión". Los de alta visibilidad están "protegidos": solo editores verificados pueden modificarlos. Hay ~280.000 editores activos mensuales y ~1.000 administradores. Un estudio de Nature (2005) encontró precisión comparable a Britannica en 42 artículos científicos analizados.
Una enciclopedia ofrece: atribución (sabes quién escribió qué), verificabilidad (cada afirmación cita una fuente) y responsabilidad editorial. Una IA generativa ofrece: síntesis fluida y acceso conversacional. Lo que la IA NO ofrece: citas verificables, garantía de veracidad ni responsabilidad cuando se equivoca. El riesgo de las "alucinaciones" (información falsa presentada con confianza) es el mayor desafío del conocimiento en la era de la IA generativa.
El Diccionario de la Lengua Española (DLE) de la Real Academia Española tiene 93.111 entradas en su 24ª edición (2014, actualización 2022). Pero eso no significa que el español tenga solo 93.111 palabras: el DLE recoge el vocabulario "común y estándar", excluyendo miles de tecnicismos, regionalismos, neologismos aún no aceptados y palabras coloquiales o vulgares. El vocabulario activo total del español supera el millón de palabras si se incluyen todos los registros. La pregunta correcta no es "cuántas palabras tiene el español" sino "qué criterios usa la RAE para incluir una palabra".
Wikipedia tiene una fiabilidad variable según el artículo. Los artículos científicos bien establecidos (física, química, matemáticas) suelen ser muy precisos. Los artículos sobre personas vivas, política o eventos recientes pueden tener sesgos o errores. El control de calidad se basa en: políticas de verificabilidad (toda afirmación debe citar una fuente publicada), el sistema de revisión por pares de los editores voluntarios, y los bots que detectan vandalismo automáticamente. Un estudio de Nature (2005) encontró una precisión comparable a Britannica en artículos científicos. La regla práctica: Wikipedia es excelente para una primera orientación; para trabajo académico, verifica siempre las fuentes que cita.
La Real Academia Española (46 académicos de número) y las 22 academias asociadas de América y Filipinas (Asociación de Academias de la Lengua Española, ASALE). El proceso: la palabra debe aparecer con frecuencia en textos escritos de distintos géneros y regiones hispanohablantes durante un período sostenido. El departamento de lexicografía de la RAE monitoriza los corpus lingüísticos (CORDE, CORPES XXI). Un académico propone la incorporación con documentación textual. La comisión de lexicografía debate la definición, etimología y marcas gramaticales. Finalmente se vota en pleno. Palabras recientes incorporadas: "postureo", "selfi", "tuit", "tuitear", "emoji".
Un corpus lingüístico es una colección masiva de textos reales (libros, periódicos, conversaciones, páginas web) usada para estudiar cómo se usa realmente una lengua. El Corpus de Referencia del Español Actual (CREA, RAE) contiene 160 millones de palabras de textos de 1975-2004. El CORPES XXI añade textos desde 2001. El Corpus del Español de Mark Davies tiene más de 2.000 millones de palabras. Los corpus permiten: saber cuándo se empezó a usar una palabra, en qué contextos aparece, con qué frecuencia, y si su uso está cambiando. Son la base de los diccionarios modernos, la traducción automática (Google Translate, DeepL) y los modelos de lenguaje de IA.
Es el debate más vivo de la lexicografía y el conocimiento digital actual. Los optimistas ven la IA como una herramienta para ayudar a los editores de Wikipedia (generando borradores, detectando errores, traduciendo artículos). Los pesimistas temen que los LLMs sustituyan la consulta enciclopédica sin ofrecer sus garantías de verificabilidad. La Fundación Wikimedia ya experimenta con IA para apoyar editores. Lo más probable: coexistencia. La enciclopedia verificada, citable y con atribución seguirá siendo necesaria para el trabajo académico, el periodismo y la investigación. La IA ofrecerá síntesis rápidas para consultas cotidianas. El riesgo real es que la gente deje de distinguir entre "saber verificado" y "texto generado plausible".
Una palabra nueva (neologismo, extranjerismo, tecnicismo popularizado) aparece en textos escritos de distintos géneros: prensa, literatura, redes sociales, divulgación científica. La RAE monitoriza los corpus lingüísticos (CORDE, CORPES XXI) para detectar palabras con frecuencia creciente en distintas variedades del español.
El departamento de lexicografía de la RAE analiza cuántas veces aparece la palabra, en qué contextos, en qué géneros textuales y en cuántos países hispanohablantes. Para ser candidata, una palabra debe mostrar estabilidad de uso durante varios años y extensión geográfica.
Un miembro de la RAE o de una academia asociada propone formalmente la palabra, aportando ejemplos textuales documentados, etimología propuesta, categoría gramatical y definición preliminar. La propuesta incluye también un análisis de si la palabra ya tiene equivalente en español estándar.
La comisión debate la definición exacta, la etimología, las marcas gramaticales (sustantivo, verbo, adjetivo; género; plural) y las marcas de uso (coloquial, vulgar, técnico, regional). También se discute la ortografía: para extranjerismos, si se adapta a la fonología española (tuit, selfi) o se acepta la grafía original.
La propuesta se somete a votación en el pleno de la RAE (46 académicos de número) y requiere mayoría. Si se aprueba, la nueva entrada se publica en la siguiente actualización anual del DLE online (dle.rae.es). La versión digital permite incorporar novedades de forma continua; cada año se añaden y modifican decenas de entradas.
Recursos gratuitos de referencia lingüística en español: DLE (dle.rae.es, 93.111 entradas), CORDE y CORPES XXI (millones de textos reales), Diccionario panhispánico de dudas (dpd.rae.es) y Fundéu (fundeu.es) para neologismos y uso correcto. Todos gratuitos y accesibles online.
Wikipedia no es una fuente primaria para trabajos académicos: úsala para orientarte y localizar fuentes. Luego cita esas fuentes primarias. Si necesitas la versión exacta consultada, usa el "enlace permanente" del menú lateral del artículo, que congela la versión en esa fecha.
Un diccionario prescriptivo (como el DLE de la RAE) establece cómo "debe" usarse el idioma. Uno descriptivo (como el OED) registra cómo se usa realmente, sin juzgar. Urban Dictionary es puramente descriptivo. La mayoría de los diccionarios modernos combinan ambas perspectivas con marcas de registro.
El OED Online (oed.com, accesible gratis en muchas bibliotecas públicas) documenta la primera aparición textual conocida de cada palabra en inglés: "selfie" fue documentada por primera vez en un foro australiano en 2002. Incluye etimología completa y evolución semántica a lo largo de los siglos.