Método y limitaciones
Esta página cuenta cómo se construye el corpus, con qué criterios entra un documento, cómo se recupera y qué defectos conocidos arrastra. Lo último importa tanto como lo primero: una herramienta documental que no declara sus límites obliga a fiarse de ella, y de lo que se trata es de lo contrario.
Cifras leídas del propio grafo al cargar la página. El resto de datos corresponde al 3 de agosto de 2026.
De dónde sale y qué entra
El corpus se alimenta por tres vías automáticas y una manual, todas ellas a diario. Ninguna busca «lo que hay sobre drogas»: cada una recorre cuarenta y cuatro ejes definidos por disciplina, para que el conjunto no acabe siendo farmacología con adornos.
| Vía | Documentos | Qué aporta y por qué |
|---|---|---|
| Crossref | 14.472 | Toda la producción con DOI: humanidades, derecho, botánica |
| PubMed / Europe PMC | 11.128 | Literatura biomédica revisada por pares |
| OpenAlex | 2.542 | Ciencias sociales y disciplinas sin cobertura biomédica |
| Biblioteca y archivo propios | 3.276 | Material gris: informes, actas, tesis, documentos sin DOI |
| Cannabis Magazine | 700 | Hemeroteca propia desde 1997 |
Criterios de inclusión. De las fuentes automáticas solo entra lo que tiene resumen depositado —sin texto no hay nada que indexar— y lo que supera un filtro de pertinencia por términos del ámbito, aplicado sobre el título y el resumen. Se descarta lo ya presente comparando DOI, dirección y título normalizado. No hay criterio de impacto ni de prestigio de la revista: un informe de una entidad de reducción de riesgos pesa lo mismo que un artículo de Nature, y quien consulta ve de cuál viene cada afirmación.
Cómo se indexa
Segmentación
Cada documento se parte en fragmentos solapados de un tamaño manejable. El solapamiento evita que una afirmación quede cortada justo por la mitad y se pierda para la búsqueda.
Doble índice
Cada fragmento se indexa por significado, con un modelo de embeddings multilingüe que corre en el propio servidor, y por texto literal. Lo primero encuentra lo que se dice de otra manera; lo segundo, las siglas y los nombres propios que un embedding diluye.
Extracción del grafo
De los fragmentos se extraen conceptos —sustancias, receptores, regiones cerebrales, efectos, condiciones clínicas— y las relaciones entre ellos, con la evidencia textual que las sostiene. Eso es lo que permite que una pregunta sobre un receptor traiga también lo escrito sobre la planta que lo activa.
Cómo se recupera, y por qué eso acota la invención
Al preguntar no se hace una búsqueda, sino varias. La consulta se reformula y se traduce a los idiomas del corpus; se recupera en paralelo por significado y por coincidencia literal; los dos rankings se fusionan; y un modelo de reordenación local vuelve a juzgar los candidatos por contenido, no por idioma, porque un embedding puntúa más alto lo escrito en la lengua de la pregunta y eso sesgaba las respuestas hacia el corpus español.
Solo entonces se redacta la respuesta, y únicamente con los fragmentos recuperados. El modelo no aporta conocimiento propio: si el corpus no contiene la respuesta, la instrucción es decirlo. Eso no elimina el riesgo de que una afirmación se deslice, pero lo acota a lo que hay en los documentos citados, que están enlazados debajo de cada respuesta para poder comprobarlos. Es más lento que un buscador, y esa es la razón.
Qué cobertura hay
Limitaciones conocidas
Lo que sigue no son advertencias de cortesía: son defectos medidos, con su magnitud. Quien use esta herramienta para investigar debería conocerlos antes de citar nada.
Cómo citarlo
Cita el corpus, no la respuesta, y cita además las fuentes concretas que la respuesta te haya mostrado, que son las que sostienen cada afirmación.
Psiconáutica (2026). Corpus documental multidisciplinar sobre sustancias psicoactivas (Noosphere). https://brain.psiconautica.org/corpus.html
Si detectas un error, dilo
Un metadato mal, una atribución imposible, un documento que no debería estar: escríbenos a noosphere@psiconautica.org. Interesa igual la aportación de literatura que no esté indexada en ningún sitio y se pierda: material gris, actas, trabajos que no se publicaron en inglés.