Conectarse al pipeline de datos OSM
Requisitos previos
- Acceso al directorio de trabajo
app-orchestration-gis(los scripts del pipeline) - Python 3.11+ con las dependencias del pipeline instaladas
- Acceso de red a la API de Overpass
- Un Q-ID de Wikidata para la cadena que está ingiriendo (búsquelo en wikidata.org)
Propósito
Añada una nueva cadena minorista o de servicios al pipeline de inteligencia de ubicación — desde datos crudos de OpenStreetMap hasta un tile de clúster servible. Un procedimiento genuinamente ya ejecutado antes, no hipotético.
Procedimiento
-
Busque el Q-ID de Wikidata de la cadena. Este es el identificador estable y neutral en idioma al que se ancla la taxonomía (Walmart: Q483551, IKEA: Q54078). Si la cadena no tiene una entrada limpia en Wikidata, más adelante recurrirá a una consulta basada en nombre.
-
Ejecute el script de ingestión directamente contra el identificador de la cadena — no hay ningún archivo YAML descriptor separado que redactar para una ejecución sencilla:
Esto consulta la API de Overpass y escribe registros JSONL en el directorio de datos de la plataforma. Si la cadena devuelve cero registros, la cobertura de etiquetas de Wikidata puede ser escasa en OpenStreetMap para esa cadena — revise si conviene una consulta de respaldo basada en nombre antes de asumir que la cadena no tiene datos.
-
Registre la categoría de la cadena en
taxonomy.py, en el diccionarioCATEGORIES:: , -
Añada la cadena a
BRAND_FILL, bajo su categoría, indexado por código de país:: , -
Reconstruya la capa de clústeres y sus tiles servibles:
Resultado esperado
Las ubicaciones de la nueva cadena están presentes en el GeoJSON de clúster reconstruido y reflejadas en el archivo PMTiles regenerado que realmente sirve el mapa.
Verificación
Verifique que el recuento de registros de la nueva cadena llegó como se esperaba:
Luego confirme que aparece en la salida de clúster reconstruida antes de dar por completa la ingestión. Una cadena registrada en la taxonomía pero nunca realmente ingerida, o una ingestión que se ejecutó pero nunca se incluyó en una reconstrucción, ambas dejan el mapa mostrando datos obsoletos sin ningún error que lo advierta.
Reversión
Elimine las entradas de la cadena de CATEGORIES/BRAND_FILL y borre su archivo JSONL, luego vuelva a ejecutar los pasos de reconstrucción para regenerar la salida de clústeres sin ella. No hay un "deshacer" en el lugar para una reconstrucción ya servida — el estado anterior solo es recuperable reconstruyendo de nuevo desde una taxonomía que la excluya.
Próximos pasos
- Construir un mapa de co-ubicación — renderice los tiles de clúster reconstruidos en una aplicación MapLibre
Véase también
- Sustrato de inteligencia de localización — la arquitectura de archivo plano/PMTiles que alimenta este pipeline
Cite this record: /wiki/connect-osm-data-pipeline — revision 9b9339a2, last updated 6 August 2026.