Las estadísticas oficiales de superficie cafetera vienen como totales administrativos —de un país, de un estado, de un municipio—, nunca como una superficie continua. Para la contabilidad agrícola eso basta, pero para un análisis a nivel de píxel se queda corto: si uno quiere, por ejemplo, cruzar el café con el SPEI a distintas escalas, necesita saber dónde está el cultivo dentro de cada territorio, y un total nacional no lo dice.
Este documento describe cómo desagregamos (downscaling) el área cosechada de café de Brasil hasta resolución de píxel (0.05°, ~5 km). La idea es repartir el total nacional de FAOSTAT en cascada: primero según la estructura subnacional que reporta el IBGE, y luego según la probabilidad de idoneidad climática del modelo Random Forest de aCLIMAtar, tratando por separado Coffea arabica y Coffea canephora (robusta/conilon).
La pregunta que guía esta iteración es concreta: ¿cuánto cambia el resultado según el nivel de detalle del dato que usamos como base? Para averiguarlo corremos el mismo flujo dos veces —primero apoyados en el nivel estatal (ADM1) y después en el municipal (ADM2)— y comparamos los rasters. Como los dos escenarios conservan el mismo total nacional, cualquier diferencia entre ellos se debe únicamente a la mayor resolución del dato subnacional, no a un cambio en las cifras.
FAOSTAT aporta la magnitud total (restricción dura, comparable entre países);
IBGE (Produção Agrícola Municipal) aporta el patrón de distribución y la separación por especie, disponible tanto a nivel estatal como municipal
Modelo de idoneidad aporta el criterio de asignación intra-unidad a través de una probabilidad continua.
El problema es cómo repartir un solo total nacional entre dos especies y muchas unidades administrativas sin contradecir a ninguna de las fuentes. La dificultad nace de una asimetría: FAOSTAT da el total del país pero no lo separa por especie, mientras que el IBGE sí distingue especie y unidad. Cada fuente aporta, entonces, lo que mejor mide: FAOSTAT fija cuánto café hay; el IBGE, de qué especie es y cómo se reparte en el territorio.
El primer escalón transfiere la composición por especie observada por el IBGE al total de FAOSTAT:
\[p_{ara} = \frac{\sum_u A^{ara}_u}{\sum_u A^{ara}_u + \sum_u A^{rob}_u}, \qquad F_{ara} = F \cdot p_{ara}, \qquad F_{rob} = F \cdot (1 - p_{ara})\]
donde \(A^{ara}_u\) y \(A^{rob}_u\) son las áreas por especie de la unidad \(u\) y \(F\) es el total nacional de FAOSTAT. El segundo escalón distribuye el objetivo de cada especie entre las unidades, en proporción a la participación de cada una dentro de esa especie:
\[\text{targ}^{ara}_u = \frac{A^{ara}_u}{\sum_v A^{ara}_v} \cdot F_{ara}\]
La normalización mediante la suma de participaciones garantiza que \(\sum_u \text{targ}^{ara}_u = F_{ara}\) y, por tanto, que \(\sum_u (\text{targ}^{ara}_u + \text{targ}^{rob}_u) = F\): la conservación del total queda asegurada desde antes de descender al píxel. Un punto de implementación relevante es que las proporciones y objetivos se calculan como escalares fuera de cualquier operación agregada sobre el objeto espacial.
El descenso de la unidad administrativa al píxel ocurre en la función
down.spp, una asignación proporcional con capacidad
limitada que se ejecuta por separado para cada especie.
Para cada unidad \(u\) con objetivo \(T_u\), el área se reparte entre sus píxeles \(i\) en proporción a un peso \(w_i\) igual a la probabilidad de idoneidad. lo que asegura que un píxel de mayor idoneidad recibe más área, pero esta no supera el tope de capacidad de la celda, esta decrece con la latitud.
Un dato importante, el territorio no idóneo dentro de una unidad productiva recibe peso nulo (concentra la asignación en la tierra que el modelo respalda), y la unidad con producción reportada pero sin idoneidad modelada recibe peso uniforme, salvaguarda que impide perder la producción de unidades donde modelo y dato no coinciden.
Todo el proceso de la línea base —lectura del dato subnacional,
partición de FAOSTAT, construcción de objetivos y desagregación por
especie— se encapsula en una función make.rstr, cuyo único
argumento admn indica el nivel administrativo (1 = estado,
2 = municipio).
## [ADM 1 ] arabica target: 1500891 | raster: 1500891
## [ADM 1 ] robusta target: 388617 | raster: 388617
## [ADM 1 ] total FAOSTAT: 1889509 | raster: 1889508
## [ADM 2 ] arabica target: 1500930 | raster: 1499472
## [ADM 2 ] robusta target: 388630 | raster: 388630
## [ADM 2 ] total FAOSTAT: 1889509 | raster: 1888102
El reporte de conservación es el criterio de validez: la suma de los píxeles de cada especie (sea arábica o robusta) debe sumar la proporción de FaoSTAT.
Se examina el producto de referencia —el escenario municipal (ADM2), el más detallado— contrastando, por especie, el campo de idoneidad que actúa como criterio de asignación frente a la superficie de hectáreas efectivamente asignada. Para ello se define una función de trazado reutilizable que homogeneiza la simbología.
A continuación, los mapas para Arábica tanto a ADM1 como ADM2.
Arábica (ADM2) — Área cosechada asignada (izq.) frente a probabilidad de idoneidad (der.).
Arábica (ADM1) — Área cosechada asignada (izq.) frente a probabilidad de idoneidad (der.).
Robusta (ADM2) — Área cosechada asignada (izq.) frente a probabilidad de idoneidad (der.).
Robusta (ADM1) — Área cosechada asignada (izq.) frente a probabilidad de idoneidad (der.).
Los dos insumos se complementan. El campo de idoneidad es una superficie suave y amplia: marca el potencial climático, haya o no cultivo. La superficie de hectáras es mucho más concentrada; solo toma valor donde coinciden la aptitud del modelo y el dato subnacional. El cultivo de arábica se concentra en tierras altas del sudeste (Minas Gerais, Sao Paulo); la robusta en tierras bajas prpias de Espírito Santo y Rondonia Una sola capa de idoneida habría eliminado la separación de las zonas con área cosechada por cultivo.
Se contrastan ahora los dos escenarios. Como ambos conservan el mismo total nacional, la diferencia celda a celda (ADM2 - ADM1) suma cero; no mide un cambio de magnitud, sino una redistribución espacial. Antes de restar, se reemplazan los NA por cero, de modo que una celda con café en un esceanrio y vacía en el otro también cuente en la diferencia.
Arábica — Área asignada bajo ADM1 (izq.), bajo ADM2 (centro) y su diferencia ADM2−ADM1 (der.). El azul indica concentración adicional bajo el dato municipal; el rojo, sobre-asignación del dato estatal.
Robusta — Área asignada bajo ADM1 (izq.), bajo ADM2 (centro) y su diferencia ADM2−ADM1 (der.).