CIATBlog

Y sin embargo

Un post tan innecesario como importante

blog-Y sin embargoNo recuerdo con precisión el día en que por primera vez escuché aquella vieja afirmación, que ya suena a cliché, que si a un sistema de información entra basura, de él solo saldrá basura. Es tan solo obvio. Alcanzar niveles adecuados en la calidad de datos es indispensable. Uno debería pensar que insistir en eso está demás. Y sin embargo…

Las administraciones tributarias obtienen datos de diversas y cada vez más fuentes de información. En muchos casos los contribuyentes preparan y envían, en diversos formatos , detalles de las retenciones efectuadas, de los pagos realizados, sus libros y documentos electrónicos, los intereses pagados y recibidos, reportes sobre las  nóminas de los empleados, las remesas al exterior, operaciones con partes vinculadas, los pagos de dividendos, las primas de seguros, y muchos otros etcéteras. Es precisamente ese enorme conjunto de información el que permite desarrollar programas de control de carácter masivo y, a un número ya importante de administraciones, pre-llenar declaraciones.

Vale la pena recordar los esfuerzos que a lo largo de los años desarrollaron las administraciones tributarias para ir de un escenario lleno de declaraciones en papel al actual,  en el que predominan las electrónicas. Los errores por fallas de cálculo, uso de tipos errados, ilegibilidad de letra, traslape de casillas, datos de identificación imperfectos fueron disminuyendo al pasar de métodos manuales a mecanismos asistidos por software para generar discos o archivos para incorporar. La posibilidad de presentar la declaración en línea permitió, por ejemplo, realizar validaciones sobre el uso de créditos de otros períodos o alertar inmediatamente sobre inconsistencias con otra información ya en poder de la administración. La calidad de la información de las declaraciones mejoró significativamente a lo largo de los años.

Pero, a veces, como dice el refrán, pronto olvida el cura que fue sacristán, y ocurre que de tanto recibir información de los contribuyentes con pocos o muy pocos errores, podemos asumir que toda nueva información enviada en medios electrónicos tendrá los mismos niveles deseables de calidad. La verdad es que cada nueva información tiende a ser más compleja, sea porque será reportada por más informantes, sea porque serán volúmenes más grandes, sea porque los envíos deben ocurrir en momentos muy cercanos a las transacciones (o incluso antes de que las transacciones se ejecuten) dejando el proceso sin tiempos ni espacios para revisar, validar y corregir. Asumimos que cientos, miles o cientos de miles de contribuyentes son capaces de, a partir de una guía técnica y un par de manuales, entender a la perfección un esquema XSD, desarrollar software que sin bugs, extraigan de sus sistemas la información necesaria, la transformen, la traten, preparen un XML, lo firmen electrónicamente, lo transmitan a la administración. Y hacer todo eso sin errores, incluso desde la primera vez.

Luego, un tiempo después, tiempo que a veces no es despreciable, al momento de intentar usar esa información para fines de control, encontramos que la misma tiene tantos errores que el esfuerzo de depurarla requeriría un costo desproporcionado y que corregir los hábitos ya desarrollados de los cientos, miles o cientos de miles de informantes, que no tuvieron realimentación, regaños o multas sobre sus envíos durante el tiempo transcurrido, se tornaría un proyecto en sí mismo.

Obtener información de terceros es algo que, en mi opinión, va a aumentar. Ella vendrá de otros organismos del Estado; de los contribuyentes que empiezan a usar documentos (facturas electrónicas por ejemplo), libros y reportes electrónicos cuyos detalles se envían a la Administración; de otras administraciones tributarias a partir de la implementación de convenios de intercambio de información automática; de multinacionales que reportan sus operaciones país por país, y de otros actores tal vez menos preparados para, por ejemplo, preparar un archivo XML como colegios profesionales, iglesias o fundaciones sin fines de lucro.

La tentación de establecer un conjunto mínimo de validaciones para proceder a únicamente aceptar, identificar y almacenar los archivos y sus datos es grande. La información de control, los cruces, la inteligencia de negocio vendrán después, tal vez mucho después. Evitar a toda costa el “después vemos”.

En mi opinión, para cada nuevo conjunto de informaciones, es necesario involucrar desde los momentos de la incepción a las áreas de la administración que lo utilizarán para fines de control, se debe incorporar que todos los elementos necesarios para su uso se incluyan y para incorporar todas las validaciones posibles de incluir. Lo más importante: las primeras tareas de control se deben destinar primero  a que los informantes informen lo correcto, en el momento adecuado con los medios correctos y luego, solo cuando la información tenga niveles de confiabilidad suficiente, al control tributario.

En ese proceso de mejora de la calidad creo que se puede implementar un esquema de tipo Bayesiano. Una vez que los datos pasan todas las validaciones es posible estimar una probabilidad de que los datos sean correctos y se actuaría o dejaría de actuar en busca de mejorar esa calidad cuando la probabilidad de datos incorrectos sea relativamente alta. Adicionalmente, cuando se obtenga nueva información, la probabilidad se afectará y consecuentemente la decisión sobre la actuación. Por ejemplo, en factura electrónica, aun si el formato, los elementos de identificación de vendedor y comprador, los detalles de los bienes, los cálculos de los tributos y las sumatorias son aparentemente correctos, una factura con un valor inusualmente alto para ese contribuyente (por ejemplo con más de tres desviaciones estándar por encima de la media de sus operaciones anteriores) tendría una probabilidad alta de contener un error de información y consecuentemente la administración después de un tiempo prudente, podría enviar un mensaje para informar al contribuyente sobre el posible error. En otro caso, una factura que cumple las validaciones y reglas y está dentro de los límites se podría considerar con baja probabilidad de errores, sin embargo, si posteriormente la administración identifica que el comprador había fallecido unos meses antes, la probabilidad de problemas se calcularía nuevamente y esta vez identificaría una situación muy distinta.

Es lógico. Podríamos pensar que no podría ser de otra manera. Pero estas cosas pasan. Es algo así como los primeros versos de “Y sin embargo”, esa magnífica canción de Joaquín Sabina que dice “Me lo dijeron mil veces, pero nunca quise prestar atención, cuando vinieron los llantos, ya estabas muy dentro de mi corazón….”.

Saludos y suerte