Pular para o conteúdo

Cabeçalhos CSV em ordens diferentes e campos repetidos

Confira os nomes antes da importação e bloqueie cabeçalhos repetidos, preservando o significado de débitos e créditos.

Dois arquivos podem ter as mesmas colunas em posições diferentes. Ler sempre a segunda coluna como débito transforma uma mudança de apresentação em alteração do resultado. O cabeçalho precisa ser validado antes de associar nomes e valores.

Este laboratório fictício contém dois arquivos válidos e um arquivo recusado. Todos usam ponto e vírgula, valores inteiros em reais e o mesmo período. As origens são distintas e os quatro lançamentos válidos já estão identificados. O exemplo não interpreta separadores decimais nem avalia a autenticidade dos documentos.

A ordem muda, o significado permanece

Na origem A, a sequência é identificador, débito e crédito. Seus dois registros contêm débito de R$ 100 e crédito de R$ 40. Na origem B, a sequência é identificador, crédito e débito. Ela contém débito de R$ 60 e crédito de R$ 10.

Origem Débitos em reais Créditos em reais Débito menos crédito
A 100 40 60
B 60 10 50
Conjunto válido 160 50 110

O leitor que usa posições fixas calcula R$ 10 de débitos e R$ 60 de créditos para B. Seu resultado nessa origem passa a menos R$ 50. A soma das duas origens fica em R$ 10, embora o resultado correto seja R$ 110. Nenhuma linha precisou desaparecer para surgir uma diferença de R$ 100.

Validar antes de formar o dicionário

O terceiro arquivo repete o nome débito em duas colunas e não fornece crédito. Ele não entra nos totais. Converter o cabeçalho diretamente em chaves de dicionário pode ocultar a repetição, pois uma chave não conserva dois significados independentes.

O verificador primeiro lê o cabeçalho como lista, exige nomes únicos, confere o conjunto exato de campos e verifica a largura de cada registro. Só depois associa cada valor ao nome correspondente. Também testa uma linha com campo excedente e exige sua rejeição. A posição física das colunas válidas não interfere no cálculo.

O pacote contém as duas origens, o arquivo de cabeçalho repetido e os resultados esperados. O script reproduz a leitura correta e o contraste por posição, preservando os arquivos originais. A documentação oficial do módulo csv explica a leitura de registros e a associação por nomes. O estudo acrescenta esse teste executável à conferência de dados da assistência técnica contábil. A rejeição do terceiro arquivo permanece explícita: R$ 110 é o total das duas origens válidas, não de todo material recebido.

Falar pelo WhatsApp