O Avro é um sistema de serialização de dados desenvolvido dentro do projeto Apache Hadoop. Ele oferece uma estrutura de dados rica, um formato de dados binário compacto e rápido, um arquivo de contêiner para armazenar dados persistentes, chamadas de procedimento remoto (RPC) e integração simples com linguagens dinâmicas. O Avro utiliza JSON para definir tipos de dados e protocolos, serializando as informações em um formato binário compacto. Seu uso principal ocorre no Hadoop, onde é empregado para serviços de serialização e troca de dados. O Avro é particularmente adequado para aplicações que exigem evolução de esquema, pois armazena o esquema juntamente com os dados. Isso permite que os leitores processem as informações mesmo que o esquema tenha sido alterado desde a gravação original. As capacidades de evolução de esquema do Avro, combinadas com seu formato binário eficiente, tornam-no uma escolha popular para armazenamento e intercâmbio de dados em ambientes de big data. Ele suporta tipos de dados complexos e foi projetado para oferecer alto desempenho tanto na leitura quanto na escrita. Arquivos Avro são frequentemente utilizados para armazenar grandes conjuntos de dados de maneira distribuída.