O mês de julho de 2026 foi movimentado para quem trabalha com engenharia de dados: anúncios importantes no ecossistema da dbt, um release grande do Apache Spark e a consolidação de tendências como pipelines agent-driven. Reuni aqui os principais movimentos para você acompanhar.
O que está acontecendo
- Fivetran + dbt Labs anunciaram o futuro do dbt Core v2.0 (21/07) — a integração pós-aquisição avança, com a dbt Labs definindo o roadmap do Core open source sob o guarda-chuva da Fivetran.
- dbt descontinua o Snowflake Native App (24/07) — mudança de estratégia de distribuição da dbt no ecossistema Snowflake.
- Apache Spark 4.2 chegou com foco em “AI-developer friendly” (17–21/07). O The New Stack destaca uma feature que pode “aposentar seu vector database”: integração de busca vetorial direto no motor.
- Snowflake CoCo simplifica a migração de Spark para Snowflake (GA em 30–31/07).
- Apache SeaTunnel documenta a evolução ETL → ELT → EtLT → agent-driven data engineering (10–21/07), com agentes orquestrando pipelines.
Ferramentas e comunidade
- Ciaren: Show HN de pipelines visuais que exportam Polars/Python de verdade (28/07).
- r/dataengineering (31/07): como carregar volumes grandes no Iceberg com eficiência; debate One Big Table vs. Kimball em arquitetura medallion.
- OSI virou Apache Ossie (Incubating) — o órgão do open source entrou na incubadora da Apache (13/07).
Leitura rápida
- Spark 4.2 vale a pena para quem unifica analytics + IA (embeddings/busca vetorial no motor).
- dbt Core 2.0: acompanhe o roadmap — mudanças grandes vêm da Fivetran.
- EtLT e agent-driven: a tendência de agentes dentro da engenharia de dados veio para ficar.