We deploy your 100% open source lakehouse in 3 weeks — with equal or better performance than proprietary platforms.
Formatos proprietários e custos de saída que te prendem de propósito.
Tecnologia que existe grátis em open source, com a mesma performance.
Vendors tradicionais levam meses. O nosso: 3 semanas em produção.
DBU, compute credits e markups escondidos — surpresa na fatura.
5 camadas. 100% open source. Cada componente escolhido por performance, maturidade e custo zero de licenciamento.
Plataforma de IA integrada ao seu datalake. Text-to-SQL, proxy de LLMs com governança, visibilidade de custo por time e deploy on-premise ou cloud.
Além do lakehouse, integramos uma camada de IA diretamente nos seus dados. Inclui um proxy de LLM que centraliza o acesso a modelos, dá visibilidade de custo por time e governança total sobre os tokens consumidos.
Alocação de profissionais seniores prontos para integrar seu time. Experiência real em plataformas de dados em larga escala.
Agentes de IA, RAG, fine-tuning, integração de LLMs e deploy de modelos em produção.
Modelagem dimensional, dbt, data quality e governança de métricas.
Dashboards, storytelling com dados, self-service analytics e KPIs.
Design de lakehouse, governança, catálogo e estratégia multi-cloud.
Infraestrutura como código, CI/CD para dados, Kubernetes e observabilidade.
Pipelines, ingestão, transformação e orquestração de dados em escala.
Estratégia de dados como produto, roadmap e alinhamento com negócio.
Artigos, cases e palestras que mostram como transformamos dados em resultado real.
→
→
→
→
→
+13 anos em engenharia e arquitetura de dados, IA e liderança de times. Liderou plataformas de dados em larga escala no Banco Inter (1.400+ produtos de dados), implantou a plataforma de GenAI corporativa e obteve savings de +R$1.2MM com FinOps. Reconhecido como Lakehouse of the Year 2023 (Starburst & AWS).
Especialista em gestão de dados e plataformas de IA, com experiência em produto e arquitetura de soluções para empresas de tecnologia Brasileiras e Americanas. Atua no desenho e implementação de lakehouses open source, integração de dados e plataformas de IA sobre AWS, sempre com foco em reduzir custos, eliminar vendor lock-in e acelerar a entrega de valor.
Especialista em infraestrutura de dados sobre Kubernetes (GKE, EKS), com domínio em FluxCD, Helm, Trino, Apache Pinot, Kafka (MSK e K8s), Kafka Connect, Debezium, Schema Registry, Spark (Databricks, EMR e Spark Operator), Superset, Airflow e DataHub. Desenvolveu agentes Text-to-SQL em produção — integrando DataHub para metadados com execução de queries em Trino e Pinot (tempo real), incluindo controle de acesso granular por usuário.
Nosso time analisa seu cenário e potencial de economia em até 24h.
Solicitar análise gratuita