Escrevendo sobre dados & IA
Artigos técnicos sobre engenharia de dados, Databricks e IA.
Escolhendo o layout de uma tabela Delta Lake: quando particionar, usar Liquid Clustering e rodar OPTIMIZE
Uma tabela de pedidos é particionada por data. Parece razoável — até que uma query importante busca um cliente em todo o histórico de pedidos…
Databricks Genie: um guia prático das tabelas às respostas testadas
Uma query pode executar com sucesso e ainda assim responder à pergunta errada. Um guia prático para montar um Genie Agent focado, com regras de negócio, SQL de referência e benchmarks…
Diagnosticando o Fabric Data Warehouse com o SQL DW Operations Skill: investigando workloads sem sair do Copilot
Quando um warehouse começa a dar sinais de lentidão, a investigação raramente começa com respostas claras. Ela começa com perguntas…
Além das respostas: como as novas funcionalidades do Genie One transformam insights em ação
Existe um padrão que qualquer pessoa que trabalha com dados reconhece: você faz uma pergunta, recebe uma resposta em segundos, e então… para…
Community Connectors no Databricks
Se você já trabalhou com ingestão de dados em escala, sabe que uma parte considerável do esforço não está na transformação ou na modelagem, mas em…
Autenticação segura em notebooks do Microsoft Fabric com Workspace Identity e Connection Objects
Se você trabalha com notebooks no Microsoft Fabric, provavelmente já passou pela situação clássica: durante o desenvolvimento, tudo funciona…
Colunas VOID no Delta Lake
Por que uma coluna sem tipo aparece no seu schema Delta, o que isso quebra e como resolver de forma idempotente.
A próxima geração do Databricks Genie
O Databricks Genie não é mais só um chatbot de dados. Com as atualizações recentes anunciadas pela Databricks, o produto está se posicionando como algo…
AI/BI Dashboards e DABs: a lição que aprendi quase da pior forma
Tem um comportamento no Databricks que parece bug mas é feature, e que quase ninguém descobre até perder um dashboard em produção.
DABs Python Mutators: como garantir configuração consistente em 50 jobs sem copy-paste
À medida que um projeto Databricks cresce, o número de jobs no bundle cresce junto. Dez jobs viram vinte, vinte viram cinquenta. E junto com o…
Databricks Apps: construindo aplicações de dados sem sair do Lakehouse
Por muito tempo, o ciclo de vida de um projeto de dados tinha uma divisão bem clara: você construía seus pipelines, transformações e modelos dentro de…
Liquid Clustering no Databricks: a evolução do OPTIMIZE + ZORDER no Delta Lake
Se você trabalha com Delta Lake no Databricks há algum tempo, certamente já se deparou com o combo `OPTIMIZE` + `ZORDER BY` para organizar fisicamente…
Como construir um agente de governança de nomenclatura para o Databricks Unity Catalog
Naming conventions são um daqueles temas que todo time de dados concorda em teoria e ignora na prática. A regra existe, o documento está no Confluence…
Evoluindo aplicações agênticas no Microsoft Fabric: deploy automatizado e integração com Data Agents
Nos últimos meses, tenho acompanhado de perto como o Microsoft Fabric tem acelerado sua evolução para competir diretamente no espaço de IA e agentes.…