Documentación para agentes: plantillas y buenas prácticas
Cómo documentar un proyecto para agentes de IA: plantillas de contexto, buenas prácticas de mantenimiento y un prompt para generarlas desde el repo.
uv — Gestionando +80 entornos virtuales en producción
Cómo reemplazamos pip, pyenv y virtualenv por uv para gestionar +80 entornos virtuales de Python en producción, acortando el onboarding de días a minutos.
SQL: guía completa desde cero
Fundamentos de SQL y bases de datos relacionales, con ejemplos prácticos de DDL, DML y consultas, más un vistazo a Postgres y SQLite.
Guía de Python para Data Engineering
Del vamos a la práctica: sintaxis, estructuras de datos, funciones, POO, manejo de errores y buenas prácticas para trabajar con Python en proyectos de datos.
Roadmap de Data Engineering
Un recorrido por los conceptos esenciales de la Ingeniería de Datos: de OLTP/OLAP a Lakehouse, pasando por ETL/ELT, modelado, particionado y DataOps.
Git: fundamentos, ramas y claves SSH múltiples
Qué es Git y por qué importa más allá del control de versiones, conceptos fundamentales, y cómo gestionar múltiples cuentas SSH para separar tus repos personales y de trabajo.
Introducción a dbt (data build tool)
Qué es dbt, sus ventajas frente a herramientas ETL tradicionales y cómo instalarlo y configurarlo para transformar datos con SQL.
Cursor: guía práctica para data engineers
Cómo sacarle el máximo provecho a Cursor, el IDE con IA, en tareas de data engineering: autocompletado, chat, agentes y prompt vs context engineering.
No reinventar la rueda: proyectos y estándares antes de construir tu propio RAG
Antes de construir un motor de búsqueda semántica custom para tu codebase o tu documentación, mirá qué ya existe: compresión de codebases, grafos de conocimiento navegables y RAG sin embeddings.
tmux: la terminal persistente que uso con Claude Code y en servidores remotos
Qué es tmux, sus conceptos clave (sesión, ventana, panel), cómo personalizarlo (mouse, atajos propios) y por qué es indispensable tanto para trabajar con agentes de código AI como para servidores remotos.
Guía de AWS para Data Engineering
Los servicios de AWS que realmente usás en un pipeline de datos, organizados por capa: ingesta, almacenamiento, catálogo, procesamiento, orquestación y consumo.
Apache Iceberg vs Hudi: Guía Definitiva 2024
Comparativa profunda entre los dos formatos de tabla más populares para Data Lakehouses.
Optimización de costos en Snowflake
Tips prácticos para mantener tu factura de Snowflake bajo control sin sacrificar rendimiento.