Volver al inicio

Trubi Wiki

Explora mi segundo cerebro digital. Documentación, patrones y notas sobre ingeniería de datos.

Documentación

Documentación para agentes: plantillas y buenas prácticas

Cómo documentar un proyecto para agentes de IA: plantillas de contexto, buenas prácticas de mantenimiento y un prompt para generarlas desde el repo.

10 min13 jul 2026
Herramientas

uv — Gestionando +80 entornos virtuales en producción

Cómo reemplazamos pip, pyenv y virtualenv por uv para gestionar +80 entornos virtuales de Python en producción, acortando el onboarding de días a minutos.

5 min10 jul 2026
Bases de Datos

SQL: guía completa desde cero

Fundamentos de SQL y bases de datos relacionales, con ejemplos prácticos de DDL, DML y consultas, más un vistazo a Postgres y SQLite.

12 min10 jul 2026
Programación

Guía de Python para Data Engineering

Del vamos a la práctica: sintaxis, estructuras de datos, funciones, POO, manejo de errores y buenas prácticas para trabajar con Python en proyectos de datos.

13 min10 jul 2026
Data Engineering

Roadmap de Data Engineering

Un recorrido por los conceptos esenciales de la Ingeniería de Datos: de OLTP/OLAP a Lakehouse, pasando por ETL/ELT, modelado, particionado y DataOps.

9 min10 jul 2026
Herramientas

Git: fundamentos, ramas y claves SSH múltiples

Qué es Git y por qué importa más allá del control de versiones, conceptos fundamentales, y cómo gestionar múltiples cuentas SSH para separar tus repos personales y de trabajo.

9 min10 jul 2026
Data Engineering

Introducción a dbt (data build tool)

Qué es dbt, sus ventajas frente a herramientas ETL tradicionales y cómo instalarlo y configurarlo para transformar datos con SQL.

9 min10 jul 2026
Herramientas

Cursor: guía práctica para data engineers

Cómo sacarle el máximo provecho a Cursor, el IDE con IA, en tareas de data engineering: autocompletado, chat, agentes y prompt vs context engineering.

7 min10 jul 2026
Herramientas

No reinventar la rueda: proyectos y estándares antes de construir tu propio RAG

Antes de construir un motor de búsqueda semántica custom para tu codebase o tu documentación, mirá qué ya existe: compresión de codebases, grafos de conocimiento navegables y RAG sin embeddings.

5 min10 jul 2026
Herramientas

tmux: la terminal persistente que uso con Claude Code y en servidores remotos

Qué es tmux, sus conceptos clave (sesión, ventana, panel), cómo personalizarlo (mouse, atajos propios) y por qué es indispensable tanto para trabajar con agentes de código AI como para servidores remotos.

6 min10 jul 2026
Cloud

Guía de AWS para Data Engineering

Los servicios de AWS que realmente usás en un pipeline de datos, organizados por capa: ingesta, almacenamiento, catálogo, procesamiento, orquestación y consumo.

7 min10 jul 2026
Architecture

Apache Iceberg vs Hudi: Guía Definitiva 2024

Comparativa profunda entre los dos formatos de tabla más populares para Data Lakehouses.

8 min16 feb 2024
FinOps

Optimización de costos en Snowflake

Tips prácticos para mantener tu factura de Snowflake bajo control sin sacrificar rendimiento.

5 min10 feb 2024