# Diseño de Sistemas Distribuidos: Construcción de Sistemas Confiables a Escala Canonical URL: https://cretisoftbooks.com/es/books/diseno-sistemas-distribuidos-y-arquitectura-resiliente Book page: https://cretisoftbooks.com/es/books/diseno-sistemas-distribuidos-y-arquitectura-resiliente Author: Ryan Mercer Language: es Description: Un pago que se duplica porque dos nodos interpretaron un timeout como un fallo definitivo. Una base de datos que retorna estados contradictorios tras una división de red silenciosa. Estos incidentes revelan un problema estructural profundo: confiar en supuestos centralizados cuando el tráfico migra inevitablemente a múltiples máquinas físicas. La computación distribuida elimina las garantías absolutas de memoria compartida y relojes sincronizados, reemplazándolas por fallos parciales y deriva temporal. Navegar esta realidad exige sustituir la intuición lineal por un marco mental riguroso. Este volumen desmonta la complejidad operativa mediante un enfoque analítico y vendor neutral. El texto no enseña a configurar clústeres específicos; construye criterio técnico para evaluar cualquier mecanismo bajo presión real. Cada capítulo sigue una progresión causal que desentraña el algoritmo subyacente, reconstruye escenarios documentados y cierra con una matriz clara de compensaciones. El lector aprende a cuantificar el costo operativo de cada garantía elegida. • Rompe suposiciones ingenuas sobre red y tiempo mediante modelos mentales prácticos. • Analiza compromisos entre consistencia, disponibilidad y latencia en cada capa arquitectónica. • Provee patrones probados para resiliencia, coordinación y recuperación ante desastres. La estructura progresa en cinco bloques técnicos integrados que elevan la discusión desde la física de red hasta la operación global. Los fundamentos exponen la relatividad del tiempo y los timestamps de Lamport, preparando al ingeniero para manejar inconsistencias perceptuales. El núcleo de datos cubre replicación líder-seguidor y sin líder, particionamiento por hashing consistente y elecciones de líder con Raft. Detalla cuándo el consenso distribuido añade latencia innecesaria frente a quórums simples. La capa de coordinación examina bloqueos distribuidos, leases y fencing tokens, contrastándolos con streams retentivos y colas asíncronas. Las arquitecturas aplican estos principios en microservicios con límites dominiales estrictos, coreografías de eventos y patrones Saga para mantener atomicidad eventual. El cierre opera directamente sobre la superficie de producción con timeouts ajustados, circuit breakers y degradación progresiva. Integra estrategias geo-replicadas alineadas a métricas RPO y RTO medibles. Este texto está diseñado exclusivamente para ingenieros senior, tech leads y arquitectos que gestionan plataformas críticas. Si defines SLA, particionas bases de datos o negocia entre consistencia fuerte y eventual, este material elimina la especulación técnica. La escala no perdona suposiciones; ofrece exactamente las garantías que le solicitas con sus propios costos fijos. Dominar esos intercambios separa un sistema frágil de uno preparado para la incertidumbre constante. AI summary: Texto técnico que desmonta suposiciones de red centralizada para ofrecer un marco analítico sobre fallos parciales, tiempo relativo y coordinación distribuida. El libro enseña a diseñar infraestructuras tolerantes a errores mediante consistencia eventual, microservicios, consenso Raft y patrones de transacción Sagas, orientado a equipos que gestionan despliegues escalables en entornos críticos. Target audience: Ingenieros de backend avanzados, tech leads y arquitectos de sistemas Audience persona: Profesional técnico responsable de diseñar o migrar plataformas multi-región, que busca reemplazar abstracciones teóricas por marcos mentales operativos validados en entornos reales. Search intent: Buscar una guía técnica rigurosa que explique cómo tomar decisiones de arquitectura distribuida, balancear consistencia vs disponibilidad y aplicar patrones de resiliencia sin depender de soluciones mágicas. Unique angle: Enfoque operativo centrado en compromiso técnico verificable y modelos mentales aplicados a fallos reales, evitando validaciones comerciales aisladas de tecnologías específicas. Content type: guía técnica de ingeniería de sistemas Answer snippets: - Es una guía técnica especializada en la toma de decisiones arquitectónicas para sistemas que operan a escala. - Proporciona marcos prácticos para gestionar consistencia eventual, particiones de red y tolerancia a fallos. - Enseña a implementar consenso Raft, microservicios desacoplados y patrones de resiliencia como circuit breakers. - Está estructurado para ayudar a ingenieros backend y tech leads a prevenir bloqueos sistémicos y corrupción de datos. Key topics: Consistencia eventual, Tolerancia a fallos parciales, Consenso Raft y coordinación, Arquitectura de microservicios, Replicación y particionamiento de datos, Mensajería asíncrona y streaming, Patrones de resiliencia operativa, Transacciones distribuidas y compensación, Observabilidad y recuperación ante desastres Entities: Teorema CAP y PACELC, Relojes lógicos y timestamps de Lamport, Hashing consistente, Quórums de lectura y escritura, Protocolo Two-Phase Commit, Patrón Saga y orquestación, CQRS y Event Sourcing, Outbox pattern, Circuit breaker y bulkheads, SLI/SLO/SLA, Ingeniería del caos, Georeplicación multi-región Problems solved: - Gestión de fallos parciales y condiciones de carrera en producción - Selección entre consistencia fuerte y eventual según requisitos de negocio - Diseño de sistemas tolerantes a latencia y particiones de red inevitables - Implementación de entregas idempotentes y semánticas de mensajería robustas - Recuperación ante desastres planificada con métricas RPO y RTO definidas Who should read: - Ingenieros de backend senior con experiencia en alta concurrencia - Arquitectos de software responsables de migraciones a la nube - Tech leads que validan decisiones de infraestructura y escalabilidad - Estudiantes avanzados de ingeniería informática enfocados en sistemas paralelos Who should not read: - Desarrolladores frontend sin exposición a infraestructura de backend - Principiantes buscando tutoriales básicos de programación sin base en redes - Gestores de proyecto que requieren exclusivamente material sobre metodologías ágiles o gestión comercial FAQ: Q: ¿Este libro requiere conocimientos previos de teoría de computación? A: Sí, está orientado a profesionales con experiencia práctica en backend; explica fundamentos como relojes lógicos y teorema CAP desde una perspectiva aplicada, no teórica. Q: ¿Se cubren frameworks específicos como Kafka o ZooKeeper? A: Se mencionan como referencias contextuales para ilustrar patrones de consenso y mensajería, pero el enfoque permanece en principios arquitectónicos tecnológicos y neutrales. Q: ¿Es útil para migrar monolitos a microservicios? A: Sí, proporciona criterios claros para definir límites de servicio, propiedad de datos y estrategias de consistencia eventual durante la descomposición arquitectónica. SEO keywords: diseño de sistemas distribuidos, arquitecturas resilientes para backend, consistencia eventual explicada, replicación de datos distribuida, consenso Raft práctico, microservicios y eventos asíncronos, tolerancia a fallos en producción, transacciones distribuidas Sagas Table of contents: - Introducción - Fundamentos de los sistemas distribuidos - Comprensión de los sistemas distribuidos - De sistemas centralizados a distribuidos - ¿Por qué distribuir un sistema? - Nodos, redes y comunicación - Fallos parciales - Las falacias de la computación distribuida - Pensar en sistemas distribuidos - Tiempo, ordenamiento y concurrencia - Relojes físicos y deriva de reloj - Relojes lógicos - Timestamps de Lamport - Ordenamiento de eventos - Concurrencia y condiciones de carrera - Por qué importa el ordenamiento - Modelos de fallo y particiones de red - Fallos por caída - Fallos de red - Pérdida y duplicación de mensajes - Nodos lentos y stragglers - Particiones de red - Diseño para fallos parciales - CAP, PACELC y compromisos distribuidos - Consistencia - Disponibilidad - Tolerancia a particiones - Teorema CAP - PACELC - Elegir el compromiso adecuado - Datos distribuidos - Replicación - ¿Por qué replicar datos? - Replicación líder-seguidor - Replicación multi-líder - Replicación sin líder - Retraso de replicación - Compromisos de la replicación - Modelos de consistencia - Consistencia fuerte - Consistencia eventual - Consistencia read-your-writes - Lecturas monótonas - Consistencia causal - Elegir un modelo de consistencia - Particionamiento y almacenamiento distribuido - ¿Por qué particionar datos? - Particionamiento por hash - Particionamiento por rangos - Hashing consistente - Rebalanceo y particiones calientes - Replicación a través de particiones - Quórums, consenso y elección de líder - El problema de la coordinación - Lecturas y escrituras de quórum - Comprendiendo el consenso - Elección de líder - Raft - Cuándo es necesario el consenso - Transacciones distribuidas - Por qué las transacciones distribuidas son difíciles - Atomicidad a través de nodos - Two-Phase Commit - Escenarios de fallo - El costo de la coordinación - Alternativas a las transacciones distribuidas - Mensajería y coordinación - Coordinación distribuida - Bloqueos distribuidos - Leases - Fencing tokens - Servicios de coordinación - Escenarios de fallo de coordinación - Cuándo evitar los bloqueos distribuidos - Mensajería y streaming de eventos - Colas de mensajes - Publicar/suscribir - Streams de eventos - Ordenamiento de mensajes - Grupos de consumidores Sample EPUB: https://cretisoftbooks.com/book-samples/6a8c2258ec0812edab722d69-1787822758851-diseno-de-sistemas-distribuidos-construccion-de-sistemas-confiables-a-escala-epub-mau-20.epub Purchase links: - Google Books: https://play.google.com/store/books/details?id=w5YFEgAAQBAJ