Preguntas de entrevista con desglose de respuestas — Página 49 de 52

Explora la página 49 de los desgloses de preguntas y respuestas de entrevistas de Offer.cc con razonamiento, detalles de implementación, preguntas de seguimiento y fuentes públicas.

BackendDifícil

¿Cómo diseñar una API de paginación basada en cursores estable?

Comience con la semántica de paginación bajo escrituras concurrentes, compare la paginación por offset y por cursor, y luego deduzca un cursor compuesto, el índice correspondiente, consultas bidireccionales, el límite de snapshot y pruebas adversarias.

Abrir la pregunta y respuesta
DatosDifícil

Entrevista de ingeniería de datos: Diseñar una dimensión SCD Tipo 2

Diseña una dimensión SCD Tipo 2 con precisión temporal puntual (point-in-time) que incluya claves subrogadas, intervalos de validez semiabiertos, cargas idempotentes, semántica de eliminaciones, correcciones tardías y validaciones de invariantes.

Abrir la pregunta y respuesta
CodingDifícil

Entrevista de código: Implementar un búfer circular acotado SPSC sin bloqueos (Lock-Free)

Implementa un búfer circular de capacidad fija para un único productor y un único consumidor, y explica los índices, las comprobaciones de lleno/vacío, el ordenamiento de memoria y las pruebas de casos límite.

Abrir la pregunta y respuesta
Diseño de sistemasDifícil

Entrevista de diseño de sistemas: Diseñar un editor colaborativo en tiempo real

Construye un editor colaborativo en torno a la convergencia de CRDT, salas de documentos, un registro de actualizaciones duradero y sincronización por vectores de estado, mientras manejas ediciones locales instantáneas, reconexiones fuera de línea, cursores efímeros, revocación de permisos y recuperación comprobable.

Abrir la pregunta y respuesta
BackendDifícil

¿Cómo se diagnostica y optimiza una consulta lenta en PostgreSQL?

Deduzca un índice multicolumna o parcial a partir de la evidencia de la carga de trabajo, los planes de ejecución y las estimaciones de cardinalidad, y luego valide las mejoras de lectura frente a la amplificación de escritura y el riesgo de despliegue.

Abrir la pregunta y respuesta
DatosDifícil

Entrevista de Ingeniería de Datos: Diseñar una Canalización de Change Data Capture (CDC)

Deriva una canalización de CDC sin vacíos a partir del WAL de PostgreSQL, instantáneas iniciales y posiciones de origen; luego maneja entrega al menos una vez, eliminaciones, evolución de esquemas, riesgo de slots de replicación, reanudación/reprocesamiento y reconciliación.

Abrir la pregunta y respuesta
CodingDifícil

¿Cómo implementar un árbol de Fenwick para sumas de prefijos dinámicas y selección ponderada?

Implementa actualizaciones puntuales, sumas de prefijos y rangos, y selección de rango por peso con una estructura compacta de un solo arreglo, manejando la indexación, la complejidad y los límites de pesos negativos.

Abrir la pregunta y respuesta
Diseño de sistemasDifícil

Entrevista de diseño de sistemas: Diseñar un sistema centralizado de registro de logs

Diseñe una plataforma centralizada de registro de logs basada en almacenamiento en búfer local, un flujo durable, indexación selectiva y archivos en almacenamiento de objetos para que sobreviva a tormentas de logs, caídas de servicios posteriores, campos de alta cardinalidad y tenants ruidosos.

Abrir la pregunta y respuesta
BackendDifícil

¿Cómo prevenir una estampida de caché cuando expira una clave de alto tráfico?

Diseñe una ruta de lectura de caché con expiración suave, coalescencia de solicitudes y concesiones distribuidas que resista la expiración de claves populares, caídas del proceso de actualización, fallas de la caché y escrituras demoradas.

Abrir la pregunta y respuesta
DatosDifícil

Entrevista de Ingeniería de Datos: ¿Cómo Diagnosticar y Solucionar una Partición Caliente (Hot Partition) en Kafka?

Diagnostica una partición caliente en Kafka a partir del lag por partición y el sesgo de claves (key skew), calcula el crecimiento del backlog y luego elige limitación de tasa (throttling), concurrencia intrapartición segura, una mejor clave y una migración que preserve el orden.

Abrir la pregunta y respuesta
CodingDifícil

¿Cómo implementar una skip list y explicar su comportamiento esperado O(log N)?

Construye una estructura ordenada, mutable y con capacidad de búsqueda mediante niveles aleatorios, y luego analiza la complejidad esperada, los casos límite y las compensaciones de memoria.

Abrir la pregunta y respuesta
Diseño de sistemasDifícil

Entrevista de diseño de sistemas: Diseñar un servicio de almacenamiento y sincronización de archivos en la nube

Diseña un disco en la nube con subidas de fragmentos reanudables, versiones de archivo inmutables, sincronización de dispositivos basada en cursores, copias en conflicto, recuperación de versiones y recolección de basura segura.

Abrir la pregunta y respuesta
BackendDifícil

Prevenir el Write Skew mediante Aislamiento de Transacciones

Utiliza un invariante de guardia médica para deducir el comportamiento real de Read Committed, Repeatable Read y Serializable, y luego compara reintentos en serializable, bloqueo explícito y una actualización condicional de una sola fila.

Abrir la pregunta y respuesta
DatosIntermedio

¿Cómo se diagnostica el Sample Ratio Mismatch en una prueba A/B?

Utilice una prueba de chi-cuadrada para confirmar el Sample Ratio Mismatch, y luego rastree la asignación, la ejecución, el procesamiento de registros y los filtros de análisis antes de confiar en un incremento del experimento aparentemente significativo.

Abrir la pregunta y respuesta
CodingDifícil

¿Cómo implementar el método alias de Vose para muestreo ponderado O(1)?

Precalcula tablas de probabilidad y alias para el muestreo en tiempo constante a partir de una distribución discreta estática, incluyendo actualizaciones, precisión y validación.

Abrir la pregunta y respuesta
Diseño de sistemasDifícil

Entrevista de diseño de sistemas: Diseñar un servicio de bloqueo distribuido

Diseñe un servicio de bloqueo distribuido basado en un estado fuertemente consistente, renovación de arrendamientos (leases) y tokens de cercado (fencing tokens) para que se mantenga seguro frente a pausas de procesos, particiones, respuestas perdidas y fallas del líder.

Abrir la pregunta y respuesta
BackendDifícil

Diseñar una API idempotente para la creación de pedidos

Comience con el alcance de la clave de idempotencia, las huellas digitales de la solicitud y una restricción de unicidad en la base de datos para que la creación de pedidos sea segura ante reintentos, incluyendo solicitudes concurrentes, respuestas perdidas, expiración de claves y efectos secundarios posteriores.

Abrir la pregunta y respuesta
DatosIntermedio

Entrevista de SQL: Encontrar los tres productos principales por categoría

Agrega los artículos de órdenes al nivel de producto, usa DENSE_RANK para preservar empates de ingresos, y explica el orden de las funciones de ventana, los casos límite, la correctitud y la validación.

Abrir la pregunta y respuesta
CodingDifícil

¿Cómo se implementa un Count-Min Sketch para estimar frecuencias en flujos de datos?

Utilice una matriz bidimensional de contadores y funciones hash independientes para estimar frecuencias de claves en memoria fija, incluyendo límites de error, fusiones y límites de reinicio.

Abrir la pregunta y respuesta
Diseño de sistemasDifícil

Entrevista de diseño de sistemas: Diseñar un rastreador web a gran escala

Derive una frontera de URLs particionada por host a partir del presupuesto de rastreo y luego gestione robots.txt, cortesía, deduplicación, rerastreo y recuperación de concesiones (leases) con invariantes comprobables de capacidad y fallas.

Abrir la pregunta y respuesta
DatosIntermedio

¿Cómo monitorear un modelo de ML en producción?

Utilice un regresor de ETA para viajes compartidos para construir un monitoreo por capas de la salud del servicio, la calidad de los datos, los cambios en la distribución y la calidad de las etiquetas demoradas, y luego asocie cada señal a una decisión accionable de alerta, reversión o reentrenamiento.

Abrir la pregunta y respuesta
CodingIntermedio

¿Cómo puede HyperLogLog estimar valores distintos en un flujo masivo de datos?

Estime la cardinalidad en flujos continuos con memoria fija derivando las actualizaciones de registros de HyperLogLog, las correcciones de error y los límites de combinación distribuida.

Abrir la pregunta y respuesta
Diseño de sistemasDifícil

¿Cómo diseñarías un sistema de feature flags (banderas de funcionalidad)?

Diseña una plataforma de feature flags de baja latencia separando su plano de control de gestión de la evaluación dentro del proceso (in-process), y define explícitamente la asignación de lanzamientos, el comportamiento ante datos obsoletos, la gobernanza y la recuperación ante fallas.

Abrir la pregunta y respuesta
DatosDifícil

¿Cómo evaluar un sistema de recomendación offline y online?

Construye una decisión de lanzamiento a partir de datos registrados en un punto en el tiempo, métricas de ranking y más allá de la precisión, sesgo de exposición y un experimento online aleatorizado; luego diagnostica por qué una victoria offline puede perder online.

Abrir la pregunta y respuesta