Saltar al contenido
kerneldigest

Señales

553 señales · página 11 de 28 · GitHub trending, HN, noticias del ecosistema

Lum1104/Understand-Anything

26 may 2026

Esta herramienta de TypeScript genera grafos de conocimiento interactivos a partir de código, permitiendo a ingenieros Staff+ explorar, buscar y consultar bases de código complejas. Es relevante para mejorar la comprensión de sistemas distribuidos o monolitos grandes, facilitando el onboarding y la depuración.

GH·⭐33k

Despacho Fused MoE Multiplataforma en Triton: Enrutamiento de Expertos Portable sin CUDA

26 may 2026

Este artículo presenta TritonMoE, un kernel de despacho MoE completamente implementado en OpenAI Triton. Permite el enrutamiento de expertos portable sin depender de CUDA, abordando un cuello de botella clave en la inferencia de LLMs y ofreciendo una alternativa a las implementaciones optimizadas existentes que están ligadas a hardware NVIDIA.

arxiv ML Training LLM Inference

Parches ML-KEM y X-Wing para el kernel de Linux: Criptografía Post-Cuántica

26 may 2026

Google ha publicado parches de prueba de concepto para ML-KEM y X-Wing en Linux, preparando el kernel para la seguridad post-cuántica. Esto es crucial para ingenieros Staff+ que diseñan sistemas con requisitos de seguridad a largo plazo, anticipando la amenaza de la computación cuántica a la criptografía actual.

phoronix Cryptography

Btrfs se prepara para soportar Huge Folios en Linux 7.2, mejorando I/O y gestión de memoria

26 may 2026

Btrfs integrará soporte para Huge Folios (hasta 2MB) en Linux 7.2, una mejora significativa para el rendimiento de I/O y la eficiencia de la gestión de memoria. Esta optimización es clave para sistemas con cargas intensivas que utilizan Btrfs.

phoronix

rohitg00/ai-engineering-from-scratch

25 may 2026

Este repositorio en Python ofrece un currículo práctico para ingenieros que buscan dominar la ingeniería de IA desde cero, cubriendo desde los fundamentos hasta el despliegue de modelos. Es relevante para Staff+ que necesitan construir y escalar sistemas de IA, proporcionando una base sólida para diseñar arquitecturas robustas y eficientes.

GH·⭐18k ML Training LLM Inference

SRE Weekly Issue #518: Observabilidad, DORA y la adopción de IA en SRE

25 may 2026

Este número de SRE Weekly aborda la adopción de IA en SRE, la importancia de la legibilidad más allá de las métricas DORA y los desafíos de la observabilidad cuando los sistemas de monitoreo fallan junto con la infraestructura. Incluye un análisis de los problemas de disponibilidad recientes de GitHub.

HN Incident Response Performance Profiling

Constraint Decay: La Fragilidad de los Agentes LLM en la Generación de Código Backend

25 may 2026

Este estudio evalúa la capacidad de los agentes LLM para adherirse a restricciones estructurales estrictas en la generación de código backend multifichero. Es crucial para ingenieros Staff+ entender las limitaciones de los LLM en entornos de producción que requieren patrones arquitectónicos y ORMs específicos.

arxiv

KernelScript: Lenguaje para personalización del kernel y optimizaciones de aplicaciones

25 may 2026

Multikernel Technologies ha presentado KernelScript, un lenguaje de programación diseñado para simplificar la escritura de programas eBPF y unificar el desarrollo de extensiones de kernel y espacio de usuario. Esto podría transformar cómo los ingenieros Staff+ abordan la optimización de rendimiento a bajo nivel y la personalización del kernel.

phoronix eBPF Performance Profiling

El códec AV2 se lanzará oficialmente la próxima semana, con un decodificador de VideoLAN ya disponible

24 may 2026

El sucesor de AV1, el códec de video de código abierto y libre de regalías AV2, está a punto de ser lanzado. VideoLAN ya ha publicado Dav2d, su decodificador de código abierto, lo que indica la inminencia de su debut oficial.

phoronix

Soporte de Reset Expandido en AMDGPU para Recuperar GPUs de Cuelgues de Cómputo

23 may 2026

AMD está introduciendo soporte de 'pipe reset' en el driver AMDGPU para mejorar la recuperación de GPUs ante cuelgues en cargas de trabajo de cómputo. Esto es crucial para la estabilidad de sistemas que dependen de la GPU, como en ML o HPC, donde la resiliencia es clave para la disponibilidad del servicio.

phoronix GPU Architecture ML Training

Propuesta de compilación paralela multi-hilo (MTPC) para ThinLTO de LLVM

23 may 2026

Una nueva propuesta para LLVM ThinLTO busca introducir paralelismo intra-módulo, permitiendo la compilación de funciones en paralelo. Esto es crucial para reducir los tiempos de compilación de módulos grandes en CPUs modernas de alto número de núcleos, impactando directamente la eficiencia del ciclo de desarrollo.

HN Performance Profiling

Discord automatiza la gestión de ScyllaDB a escala masiva con su Scylla Control Plane

23 may 2026

Discord detalla cómo su equipo de infraestructura, pequeño para su escala, automatizó la gestión de cientos de nodos ScyllaDB. Esto permite operaciones complejas como upgrades y expansión de clusters, reduciendo drásticamente el overhead y riesgo operacional.

infoq Databases

Imbad0202/academic-research-skills

22 may 2026

Este repositorio ofrece un flujo de trabajo estructurado para la investigación académica asistida por IA, utilizando Claude para generar, revisar y refinar textos. Es relevante para ingenieros Staff+ interesados en automatizar y mejorar la eficiencia de la producción de documentación técnica o papers de investigación, aprovechando modelos de lenguaje avanzados.

GH·⭐19k

LiveR: Elasticidad Fina para Entrenamiento de Modelos con Reconfiguración en Vivo

22 may 2026

Este artículo presenta LiveR, un sistema que permite la reconfiguración en vivo de trabajos de entrenamiento de modelos distribuidos. Esto es crucial para aprovechar recursos GPU volátiles y económicos, minimizando interrupciones y maximizando la utilización del clúster, un desafío clave en infraestructuras de ML a gran escala.

arxiv ML Training GPU Architecture

DynaFlow: Paralelismo Intra-Dispositivo Transparente y Flexible con Planificación Programable de Operadores

22 may 2026

Este artículo presenta DynaFlow, una solución para el paralelismo intra-dispositivo en ML que aborda la subutilización de recursos. Su enfoque de planificación programable de operadores busca superar las limitaciones de los modelos de programación estáticos y secuenciales, reduciendo el costo de ingeniería para integrar estrategias de paralelismo.

arxiv ML Training LLM Inference

Multi-Stream LLMs: Desbloqueando Modelos de Lenguaje con Streams Paralelos de Pensamientos, Entradas y Salidas

22 may 2026

Este paper propone un nuevo paradigma para LLMs, permitiendo streams paralelos de pensamientos, entradas y salidas. Esto aborda el cuello de botella de un solo stream en los modelos de chat actuales, lo que podría mejorar significativamente la eficiencia y la capacidad de los agentes autónomos basados en LLMs.

arxiv LLM Inference

colbymchenry/codegraph

21 may 2026

CodeGraph es un grafo de conocimiento de código pre-indexado que optimiza el uso de LLMs para análisis de código, reduciendo tokens y llamadas a herramientas. Es relevante para ingenieros Staff+ que buscan mejorar la eficiencia y el rendimiento de sus flujos de trabajo de desarrollo asistidos por IA, especialmente en entornos locales.

GH·⭐11k

Valkey 9.1: Mejoras de Rendimiento y Seguridad en el Fork de Redis

21 may 2026

Valkey 9.1, el fork de Redis, alcanza 2.1M de req/s con un nuevo modelo de I/O threading y optimizaciones. Incluye control de acceso a nivel de base de datos y mejoras TLS, relevantes para arquitecturas de alto rendimiento y seguridad.

phoronix Databases

Programación consciente de caché (CAS) se fusionará en Linux 7.2 para mejorar el rendimiento de CPU modernas

21 may 2026

La esperada característica de programación consciente de caché (CAS) liderada por Intel se integrará en el kernel de Linux 7.2. Esta mejora es crucial para ingenieros Staff+ que optimizan el rendimiento en CPUs modernas con múltiples cachés de último nivel, especialmente en servidores con cargas de trabajo exigentes.

phoronix Linux Scheduler CPU Architecture

OpenAI detalla su arquitectura WebRTC para IA de voz de baja latencia a escala global

21 may 2026

OpenAI ha rediseñado su arquitectura WebRTC para IA de voz, reemplazando un modelo de terminación de medios convencional por uno de retransmisión-transceptor. Este cambio optimiza la latencia y la escalabilidad global, utilizando Kubernetes y balanceadores de carga en la nube para mantener el estado de la sesión y reducir la exposición UDP.

infoq Kubernetes