Saltar al contenido
kerneldigest

Señales

553 señales · página 9 de 28 · GitHub trending, HN, noticias del ecosistema

GSoC 2025: Implementación de Bfloat16 en LLVM libc para ML y IA

10 jun 2026

Este proyecto de GSoC introduce el tipo Bfloat16 en LLVM libc, crucial para ingenieros Staff+ que trabajan en optimización de rendimiento en cargas de trabajo de IA y ML. Permite un mayor rango dinámico con menor precisión, mejorando la eficiencia computacional.

blog CPU Architecture ML Training

Matching Regularizado a Gran Escala en Clusters de GPU

9 jun 2026

Este artículo aborda la optimización de programas lineales a gran escala con estructura dispersa para sistemas de decisión como la asignación de anuncios. Propone un nuevo algoritmo distribuido para GPU que supera las limitaciones de memoria y ofrece control explícito sobre la estabilidad temporal de las soluciones, crucial para evitar la "churn" en sistemas de producción.

arxiv GPU Architecture ML Training

Accelerating Birkhoff Projection for Manifold-Constrained Hyper-Connections

9 jun 2026

Este artículo propone una optimización para la proyección de Birkhoff en hyper-conexiones con restricciones de manifold, abordando los altos costos computacionales y de memoria de las implementaciones actuales. Es relevante para ingenieros Staff+ que trabajen con algoritmos de optimización en sistemas distribuidos o ML.

arxiv

Gemma 4 12B: Workflows Agénticos Multimodales On-Device con Arquitectura Encoder-Free

9 jun 2026

Google lanza Gemma 4 12B, un modelo que permite ejecutar flujos de trabajo agénticos multimodales directamente en laptops. Su arquitectura unificada y sin encoders de visión/audio simplifica el procesamiento de datos multimodales, facilitando la experimentación local y el desarrollo de aplicaciones avanzadas.

infoq LLM Inference

Avance en parches de Linux para mejorar la planificación de cgroups en juegos

8 jun 2026

Nuevos parches para el kernel de Linux buscan optimizar el rendimiento de los juegos en hardware antiguo, abordando problemas de planificación de cgroups. Esta mejora podría impactar la gestión de recursos en sistemas con cargas de trabajo diversas.

HN Linux Scheduler

Firefox integra soporte para decodificación de video Vulkan

8 jun 2026

Firefox ahora soporta decodificación de video Vulkan, ofreciendo una alternativa multiplataforma a VA-API. Esto mejora la aceleración por GPU en Linux y sistemas embebidos, resolviendo problemas de compatibilidad con drivers y hardware.

phoronix

Problemas de red P2P de Steam afectan a jugadores en Israel desde hace más de dos meses

7 jun 2026

Este hilo detalla un problema persistente con la red P2P de Steam que afecta a jugadores en Israel, resultando en latencias elevadas. Aunque el impacto es regional, la naturaleza sistémica del fallo en una infraestructura de red a gran escala es relevante para ingenieros Staff+ que gestionan sistemas distribuidos.

HN

FreeBSD 15.1 Retrasado Hasta Mediados de Junio por Errores Críticos en x86

7 jun 2026

El lanzamiento de FreeBSD 15.1 se ha pospuesto debido a la necesidad de corregir errores críticos en el cargador de arranque y el traspaso al kernel en arquitecturas x86/amd64. Esto subraya la importancia de la estabilidad en componentes de bajo nivel para sistemas operativos de misión crítica.

phoronix

Gemma 4 QAT models: Optimizing model compression for mobile and laptop efficiency

6 jun 2026

Google lanza modelos Gemma 4 optimizados con Quantization-Aware Training (QAT) para mejorar la eficiencia en dispositivos edge y GPUs de consumo. Esta técnica simula la cuantificación durante el entrenamiento para minimizar la pérdida de calidad al comprimir el modelo, permitiendo la ejecución local en hardware menos potente.

news LLM Inference

Rastreando una potente fuente de interferencia GNSS espacial sobre Europa

6 jun 2026

Este artículo detalla la detección y caracterización de una fuente de interferencia GNSS espacial que ha afectado a Europa, Groenlandia y Canadá desde 2019. Es relevante para ingenieros Staff+ por su impacto potencial en sistemas distribuidos que dependen de la sincronización precisa y la navegación, destacando la importancia de la resiliencia en la infraestructura crítica.

arxiv

Arreglando UUIDv7 (para casos de uso en bases de datos)

5 jun 2026

Este artículo aborda las críticas a UUIDv7, especialmente su fuga de información y menor entropía, proponiendo mejoras para su uso en bases de datos. Es relevante para ingenieros Staff+ que diseñan sistemas distribuidos y necesitan identificadores únicos robustos y seguros.

HN Databases

SFQ: Simple, Stateless, Stochastic Fairness Queuing para aislamiento de cargas de trabajo

5 jun 2026

Este artículo presenta Stochastic Fairness Queuing (SFQ), un algoritmo O(1) para aislar cargas de trabajo de diferentes clientes, mitigando el efecto de "vecinos ruidosos" en sistemas distribuidos. Es relevante para ingenieros Staff+ que diseñan sistemas escalables y resilientes.

HN

UltraEP: Balanceo de Carga Óptimo en Tiempo Real para MoE en Nodos Rack-Scale

4 jun 2026

UltraEP aborda el desafío del desequilibrio de carga en modelos MoE a gran escala, ofreciendo un balanceador exacto y en tiempo real. Esto es crucial para ingenieros Staff+ que gestionan el entrenamiento y la inferencia de modelos de IA de vanguardia, mitigando stragglers y cuellos de botella.

arxiv ML Training LLM Inference

3mdeb avanza en el port de Coreboot y AMD openSIL para placas MSI Ryzen

4 jun 2026

3mdeb, tras su éxito con EPYC, continúa portando Coreboot y la librería openSIL de AMD a una placa base de consumo Ryzen 9000 (MSI PRO B850-P WiFi). Este esfuerzo independiente de los fabricantes de placas es crucial para la adopción de firmware de código abierto en hardware moderno, ofreciendo mayor control y seguridad a nivel de firmware.

phoronix CPU Architecture

Actualización de libinput corrige vulnerabilidad crítica de ejecución arbitraria de código como root

4 jun 2026

Una vulnerabilidad en libinput, crucial para la gestión de entrada en Linux (X.Org y Wayland), permitía la ejecución arbitraria de código como root. Esta actualización de seguridad es crítica para mantener la integridad de los sistemas operativos Linux.

phoronix

chopratejas/headroom

3 jun 2026

Esta herramienta de Python comprime outputs, logs y chunks RAG antes de que lleguen a un LLM, logrando una reducción significativa de tokens (60-95%) sin sacrificar la calidad de las respuestas. Es relevante para ingenieros Staff+ que buscan optimizar costos y latencia en sistemas con LLMs, especialmente en escenarios de RAG y procesamiento de logs.

GH·⭐8k LLM Inference

FOLD: Deduplicación difusa online para grandes datasets evolutivos con Approximate Nearest Neighbor Search

3 jun 2026

Este artículo presenta FOLD, un sistema de deduplicación difusa online que aborda las limitaciones de escalabilidad de los métodos clásicos de LSH para la construcción de grandes corpus de entrenamiento de LLM. Ofrece alta precisión y rendimiento para datasets en evolución continua, utilizando un índice HNSW actualizado incrementalmente.

arxiv

GreenGNN: Optimización de Comunicación con Ventanas para Entrenamiento Distribuido de GNNs con Conciencia Energética

3 jun 2026

Este artículo presenta GreenGNN, un sistema que optimiza el entrenamiento distribuido de Redes Neuronales Gráficas (GNNs) a gran escala. Aborda el alto consumo energético causado por las miles de recuperaciones de características remotas en cada época, proponiendo un enfoque que reduce los costos fijos de RPC y el consumo de energía de las GPUs en espera.

arxiv ML Training GPU Architecture

Marek Olšák optimiza el rendimiento de píxeles del driver RADV hasta un 100%

3 jun 2026

Un ingeniero clave de drivers de AMD, ahora en Valve, ha logrado una optimización significativa en el driver RADV Vulkan. Esta mejora de hasta el 100% en el throughput de píxeles es relevante para ingenieros Staff+ que trabajan con gráficos de alto rendimiento en Linux, especialmente en gaming y aplicaciones intensivas en GPU.

phoronix GPU Architecture Performance Profiling

Augur: Predicción de Consumo Energético Pre-Ejecución para Tareas en Clusters Heterogéneos

2 jun 2026

Este artículo presenta Augur, una herramienta para predecir el consumo energético de tareas en clusters heterogéneos antes de su ejecución. Es relevante para Staff+ engineers que buscan optimizar la eficiencia energética y la sostenibilidad en infraestructuras de computación distribuida, especialmente en entornos con flujos de trabajo científicos o cargas de trabajo dinámicas.

arxiv