Señales
553 señales · página 11 de 28 · GitHub trending, HN, noticias del ecosistema
Lum1104/Understand-Anything
26 may 2026Esta herramienta de TypeScript genera grafos de conocimiento interactivos a partir de código, permitiendo a ingenieros Staff+ explorar, buscar y consultar bases de código complejas. Es relevante para mejorar la comprensión de sistemas distribuidos o monolitos grandes, facilitando el onboarding y la depuración.
Despacho Fused MoE Multiplataforma en Triton: Enrutamiento de Expertos Portable sin CUDA
26 may 2026Este artículo presenta TritonMoE, un kernel de despacho MoE completamente implementado en OpenAI Triton. Permite el enrutamiento de expertos portable sin depender de CUDA, abordando un cuello de botella clave en la inferencia de LLMs y ofreciendo una alternativa a las implementaciones optimizadas existentes que están ligadas a hardware NVIDIA.
Parches ML-KEM y X-Wing para el kernel de Linux: Criptografía Post-Cuántica
26 may 2026Google ha publicado parches de prueba de concepto para ML-KEM y X-Wing en Linux, preparando el kernel para la seguridad post-cuántica. Esto es crucial para ingenieros Staff+ que diseñan sistemas con requisitos de seguridad a largo plazo, anticipando la amenaza de la computación cuántica a la criptografía actual.
Btrfs se prepara para soportar Huge Folios en Linux 7.2, mejorando I/O y gestión de memoria
26 may 2026Btrfs integrará soporte para Huge Folios (hasta 2MB) en Linux 7.2, una mejora significativa para el rendimiento de I/O y la eficiencia de la gestión de memoria. Esta optimización es clave para sistemas con cargas intensivas que utilizan Btrfs.
rohitg00/ai-engineering-from-scratch
25 may 2026Este repositorio en Python ofrece un currículo práctico para ingenieros que buscan dominar la ingeniería de IA desde cero, cubriendo desde los fundamentos hasta el despliegue de modelos. Es relevante para Staff+ que necesitan construir y escalar sistemas de IA, proporcionando una base sólida para diseñar arquitecturas robustas y eficientes.
SRE Weekly Issue #518: Observabilidad, DORA y la adopción de IA en SRE
25 may 2026Este número de SRE Weekly aborda la adopción de IA en SRE, la importancia de la legibilidad más allá de las métricas DORA y los desafíos de la observabilidad cuando los sistemas de monitoreo fallan junto con la infraestructura. Incluye un análisis de los problemas de disponibilidad recientes de GitHub.
Constraint Decay: La Fragilidad de los Agentes LLM en la Generación de Código Backend
25 may 2026Este estudio evalúa la capacidad de los agentes LLM para adherirse a restricciones estructurales estrictas en la generación de código backend multifichero. Es crucial para ingenieros Staff+ entender las limitaciones de los LLM en entornos de producción que requieren patrones arquitectónicos y ORMs específicos.
KernelScript: Lenguaje para personalización del kernel y optimizaciones de aplicaciones
25 may 2026Multikernel Technologies ha presentado KernelScript, un lenguaje de programación diseñado para simplificar la escritura de programas eBPF y unificar el desarrollo de extensiones de kernel y espacio de usuario. Esto podría transformar cómo los ingenieros Staff+ abordan la optimización de rendimiento a bajo nivel y la personalización del kernel.
El códec AV2 se lanzará oficialmente la próxima semana, con un decodificador de VideoLAN ya disponible
24 may 2026El sucesor de AV1, el códec de video de código abierto y libre de regalías AV2, está a punto de ser lanzado. VideoLAN ya ha publicado Dav2d, su decodificador de código abierto, lo que indica la inminencia de su debut oficial.
Soporte de Reset Expandido en AMDGPU para Recuperar GPUs de Cuelgues de Cómputo
23 may 2026AMD está introduciendo soporte de 'pipe reset' en el driver AMDGPU para mejorar la recuperación de GPUs ante cuelgues en cargas de trabajo de cómputo. Esto es crucial para la estabilidad de sistemas que dependen de la GPU, como en ML o HPC, donde la resiliencia es clave para la disponibilidad del servicio.
Propuesta de compilación paralela multi-hilo (MTPC) para ThinLTO de LLVM
23 may 2026Una nueva propuesta para LLVM ThinLTO busca introducir paralelismo intra-módulo, permitiendo la compilación de funciones en paralelo. Esto es crucial para reducir los tiempos de compilación de módulos grandes en CPUs modernas de alto número de núcleos, impactando directamente la eficiencia del ciclo de desarrollo.
Discord automatiza la gestión de ScyllaDB a escala masiva con su Scylla Control Plane
23 may 2026Discord detalla cómo su equipo de infraestructura, pequeño para su escala, automatizó la gestión de cientos de nodos ScyllaDB. Esto permite operaciones complejas como upgrades y expansión de clusters, reduciendo drásticamente el overhead y riesgo operacional.
Imbad0202/academic-research-skills
22 may 2026Este repositorio ofrece un flujo de trabajo estructurado para la investigación académica asistida por IA, utilizando Claude para generar, revisar y refinar textos. Es relevante para ingenieros Staff+ interesados en automatizar y mejorar la eficiencia de la producción de documentación técnica o papers de investigación, aprovechando modelos de lenguaje avanzados.
LiveR: Elasticidad Fina para Entrenamiento de Modelos con Reconfiguración en Vivo
22 may 2026Este artículo presenta LiveR, un sistema que permite la reconfiguración en vivo de trabajos de entrenamiento de modelos distribuidos. Esto es crucial para aprovechar recursos GPU volátiles y económicos, minimizando interrupciones y maximizando la utilización del clúster, un desafío clave en infraestructuras de ML a gran escala.
DynaFlow: Paralelismo Intra-Dispositivo Transparente y Flexible con Planificación Programable de Operadores
22 may 2026Este artículo presenta DynaFlow, una solución para el paralelismo intra-dispositivo en ML que aborda la subutilización de recursos. Su enfoque de planificación programable de operadores busca superar las limitaciones de los modelos de programación estáticos y secuenciales, reduciendo el costo de ingeniería para integrar estrategias de paralelismo.
Multi-Stream LLMs: Desbloqueando Modelos de Lenguaje con Streams Paralelos de Pensamientos, Entradas y Salidas
22 may 2026Este paper propone un nuevo paradigma para LLMs, permitiendo streams paralelos de pensamientos, entradas y salidas. Esto aborda el cuello de botella de un solo stream en los modelos de chat actuales, lo que podría mejorar significativamente la eficiencia y la capacidad de los agentes autónomos basados en LLMs.
colbymchenry/codegraph
21 may 2026CodeGraph es un grafo de conocimiento de código pre-indexado que optimiza el uso de LLMs para análisis de código, reduciendo tokens y llamadas a herramientas. Es relevante para ingenieros Staff+ que buscan mejorar la eficiencia y el rendimiento de sus flujos de trabajo de desarrollo asistidos por IA, especialmente en entornos locales.
Valkey 9.1: Mejoras de Rendimiento y Seguridad en el Fork de Redis
21 may 2026Valkey 9.1, el fork de Redis, alcanza 2.1M de req/s con un nuevo modelo de I/O threading y optimizaciones. Incluye control de acceso a nivel de base de datos y mejoras TLS, relevantes para arquitecturas de alto rendimiento y seguridad.
Programación consciente de caché (CAS) se fusionará en Linux 7.2 para mejorar el rendimiento de CPU modernas
21 may 2026La esperada característica de programación consciente de caché (CAS) liderada por Intel se integrará en el kernel de Linux 7.2. Esta mejora es crucial para ingenieros Staff+ que optimizan el rendimiento en CPUs modernas con múltiples cachés de último nivel, especialmente en servidores con cargas de trabajo exigentes.
OpenAI detalla su arquitectura WebRTC para IA de voz de baja latencia a escala global
21 may 2026OpenAI ha rediseñado su arquitectura WebRTC para IA de voz, reemplazando un modelo de terminación de medios convencional por uno de retransmisión-transceptor. Este cambio optimiza la latencia y la escalabilidad global, utilizando Kubernetes y balanceadores de carga en la nube para mantener el estado de la sesión y reducir la exposición UDP.