
Lanzan Laguna S 2.1: Supera a Deepseek v4 Pro y es más barata
El nuevo modelo de neolab demuestra que es posible superar a los gigantes actuales con una arquitectura optimizada y costos de inferencia reducidos.
33 notas publicadas

NVIDIA presenta ModelExpress, una solución para optimizar el ciclo de vida de los pesos de modelos mediante RDMA P2P, eliminando cuellos de botella en almacenamiento.

BFL presenta FLUX 3, un modelo multimodal capaz de generar video con audio, texto y controlar robots, superando a competidores como Gemini Omni y Grok Imagine.
El nuevo modelo de Poolside destaca en tareas de programación mediante un enfoque en persistencia y razonamiento, superando a sistemas mucho más masivos.

Autoridades estadounidenses acusan a Moonshot de copiar tecnología de Anthropic, pero investigadores sugieren que el desarrollo del modelo es mucho más complejo.

Aprende a configurar un entorno de aprendizaje reforzado en menos de cinco minutos, evalúa tu línea base y genera un adaptador LoRA descargable para tus proyectos.
El proyecto de código abierto respaldado por AMD completa su Lemonade Router, que dirige cada consulta al modelo adecuado según reglas, similitud semántica o un LLM que actúa como enrutador.
El equipo del proyecto abierto para acelerar modelos en la NPU Ryzen AI se une a AMD, y el codigo sigue bajo licencia MIT.
La nueva versión del software de IA local de AMD lleva su agente de correo más allá del triaje: sigue los mensajes pendientes, redacta respuestas con tu estilo y agenda tareas.

El fundador de Osmantic dio dos talleres en el AI Engineer World's Fair sobre cómo desplegar LLM open source en workstations propias, con público que fue de estudiantes a ejecutivos de Intel.

El workbench agrupa más de 60 habilidades preconfiguradas en genómica, proteómica y química, corre local en macOS o Linux y escala a cientos de GPUs vía SSH o HPC.

La nueva versión de la librería de código abierto de Intel ofrece mejoras de velocidad en GPUs Arc y CPUs con soporte AMX-FP16, optimizando flujos de trabajo creativos.

Arduino y Robu.in convocan a estudiantes, startups y entusiastas a crear sistemas de inteligencia artificial física con hardware de vanguardia.

Un desarrollador ha logrado ejecutar un modelo de lenguaje en una Raspberry Pi 5 utilizando energía generada manualmente, cuestionando el alto consumo de los servicios de IA.

Google DeepMind y NVIDIA optimizan la generación de texto paralela, logrando mayor throughput y menores costos operativos para aplicaciones empresariales de IA.

El proyecto GRIP utiliza una unidad IMU y un micrófono para clasificar terrenos en tiempo real, permitiendo a los robots ajustar su tracción automáticamente.

Aprende a exportar modelos cuantizados mediante ModelOpt a ONNX y compílalos con TensorRT para maximizar el throughput y reducir el uso de VRAM en GPUs NVIDIA.

La placa dual-brain de Arduino permite ejecutar agentes de IA localmente, integrando razonamiento complejo con control de hardware en tiempo real sin usar la nube.

Google DeepMind presenta Gemma 4 12B, un modelo de 12 mil millones de parámetros diseñado para ejecutar inteligencia multimodal avanzada directamente en tu laptop.

NVIDIA presenta NVFP4, una técnica de entrenamiento de precisión mixta de 4 bits que permite acelerar el despliegue de LLM en plataformas Blackwell sin perder precisión.

Tras las críticas por mi primer acercamiento a los asistentes de código por IA, profundizo en modelos, frontends y el arte de la ingeniería de prompts.

Qualcomm presenta la serie Dragonwing MBM, SoCs de 4 nm que integran conectividad 5G, Wi-Fi 7, procesamiento multimedia y capacidades de IA local para dispositivos inteligentes.

Jensen Huang presentó en Corea el nuevo superchip RTX Spark, diseñado para potenciar agentes IA y gaming AAA en laptops delgadas y PCs ultraeficientes.

La nueva versión del proyecto open-source de AMD permite seleccionar qué hardware ejecutar para cada agente, optimizando el uso de Ryzen AI y GPUs.

La startup YPlasma expuso en Computex 2026 una solución térmica basada en actuadores de plasma DBD, eliminando partes móviles en módulos NVIDIA Jetson.

En un mundo saturado de buzzwords, analizamos qué es realmente la IA, su relación con la cognición humana y por qué el término se utiliza hoy de forma tan imprecisa.

Nvidia desafía el dominio de Intel y AMD con su nuevo SoC RTX Spark. Potencia bruta y arquitectura ARM, pero la experiencia en Windows sigue siendo la gran duda.

Un ingeniero chino desarrolló un sistema de defensa láser basado en aprendizaje profundo capaz de detectar y neutralizar mosquitos en tiempo real con alta precisión.

NVIDIA simplifica el despliegue de agentes autónomos locales con NemoClaw, ofreciendo hasta 2.6x más velocidad en inferencia y soporte para clústeres multi-nodo.

Aprende a integrar Hermes Agent con NVIDIA NemoClaw para procesar datos privados y públicos de forma segura, permitiendo que tu asistente aprenda nuevas habilidades sin reescribir código.

Wireless-Tag presenta una compacta placa de desarrollo RISC-V que integra procesamiento de alto rendimiento y conectividad inalámbrica para proyectos de edge computing.

Investigadores de Nuevo México proponen un sistema biomimético con drones ligeros y robots esféricos para acceder a cavidades volcánicas de hasta 250 metros de diámetro.

Ante las restricciones de exportación de EE. UU., Alibaba apuesta por su propia arquitectura para competir en el mercado de centros de datos y entrenamiento de IA.
Otros temas que aparecen junto a #ia local en nuestra cobertura editorial.