Saltar al contenido

Archivo completo

Todas las notas publicadas en MechaNoticias. Ordenadas por fecha de publicación, de la más reciente a la más antigua.

1.098 notas · Página 43 de 46

StepFun lanza Step 3.7 Flash, VLM MoE de 198B en NVIDIA
IA

StepFun lanza Step 3.7 Flash, VLM MoE de 198B en NVIDIA

El modelo Mixture-of-Experts con 11B parámetros activos, contexto 256K y entrada multimodal nativa corre en NVIDIA NIM, TensorRT-LLM, vLLM y SGLang.

NVIDIA Developer
NVIDIA Isaac Lab acelera sim-to-real con 8 papers en ICRA 2026
IA

NVIDIA Isaac Lab acelera sim-to-real con 8 papers en ICRA 2026

De ScheduleStream a SEAL: las nuevas piezas que NVIDIA Research presentó en la conferencia ICRA buscan robots que generalicen y se adapten fuera del laboratorio.

NVIDIA Blog
Anthropic lanza Claude Opus 4.8 con Dynamic Workflows
IA

Anthropic lanza Claude Opus 4.8 con Dynamic Workflows

El nuevo modelo llega solo 41 dias despues de Opus 4.7 y suma una herramienta en research preview para coordinar cientos de subagentes dentro de Claude Code.

TechCrunch AI
NVIDIA gastará USD 150 mil millones al año en Taiwán
IA

NVIDIA gastará USD 150 mil millones al año en Taiwán

Jensen Huang reveló en Taipei que la cuenta anual con proveedores liderados por TSMC pasó de USD 10-15 mil millones hace tres años a 150 mil millones, y anunció cuadruplicar el personal local a 4.000.

The Decoder
Google I/O 2026: 12 anuncios clave en Gemini, Search y XR
IA

Google I/O 2026: 12 anuncios clave en Gemini, Search y XR

Gemini Omni para video generativo, Gemini 3.5 Flash con foco en agentes, agentes de información en Search, Daily Brief, anteojos Android XR y expansión de SynthID marcaron la keynote.

Google AI Blog
ESMFold2: BioHub abre 1,1B de estructuras de proteínas bajo MIT
IA

ESMFold2: BioHub abre 1,1B de estructuras de proteínas bajo MIT

El equipo de Alex Rives, ahora en BioHub, lanzó la segunda generación de ESMFold con state of the art en interacciones de anticuerpos y un atlas de 6.800 millones de secuencias bajo licencia MIT.

Latent Space
TRL: delta sync baja 1,2 GB a 35 MB por step en RL asincrónico
IA

TRL: delta sync baja 1,2 GB a 35 MB por step en RL asincrónico

Hugging Face liberó un PR en TRL que codifica solo los pesos que cambiaron como safetensors disperso y los sube a un Hub Bucket. El trainer y el rollout dejan de necesitar el mismo data center.

Hugging Face
NVIDIA CompileIQ: auto-tuning evolutivo para kernels CUDA
IA

NVIDIA CompileIQ: auto-tuning evolutivo para kernels CUDA

El framework integrado en CUDA 13.3 usa algoritmos genéticos para optimizar el compilador GPU por workload, en vez de aplicar heurísticas universales.

NVIDIA Developer
CrowdStrike y Google desactivan botnet contra devs OSS
IA

CrowdStrike y Google desactivan botnet contra devs OSS

La operación contra Glassworm cortó cuatro canales C2 que usaban Solana, BitTorrent, Google Calendar y VPS para envenenar más de 300 repositorios en GitHub.

TechCrunch
Reachy Mini ahora conversa 100% offline con tu hardware
IA

Reachy Mini ahora conversa 100% offline con tu hardware

Hugging Face publicó el stack speech-to-speech cascade con Silero, Parakeet-TDT, Qwen3-TTS y llama.cpp para correr el robot sin enviar audio a la nube.

Hugging Face
Blackwell HGX B200 marca récord STAC-AI en finanzas
IA

Blackwell HGX B200 marca récord STAC-AI en finanzas

El benchmark STAC-AI LANG6 con Llama 3.1 8B y 70B muestra hasta 2,8x más rendimiento por GPU frente a Hopper en cargas de inferencia con documentos EDGAR.

NVIDIA Developer
PyTorch Compile y kernel fusion: hasta 10x más rápido
IA

PyTorch Compile y kernel fusion: hasta 10x más rápido

El compilador Inductor agrupa operaciones dependientes en un solo kernel Triton, eliminando lanzamientos extra y tráfico de memoria intermedio.

PyTorch Blog
TokenSpeed alcanza 580 tps con Qwen3.5-397B-A17B en GPU
IA

TokenSpeed alcanza 580 tps con Qwen3.5-397B-A17B en GPU

El motor open source de LightSeek, escrito desde cero en SPMD con compilacion estatica, ataca workloads agenticos con prefix cache hibrido y disaggregacion prefill-decode para Mamba.

PyTorch Blog
ITBench-AA: ningun frontier LLM supera 50% en tareas SRE
IA

ITBench-AA: ningun frontier LLM supera 50% en tareas SRE

El primer benchmark IBM-Artificial Analysis para agentes en operaciones IT de empresa coloca a Claude Opus 4.7 al frente con 47%, seguido por GPT-5.5 con 46% y Qwen3.7 Max con 42%.

Hugging Face
NVIDIA Dynamo Snapshot: arranque 21x mas rapido en Kubernetes
IA

NVIDIA Dynamo Snapshot: arranque 21x mas rapido en Kubernetes

El sistema con CRIU mas cuda-checkpoint baja el cold-start de un gpt-oss-120b al limite fisico de memoria, evitando que GPUs facturadas queden ociosas durante el scale-up.

NVIDIA Developer
Una semana grabando tareas domésticas para entrenar humanoides
IA

Una semana grabando tareas domésticas para entrenar humanoides

Cocinar, lavar ropa y ordenar pueden convertirse en datos para entrenar a los robots del futuro, si el lector está preparado para las consecuencias del nuevo gig work en primera persona.

Wired
CUDA Tile llega a C++: kernels GPU sin gestionar hilos
IA

CUDA Tile llega a C++: kernels GPU sin gestionar hilos

Con CUDA 13.3, NVIDIA habilita el modelo de programación por tiles en C++ y promete que el compilador se haga cargo de la paralelización, los tensor cores y el movimiento de memoria.

NVIDIA Developer
Pichai habla con The Verge sobre IA, el futuro de la búsqueda y la web
IA

Pichai habla con The Verge sobre IA, el futuro de la búsqueda y la web

El CEO de Google y Alphabet conversó con Nilay Patel tras Google I/O 2026 sobre Gemini, los agentes, Google Zero y el camino a la AGI.

The Verge
Claude Mythos resuelve el problema Erdős que OpenAI había anunciado
IA

Claude Mythos resuelve el problema Erdős que OpenAI había anunciado

El ingeniero Sholto Douglas describió la solución como una "prueba simple y elegante" y la atribuyó a un sistema de instancias Claude Code coordinadas.

The Decoder
NVIDIA Vera, el primer CPU para agentes con 88 cores y 1,2 TB/s
IA

NVIDIA Vera, el primer CPU para agentes con 88 cores y 1,2 TB/s

Phoronix midió el CPU Olympus de NVIDIA: 1,6x sobre Grace, 10% sobre el EPYC 9575F, y compila el kernel Linux en 20 segundos a single-socket.

NVIDIA Blog
CUDA 13.3 trae Tile Programming en C++ y autoajuste de compilador
IA

CUDA 13.3 trae Tile Programming en C++ y autoajuste de compilador

NVIDIA lanza CUDA Tile sobre Hopper, libera CUDA Python 1.0 con green contexts y process checkpointing, y debuta CompileIQ con hasta 15% de speedup en GEMM y attention.

NVIDIA Developer
NVIDIA RTX PRO 4500 Blackwell: 2x más rápido en genómica y plegamiento
IA

NVIDIA RTX PRO 4500 Blackwell: 2x más rápido en genómica y plegamiento

La nueva GPU Server Edition acelera Parabricks, Minimap2, fq2bam y DeepVariant; con cuEquivariance y Openfold3 también gana 2,3x sobre la L4 al inferir estructuras de proteínas.

NVIDIA Developer
TLX Block Attention: 1,85x sobre Flash Attention v2 en NVIDIA B200
IA

TLX Block Attention: 1,85x sobre Flash Attention v2 en NVIDIA B200

El kernel Triton desarrollado por Meta para GPUs Blackwell aprovecha el patrón block-diagonal de los modelos de ranking para eliminar pasos enteros del algoritmo y acelerar 2,50x el backward pass.

PyTorch Blog
Claude Code y OpenClaw: el boom de los agentes IA en Silicon Valley
IA

Claude Code y OpenClaw: el boom de los agentes IA en Silicon Valley

Wired reconstruye cómo Anthropic con Claude Code Opus 4.5 y Peter Steinberger con OpenClaw (366.000 stars en GitHub) detonaron el cambio más subestimado del software, según Thomas Reardon.

Wired