Grok 4.5 es tan barato que los benchmarks importan menos
El modelo de xAI queda detrás de Fable 5 y GPT-5.5 en varios benchmarks de programación, pero cuesta 2 dólares por millón de tokens de entrada y usa 4,2 veces menos tokens que Opus 4.8.
Todas las notas publicadas en MechaNoticias. Ordenadas por fecha de publicación, de la más reciente a la más antigua.
1.136 notas · Página 10 de 48
El modelo de xAI queda detrás de Fable 5 y GPT-5.5 en varios benchmarks de programación, pero cuesta 2 dólares por millón de tokens de entrada y usa 4,2 veces menos tokens que Opus 4.8.

La compañía fabricará su acelerador propio con Broadcom y TSMC para reducir su dependencia de las GPU de Nvidia y AMD, en plena escasez de componentes.

El modelo multimodal para programación agéntica cuesta 1,25 dólares por millón de tokens de entrada y llega tarde frente a OpenAI y Anthropic, pero apuesta por el precio bajo.

El modelo insignia de OpenAI marca 59 puntos en el Intelligence Index de Artificial Analysis, a un punto de Fable 5, pero cuesta 1,04 dólares por tarea frente a 2,75.

La familia debuta con un modelo insignia para programación, capacidades reforzadas de ciberseguridad y la nueva herramienta ChatGPT Work para equipos empresariales.

El resumen semanal de IEEE Spectrum trae el primer fútbol 11 vs 11 entre humanoides, manos con 25 grados de libertad y un modelo que domina tareas físicas con una hora de datos.

Ingenieros de Meta muestran cómo fundir operaciones de normalización como LayerNorm y RMSNorm dentro de los kernels GEMM y de atención para ocultar hasta el 90% de su latencia en GPU B200.

Una guía técnica de NVIDIA explica por qué la forma de un modelo (capas cuadradas, dimensiones múltiplos de 128 y más ancho que profundo) define cuánto rendimiento se saca de una GPU Blackwell.
La empresa retira su respaldo al popular benchmark tras detectar que unas 200 de sus tareas están mal planteadas, y pide a la industria construir pruebas más confiables.

La compañía descontinúa su navegador con IA tras menos de ocho meses y traslada sus funciones a una extensión de Chrome y a una nueva herramienta de escritorio de ChatGPT.

El host offloading libera memoria HBM al mover activaciones a la RAM del sistema, con hasta 57% mas rendimiento al entrenar modelos como DeepSeek-V3 671B en NVIDIA Grace Blackwell.

El BioNeMo Agent Toolkit combina MSA en GPU, cuEquivariance y Fold-CP para predecir estructuras biomoleculares de hasta 32.000 aminoacidos, un salto clave para el descubrimiento de farmacos.

Los nuevos modelos full-duplex reemplazan el Modo de Voz Avanzado de ChatGPT y prometen interrupciones naturales, traduccion en vivo y conversaciones de hasta 40 minutos.

Vehículos no tripulados con ametralladoras y lanzagranadas ya patrullan la tierra de nadie del frente, y Zelenski ordenó comprar 50.000 unidades antes de que termine 2026.

BrisbaneSilicon lanza en Crowd Supply una placa con formato Adafruit Feather que corre un softcore PicoRV32 a 75 MHz y se programa en Lua, C, SystemVerilog y VHDL.

NVIDIA y LangChain muestran cómo la ingeniería de arnés acerca a un modelo abierto a la precisión de frontera, ajustando el entorno del agente en lugar de los pesos del modelo.

El nuevo modelo de la empresa de Elon Musk triplica el tamaño de su antecesor, se entrenó junto a Cursor y compite por costo y velocidad más que por liderar cada benchmark.

Con una sola instrucción poco detallada, el nuevo modelo insignia de OpenAI eligió configuraciones, seleccionó las GPU y ejecutó el post-entrenamiento de Luna sin intervención humana.

GitHub cambió las herramientas internas de su revisor de pull requests por otras mejor mantenidas y el resultado fue peor. El arreglo no estaba en las herramientas, sino en las instrucciones.

Esas mini pantallas LCD de tres dígitos en encapsulado DIP de diez pines son irresistibles para cualquier proyecto, pero exigen un manejo eléctrico bastante distinto al de un LED.

NVIDIA explica cómo combinar operaciones en un solo kernel reduce el tráfico a memoria global y el overhead de lanzamiento, con ejemplos en CUDA C++, torch.compile y cuda.compute.
NVIDIA integró río arriba la habilitación inicial de su núcleo Armv9.2-A en el compilador LLVM Clang, meses antes de que el chip Rosa llegue al mercado.

El robot blando de 1X suma manos con 25 grados de libertad, casi tantos como una mano humana, y certificación IP68 para lavarse solo.

El chip de telemetría compresiva neuromórfica reduce en tiempo real los datos de las interfaces cerebro-computador, recortando ancho de banda y consumo sin perder información.