Los resultados de MLPerf Inference v6.1 y las reseñas medidas del nuevo hardware de Apple salieron la misma semana. Lo común de ambas noticias no es la carrera de núcleos sino ‘la economía de la caja completa’. Leí los textos completos y extraje solo los números calculables.
🌐 · English · 中文 · Español · 한국어 · · Español Hub
El 3.7x del Vera Rubin NVL72 no es una nota del chip: ¿de dónde sale el número?
Anuncio oficial de NVIDIA (16 de septiembre)Según el informe, en la vista previa de MLPerf Inference v6.1 el Vera Rubin NVL72 registró hasta 3.7× el rendimiento del GB300 NVL72 en el benchmark Qwen3-VL (config vLLM + Dynamo) y 2.5× en DeepSeek-R1 (TensorRT-LLM). Pero los números que más me llamaron están en otra parte: 99% de eficiencia de escalado lineal en una configuración de 4 racks GB300 y 288 GPU, y que un 1.6× frente a v6.0 saliera solo de optimización de software en seis meses.
Mi opinión: leer 3.7x como ‘rendimiento de chip 3.7x’ es un error. La configuración de 72 GPU sigue igual; la diferencia viene del dominio NVLink y la planificación. Escalar al 99% significa que añadir racks casi multiplica el rendimiento de forma proporcional, es decir, la prueba cuantitativa de que el cuello de botella es el interconectado, no la frecuencia del chip. También me llama la atención que los modelos de referencia sean DeepSeek-R1 y Qwen3-VL: son de la misma familia que yo ejecuto con un solo 4090, así que las optimizaciones de vLLM pulidas arriba acabarán llegando al archivo de configuración de mi escritorio.
El Mac Studio M5 Ultra de 256GB cuesta 48 dólares por GB: un octavo que un H100, con condiciones
Reseña de IT World KoreaLa configuración tope probada: CPU de 36 núcleos, GPU de 80 núcleos, 256GB de memoria y 4TB de almacenamiento por 12,299 dólares. Geekbench 7 multinúcleo 52,350, Metal GPU 360,019, almacenamiento con escritura a 13,941MB/s (el doble de la generación anterior) y rendimiento de IA hasta 4.3x frente al M3 Ultra (cifras oficiales de Apple). El revisor lo montó headless, cargó modelos con LM Studio y lo usó como servidor de render e inferencia a unos 10 céntimos la hora con un pico de ~480W.
Mi opinión: haga la cuenta usted mismo: 12,299 dólares entre 256GB da unos 48 dólares por GB. Es 1/8 de los 375 dólares por GB de un H100 80GB tasado en 30,000 dólares, e incluso más barato que los 67 dólares/GB de la 4090 24GB (~1,600 dólares). Pero en ancho de banda de memoria gana el servidor por goleada, así que la velocidad de generación de tokens lo resiente. De ahí la conclusión dividida: como «sala de máquinas» que mantiene siempre en espera un modelo muy cuantizado, es la mejor relación calidad-precio existente; no para servir en tiempo real. El VRAM mínimo por uso está en miTabla de referencia de VRAMpara contrastar.
Por qué iOS 27 presume de los nuevos pero va más rápido en los iPhone viejos — mediciones al segundo
Medido en iPhone 11 Pro MaxLa cámara abre en 0.65s frente a 0.98s, revisar la miniatura tras la foto baja de 3.61s a 2.44s, y Mapas de 3.01s a 1.36s: 2.2 veces más rápido. El calentamiento también habría bajado. Ojo: Siri IA y Apple Intelligence son exclusivos de iPhone 15 Pro en adelante.
Mi opinión: la paradoja de que las funciones IA lleguen a los modelos nuevos y la velocidad que se perciba, a los viejos. Es fruto del trabajo en el pipeline de animación y la gestión de segundo plano; a la sombra del marketing de IA, los dispositivos antiguos ganan de hecho 1~2 años más de vida. El mercado de segunda mano también lo nota: los iPhone 12/13 que mueven iOS 27 sin esfuerzo mantienen más tiempo su valor percibido y su curva de caída puede suavizarse; y a diferencia del presupuesto de GPU para entrenamiento, el de cambiar de móvil sí puede esperar.
El punto de confianza de las fotos auténticas se ha desplazado de los metadatos al sensor de la cámara
Libro blanco de imágenes de referencia de AppleEn resumen. El iPhone 18 Pro firma los píxeles con una firma cifrada vía Secure Enclave y Private Cloud Compute en el instante en que pulsas el obturador, y sella metadatos inmutables y su propio sello de tiempo. La razón por la que Apple considera débil el estándar C2PA: la firma se añade tras la captura y vincula la identidad del fotógrafo a la imagen; para un fotógrafo en zona de conflicto, esa estructura le pone un objetivo en la espalda. Pero: solo la cámara principal, sin aplicación retroactiva, sin soporte en China al lanzamiento y solo visualización en Europa.
Mi opinión: lo esencial es que el ancla de confianza pasó de la «prueba a posteriori» a la «firma en el momento de la captura». A la vez queda el problema de que solo hay un ancla: Apple. En un mercado donde buena parte de las fotos de noticias se hacen con iPhone, el veredicto sobre qué es «real» queda en manos de una sola empresa, y la verificación de autenticidad empieza a fragmentarse geopolíticamente, como la bifurcación China/Europa. El primer punto a seguir es con qué rapidez el bando C2PA alcanza la firma a nivel de sensor.
Preguntas frecuentes
¿Qué tiene que ver el 3,7x de Vera Rubin con los usuarios locales?
No es comparable directamente, pero los modelos del benchmark (DeepSeek-R1, Qwen3-VL) y el framework de inferencia (vLLM) son de la misma familia que los setups locales. Las técnicas de optimización de lotes y caché validadas a escala de rack se trasladan tal cual a una configuración de escritorio.
¿Puedo ejecutar modelos de 70B con un M5 Ultra de 256GB?
Una cuantización a 4 bits de un 70B pesa unos 40GB, así que caben varios cargados a la vez con holgura. El cambio: por el límite de ancho de banda la generación puede ir más lenta que en una GPU de sobremesa, así que es ideal para espera permanente de baja frecuencia.
¿Las imágenes de referencia funcionan también en iPhones anteriores?
No. Es exclusivo de la cámara principal del iPhone 18 Pro, sin compatibilidad retroactiva, y al principio no funciona en China y en Europa solo permite ver.
Fuente: resultados de MLPerf v6.1 en el blog oficial de NVIDIA (16 de septiembre), reseña medida de IT World Korea y libro blanco de imágenes de referencia de Apple. Precios y cifras son los del anuncio y pueden cambiar.