GPU 시세 · VRAM · 온디바이스 AI

De casos de ingresos con Codex a la expansión asiática de los anuncios de ChatGPT: seis noticias de hoy desde la óptica del desarrollador. No suelto enlaces a secas: leí las fuentes y añado los números clave y mi opinión de cada una.

🌐 · English · 中文 · Español · 한국어 · · Español Hub

1. Codex creó la demo de un comercial: liberadas 40–60 horas de ingeniero

Proaction boosts sales 60% and saves 75+ hours with Codex

Es la historia de Proaction, una startup de software de gestión de flotas. Su COO de ventas no es desarrolladora: lanza a Codex grabaciones de llamadas, correos y hojas de cálculo de clientes potenciales yPantalla de demo interactiva con los datos vehiculares de esa empresaellos mismos en 30–45 minutos. De 4 a 6 al mes. Si los hiciera un ingeniero serían 10 horas cada uno, así que se ahorran 40–60 horas mensuales, y la tasa de acuerdos que pasan del primer contacto a la fase real de desarrollo de solución subió un 50–60%.

Mi opinión: lo que se está valorando no es el rendimiento del modelo, sinoEl cuello de botella se desplazaahí está la clave. La producción de demos pasó de la cola de ingeniería a una tarea improvisada del comercial sobre la marcha: si las demos de preventa eran tu cuello de botella, merece la pena copiar este desglose de flujo tal cual, más que cualquier tabla de rendimiento.

2. Harvey eleva el límite de contexto de los borradores legales

Harvey turns legal context into stronger drafts with GPT-6 Astra

Harvey, la IA legal, mostró un flujo que mete en el borrador todo el contexto del asunto —jurisprudencia, documentos de asesores, comunicaciones— y fija en un panel de memoria las preferencias de cada abogado (listas numeradas, prioridad de fuentes, colores por prioridad). Afirman que el formato de documentos y la incorporación de contexto mejoraron notablemente frente a los modelos anteriores.

Mi opinión: no es casualidad que el derecho esté en primera fila — el gran volumen de documentos de entrada y los formatos de salida estrictos hacen queLa longitud de contexto y la estructuración son calidadporque es un dominio que se convierte en eso. Si ejecutas RAG en localTabla de referencia de VRAMy calcula primero tu presupuesto de caché.

3. invideo — tasa de éxito de corrección de color ×3, 50 efectos personalizados al día

How invideo improves color grading 3x with GPT-6 Astra

Informe del editor de vídeo con agentes invideo: las tareas de separación —cambiar solo el fondo manteniendo los tonos de las personas— exigían seguimiento de fotogramas y antes fallaban mucho; ahora la tasa de éxito es unas 3 veces mayor. Crearon unos 50 efectos personalizados al día a partir de descripciones y referencias, y las ediciones complejasMenos pasos de razonamiento y menos tokens de salidaes lo que planifico.

Mi opinión: la sustancia del coste de un agente es el número de pasos de razonamiento. Que bajen los tokens de salida en la misma tarea significa que latencia y factura bajan a la vez — si eliges un agente, mira si publica el número de pasos antes que las puntuaciones de benchmark.

4. Anuncios en ChatGPT, 7 mercados más en el Sudeste Asiático y Taiwán: mil millones de dólares anualizados en 200 días desde el lanzamiento

ChatGPT Ads expands to Southeast Asia and Taiwan

Lanzamiento en Indonesia, Malasia, Filipinas, Singapur, Tailandia, Vietnam y Taiwán: más de 60 países acumulados. Un dato: desde que salieron los anunciosMil millones de dólares de ingresos anualizados en menos de 200 díasla velocidad de logro. Reconfirmaron el principio: anuncios solo en los planes gratuito y barato, sin anuncios en las suscripciones premium, y las conversaciones nunca se comparten con los anunciantes. Corea ya estaba en la ola de despliegue anterior.

Mi opinión: el valor del inventario publicitario sale de la intención de consulta de compra — la misma razón por la que la publicidad en buscadores es cara. Para el marketing coreano, el formato ya aterrizó en Corea, así que toca revisar qué frases de consulta está captando la competencia.

5. Airbnb amplía GPT-6 Astra a toda la ingeniería: trabajo documental de 20 rondas a 3~4

Airbnb widens access to GPT-6 Astra and OpenAI frontier models

Airbnb, que venía usando la familia GPT-5.6 para agentes de codificación, amplió el acceso a Astra a toda su organización de producto e ingeniería vía API y Amazon Bedrock. Un dato interesante: en trabajo de documentos estratégicos, no de código, el rendimiento de un usuario alcanzóDe más de 20 rondas en otros modelos a 3–4 rondasse ha acortado.

Mi opinión: a gran escala el ganador se decide por rondas. No es que una persona ahorre una hora sino un problema de cola de toda la organización, y por eso el presupuesto pasa incluso en equipos que antes no cooperaban.

6. Transformers ejecuta ya las cuantizaciones de llama.cpp: GGUF con from_pretrained

Transformers now runs llama.cpp quants

Hugging Face Transformers ya carga GGUF directamente. Reutilizando mediante la librería kernels los núcleos ggml que sostienen Ollama y LM Studio, alcanza un rendimiento cercano a llama.cpp; los objetivos iniciales de optimización sonApple Silicon y la arquitectura de Qwen3.5es la respuesta. Tabla de ejemplo: Qwen3.5-4B pasa de BF16 8,42 GB a Q4_K_M 2,74 GB: recomendamos Q4_K_M como punto de partida.

Mi opinión: GGUF ha funcionado como el estándar de facto de la ejecución local, pero estaba desconectado del ecosistema Transformers (datasets, runners, evaluación). Si ese muro cae, los modelos cuantizados aparcados en carpetas entran en el pipeline. Para los usuarios de Mac, es una historia que empieza hoy.

Preguntas frecuentes

¿Qué se prepara primero para automatizar demos?

El propio entorno Codex es la condición, así que la integración de grabaciones, correo y CRM va antes que el modelo. Si buscas una alternativa local, automatiza la recogida de contexto y deja la generación enGuía para codificar en localhazlo con esta configuración.

Soporte GGUF — ¿merece la pena cambiarse desde Ollama?

Para solo generar, Ollama sigue siendo cómodo. Cuando hay que enchufar GGUF a pipelines de fine-tuning, evaluación y datasets, Transformers acaba de abrir ese camino.

¿Ya hay anuncios en ChatGPT también en Corea del Sur?

Sí — tras Australia, Nueva Zelanda, Japón, Corea del Sur e India se han añadido 7 mercados del sudeste asiático. Solo son visibles las cuentas de planes gratuitos o de bajo coste.

Fuente: anuncios oficiales del fabricante y cifras publicadas. Precios y especificaciones pueden cambiar: verifica antes de decidir.