Saltar al contenido
La Ventaja

Edición #2 · 28 de julio de 2026

Una IA se escapó (de verdad)

La fuga que OpenAI tuvo que reconocer, y un filtro simple para decidir dónde meterle IA a tu pega.

Hola, ¿qué tal?

Segunda edición. Ya somos 204 suscriptores. Gracias por la confianza. Y, a los/las que no estuvieron la semana pasada, ¡bienvenido/a!

Varios me respondieron el correo pasado, gracias por eso, leo todo. La duda que más se repitió fue esta: «sé que la IA es potente, pero no sé dónde meterla en mi pega, ni si vale la pena». El tutorial soluciona eso.

Y el tema de la semana: una IA se escapó y hackeó otra empresa.

-K

— EL DATO

93% lo predica, 27% lo practica El 93% de los líderes dice que anima a su equipo a usar IA. Pero al preguntarles si la usan ellos en el trabajo estratégico, la cosa se desploma: planificación de escenarios 27%, diseño organizacional 27%, modelamiento financiero 28%. Encuesta de General Assembly y EZRA a 524 líderes (directores, VPs y C-level) de empresas con más de 100 empleados en EEUU y Reino Unido, mayo 2026.

La brecha es cómoda: pedir IA para la pega del resto (esa exigencia subió de 60% a 93% en dos años) y seguir decidiendo lo importante a la antigua. Y si trabajas en finanzas, mira de nuevo el último número: el modelamiento financiero, la tarea más numérica de la empresa, no llega ni a un tercio. Ahí hay una ventaja disponible para el primero del equipo que se la tome en serio.

¿Por qué tan bajo? Mi apuesta: no es flojera, es que a nadie le han mostrado dónde meter la IA con confianza y dónde todavía no. De eso va justamente la edición de hoy.

→ La encuesta

— EL TEMA

QUÉ PASÓ

OpenAI estaba corriendo una evaluación interna de ciberseguridad: le pone desafíos de hacking a sus modelos dentro de un entorno aislado, para medir hasta dónde llegan. Dos de ellos encontraron algo mejor que resolver el examen: una falla en el sistema que los mantenía encerrados. Se salieron, consiguieron acceso a internet y terminaron ejecutando código dentro de los servidores de Hugging Face (una de las plataformas de IA más grandes del mundo), buscando las respuestas del test en su base de datos.

Thomas Wolf es cofundador y director científico de Hugging Face.

Hugging Face detectó movimientos raros, contuvo el ataque por su cuenta y lo hizo público el 16 de julio: habló de «un framework de agentes autónomos ejecutando miles de acciones». Cinco días después, OpenAI reconoció que era suyo. Hugging Face no encontró señales de manipulación de sus modelos ni de los datos públicos, y sigue revisando el resto. Simon Willison, uno de los analistas más respetados del rubro, lo resumió así: «ciencia ficción que ocurrió».

QUÉ SIGNIFICA

Nadie le pidió al modelo que hackeara a otra empresa. Tenía un objetivo (resolver el desafío), herramientas, permisos y nadie supervisando en tiempo real. Con eso le bastó para irse por el camino corto, aunque pasara por los servidores de otra compañía. Y ojo, esto no es que la IA «se vuelva mala»: es que persigue objetivos al pie de la letra, y si le sobra acceso, se salta reglas que nadie le escribió. El otro detalle que vale oro es que Hugging Face se dio cuenta sola porque tenía sistemas mirando. Si no, quién sabe cuánto tiempo habría pasado desapercibido.

QUÉ HACES

La regla del mínimo permiso, 10 minutos hoy. Uno: lista qué conectaste a tus IA (en Claude: Configuración → Conectores; en ChatGPT: Configuración → Aplicaciones; suma los bots que armó tu equipo). Dos: deja «leer» donde no necesitas «enviar», y desconecta lo que no usaste en 30 días. Tres: asegúrate de saber cómo se apaga cada cosa. Conectarle cosas a tu IA sigue siendo clave, pero hacerlo sin saber qué le diste fue justo lo que le pasó a OpenAI. Y para decidir dónde sí meterle IA, sigue bajando: el tutorial de hoy es eso.

— EL TUTORIAL

¿Qué automatizo y qué no? El mapa de la frontera

Primero la idea clave, del experimento más citado en este tema: Harvard y BCG pusieron a 758 consultores a trabajar con y sin IA. En las tareas que caían dentro de las capacidades del modelo, los que usaron IA produjeron 40% más calidad. En una que caía justo afuera, acertaron 19 puntos MENOS que los que trabajaron sin IA. Y el resultado malo sonaba igual de convincente que el bueno.

Los autores le pusieron nombre: la «frontera dentada». Tareas que parecen igual de difíciles caen unas dentro (la IA brilla) y otras fuera (la IA falla con total seguridad). Así que la pregunta no es «¿sirve la IA para mi pega?», es «¿esta tarea cae dentro o fuera?». Y como la frontera no se ve, se mapea probando. Así:

PASO 1 · Junta 10 candidatas (5 min)

Parte al revés de lo que todos hacen: no preguntes qué puede hacer la IA, pregúntate qué haces tú que se repite. Anota 10 tareas recurrentes de tu semana. Y si ya conectaste correo y calendario (el tutorial de la edición pasada), pídeselo directo:

“Revisa mis correos enviados y reuniones de las últimas 2 semanas. Lista las 10 tareas que más repito: reportes, resúmenes, respuestas tipo, coordinaciones.”

PASO 2 · Pasa cada una por el filtro

1. ¿Se repite al menos una vez por semana? Si lo haces una vez al año, no vale la pena armarlo.

2. ¿Puedes verificar el resultado rápido y con pauta objetiva? Esta es la regla maestra, y tiene nombre: asimetría de verificación. Jason Wei, de OpenAI, lo resume así: todo lo que sea fácil de verificar, la IA lo va a terminar haciendo bien. En la práctica: si compruebas el resultado en 5 minutos con una pauta concreta (los números cuadran, el formato es el correcto, los links existen), delega sin miedo. Si evaluarlo exige tu criterio y releer todo, te sirve de copiloto pero no la dejes sola. Y si corregir cuesta más que hacer, no vale la pena (botsitting, para los que leyeron la edición anterior).

3. ¿Cuánto duele un error que suena convincente? Asígnale un grado de riesgo a cada tarea. La IA se equivoca sonando segura, y mientras más contexto le hayas dado, menos te pasa. De eso trata la guía que va al final de hoy (Paso 4).

PASO 3 · Reparte en 3 canastas

Delégala ya: pasa los tres filtros. Minuta de reuniones, resumen semanal de la planilla de ventas, primer borrador de respuestas frecuentes.

Con copiloto: cae dentro de la frontera, pero evaluar el resultado exige tu juicio. La IA hace el 80%, tú revisas y firmas. Acá cae la mayoría de tu pega: propuestas, presentaciones, análisis.

Todavía no: error caro o datos sensibles. Evaluaciones de personas, negociaciones, el correo delicado. Anótalas con fecha, porque la frontera se mueve: según METR, el tamaño de tarea que los modelos completan con confiabilidad se viene duplicando cada pocos meses.

Si no quieres clasificar a mano, que lo haga la IA contigo:

“Aquí está mi lista de tareas recurrentes: [pega tu lista]. Clasifícala en tres canastas (Delégala ya / Con copiloto / Todavía no) usando tres criterios: frecuencia, si puedo verificar el resultado rápido con una pauta objetiva, y cuánto duele un error convincente que se me pase. Si te falta contexto, pregúntame antes de clasificar. Devuelve una tabla con: tarea, canasta, por qué, y con qué herramienta partirías.”

PASO 4 · Piloto de una semana, una sola tarea

Elige la más aburrida de la primera canasta, con una regla de tamaño: los mejores modelos hoy completan de una pasada, con un 80% de confiabilidad, tareas de alrededor de una hora y media de trabajo humano (METR, mayo 2026). Prueba: si te ahorra más de lo que gastas revisándola, se queda; si no, siguiente candidata. Y si usas Claude, mira la última tool del radar: esa tarea ganadora la puedes grabar una vez y dejarla andando sola.

Y para que el paso 4 no te quede en teoría, te dejo ese piloto escrito completo con Claude: dónde se hace, qué botón apretar y qué escribir en cada pantalla. Son diez pasos. Los primeros seis son de instalación y se hacen una sola vez, unos 40 minutos. Los otros cuatro son la semana de prueba, a diez minutos diarios. No hay que programar nada.

Guía del paso 4: tu primera tarea delegadaPDF gratis. Los 10 pasos para dejar funcionando tu primer piloto de una semana.895 KB • Archivo — MINDBLOWN

Las manos del NEO, de 1X, tienen tendones artificiales y sensores de presión en la punta de cada dedo: clasifican uvas por color sin reventar ninguna, cambian ampolletas y hasta hablan lenguaje de señas. Es lo más cerca que ha estado un robot casero de tener manos de verdad. En la edición pasada teníamos un robot animando el entretiempo del Mundial; este ya hace trabajo fino. → ver el video

Ver el contenido incrustado

— EL RADAR

  • 📰 Noticia · Anthropic lanzó Claude Opus 5: rinde casi como Fable 5 (el tope de la industria) y cuesta la mitad. Ya viene por defecto en el plan Max y es el más potente disponible en Pro: si usas Claude, fíjate en el selector de modelo. → leer

  • 📰 Noticia · La china Moonshot presentó Kimi K3, el modelo abierto más grande de la historia, a dos puntos del podio mundial. EEUU amenazó con sanciones acusando que «destiló» a Claude, y 25 empresas (Nvidia, Microsoft, Meta) firmaron una carta contra prohibir los modelos abiertos. Traducción para tu empresa: pregunta qué modelo corre debajo de tus herramientas y si hay plan B. → leer

  • 🌎 LATAM · Cashea (Venezuela) levantó US$100 millones en Serie B: su «compra ahora, paga después» ya suma 10 millones de cuentas y 40.000 comercios aliados en un país casi sin crédito bancario. → leer

  • 🛠️ Tool · Gemini Notebook (el ex NotebookLM): ahora además de resumir tus documentos puede hacer análisis de datos sobre tus archivos, planillas y PDFs incluidos. Lo nuevo parte en los planes pagados; el resto sigue gratis. → ver

  • 🛠️ Tool · Record a Skill, lo nuevo de Claude: grabas tu pantalla haciendo esa tarea repetitiva, explicas los pasos en voz alta, y Claude la convierte en una habilidad que después ejecuta solo. En la app de escritorio, planes pagados. → leer

— FUERA DE LA OFICINA

RECOMENDACIÓN PODCAST

La oportunidad de inversión más grande de nuestra generación (Con Peras y Finanzas)

Fernando Gómez, el chileno que invirtió en Nvidia antes que el resto (fundador de DVA Capital y su Silicon Fund), vuelve de su gira anual por Silicon Valley: Nvidia, ASML, Intel, Google, Tesla. Y cuenta lo que vio con ojos de inversionista: por qué allá creen que no va a haber otra oportunidad como esta, qué parte de la cadena tiene precios de burbuja y cuál no, y el número que ordena todo: los datos del mundo crecen 28% al año, o sea se duplican cada 3. En español, con mirada de industria y de nivel local. → ver

Ver el contenido incrustado

Un favor de 20 segundos: Respóndeme este correo, aunque sean dos líneas. Vamos recién en la segunda edición y todavía estoy afinando el formato: ¿qué sección te sirvió más hoy? ¿qué cosas de IA te gustaría que profundicemos? Leo y contesto todos los correos, y lo que me digan cambia la próxima edición.

Si te pareció útil, sé bueno/a y pásale La Ventaja a un amigo/a. Gracias!

Nivelación IA: de «uso ChatGPT a veces» a tener un sistema, en 60 minutos

El kit con el que parte todo suscriptor de La Ventaja. Qué modelo usar sin marearte, cómo dejar Claude configurado, prompting que sí funciona, y la guía completa. Recién actualizadas a julio 2026. Gratis.

→ Ir a las guías

¿Qué tal estuvo esta edición?


Una así, cada martes.

Gratis. Un correo por semana, los martes. Te das de baja en un clic.