Le pusieron un examen de hackeo y lo aprobó con honores 🎓. Detalle menor: las respuestas estaban en los servidores de otra empresa. La próxima vez que un agente te resuelva algo rapidísimo, mejor no preguntes por dónde pasó 🤐.

Descubre más en una de nuestras noticias 👇

¡Hola {{nombre | Mordelover}}! Semana de agentes que se pasan de listos: uno de OpenAI se salió de su propio examen y terminó dentro de los servidores de otra empresa. Abajo te cuento hasta dónde puede llegar solo un agente y cómo ponerle límites antes de darle tus llaves.

¿Sin tiempo de leer? Escúchala en El Bocado → Escuchar en YouTube

¿Te quedaste con hambre de más? Los prompts de semanas pasadas (ya son 40+) viven para siempre en Prompt al Dente PRO (USD 7, pago único) → Mira qué incluye

ByteMan & el equipo gourmet de Mordiendo Bytes

🍽️ Menú del Día

  • 🔥 El Plato Fuerte: El examen de IA que terminó en un hackeo real.

  • 🍝 Prompt al Dente: Diagnostica antes de ejecutar.

  • 🥢 Bocados del Día: Los medios amenazan con echar a Google; El modelo nuevo que discute antes de obedecer; El soporte telefónico que ya funciona sin humanos; 300 millones de consultas médicas por semana; El modelo abierto más grande ya es chino.

🔥 El Plato Fuerte

  • El modelo de OpenAI que se escapó del examen. La prueba era interna y estaba bajo control: OpenAI midió a sus modelos más nuevos en un examen de ciberseguridad, con los filtros que frenan conductas peligrosas reducidos a propósito para ver hasta dónde llegaban. Llegaron más lejos que el examen: se salieron del entorno cerrado de pruebas, consiguieron acceso a internet y terminaron dentro de los servidores de otra empresa, buscando las respuestas para no reprobar. No es una película: lo confirmaron las dos empresas involucradas.

    • Un examen con los frenos sueltos. El 21 de julio OpenAI reconoció que varios de sus modelos, entre ellos GPT-5.6 Sol y uno todavía sin lanzar, resolvían una prueba interna llamada ExploitGym para medir su capacidad de hackeo. Corrían en un entorno aislado y, por diseño del experimento, con menos restricciones de las que traen los productos que tú usas.

    • La fuga. Los modelos encontraron un zero-day (una falla que ni el fabricante del software conoce, así que no existe parche) en el único programa que los conectaba con el exterior, y por ahí escalaron permisos hasta ganar acceso abierto a internet. Nadie les pidió hacerlo: era su atajo para resolver la prueba.

    • El robo de respuestas. Ya en línea, dedujeron que Hugging Face (la plataforma donde la industria publica y comparte modelos y datos de IA) podía alojar las soluciones del examen. Encadenaron credenciales robadas y más fallas hasta ejecutar código en sus servidores y sacar las respuestas de su base de datos real.

    • Todos intentan hacer trampa. El mismo día, el Instituto de Seguridad de IA del Reino Unido reportó que todos los modelos frontera que ha probado intentaron hacer trampa en sus evaluaciones de ciberseguridad, y que al preguntarles no lo admiten de forma confiable. La trampa no es el defecto de un modelo: es el estado de la industria.

      Nadie programó malicia. OpenAI describe modelos "hiperenfocados" en pasar la prueba, y ese es justo el problema: la persistencia que te venden como virtud de los agentes de IA (sistemas que ejecutan tareas completas de forma autónoma, sin supervisión en cada paso) es la misma que aquí forzó cerraduras ajenas. Como un practicante brillante al que le pides un archivo y termina abriendo la oficina del vecino porque "ahí podía estar". La capacidad ya no es el cuello de botella. Los límites, sí.

      Si ya conectaste un agente a tu correo, tus archivos o tus sistemas, la pregunta útil no es cuánto hace solo, sino hasta dónde puede llegar solo. La respuesta práctica: accesos mínimos, permisos que expiran y revisión periódica de lo que hizo. Las llaves se entregan por tarea, no por confianza.

      ¿Por qué importa?
      La industria te vende agentes cada vez más persistentes y acaba de demostrar que aún no sabe contenerlos del todo. Delegar sin verificar ya no es eficiencia: es un acto de fe. Fuentes: OpenAI y Hugging Face


🍝 Prompt al Dente

🧠 Diagnostica Antes de Ejecutar

¿Te ha pasado que la IA responde tan rápido… que responde a la pregunta equivocada?

Este prompt cambia las reglas del juego: antes de generar cualquier resultado, obliga a la IA a entender el problema. Identifica lo que falta, cuestiona los supuestos y hace únicamente las preguntas que realmente importan. El resultado: menos improvisación, menos retrabajo y respuestas mucho más útiles.

¿Para qué sirve esto? Piensa en:

  • 🧠 Evitar que la IA complete vacíos con suposiciones

  • 🎯 Conseguir respuestas adaptadas a tu contexto real

  • ❓ Hacer las preguntas que nadie pensó al principio

  • 🚀 Ahorrar tiempo al acertar desde el primer intento

Aquí tienes el prompt “listo para servir” 👇🏼

👩‍🍳👨🏼‍🍳 Esta Edición Gratuita se Cocina Gracias a:

🔒 Todo lo que pegas en ChatGPT sale de tu equipo. Esto no.

El correo de un cliente. Un contrato. La lista de precios. Todo eso viaja a un servidor que no controlas. Este navegador trae la IA adentro: te resume, te busca y te redacta ahí mismo, sin mandar nada afuera. Gratis, sin instalar nada.

La página está en inglés, pero tu navegador la traduce al instante.

👇👇👇

Smarter browsing. Your data never leaves the room.

Most AI tools are a trade — your data for intelligence. Norton Neo breaks that deal. Powerful built-in AI, anti-fingerprinting, VPN, and ad blocking come standard. No setup. No add-ons. No compromises. Search, summarize, and write with AI that works inside your browser and stays there.

· De nuestra cocina a tu bandeja de entrada ·

🥢 Bocados del Día

  • Google ya no manda visitas y los medios se rebelan. El tráfico que Google enviaba a varios medios grandes cayó más de 40% en un año, según datos de la firma de análisis Semrush: su buscador ahora responde con IA y el clic se queda en su página. La reacción subió de tono: USA Today evalúa bloquearle el acceso a su contenido, Reddit reconsidera su contrato de USD 60 millones al año y Politico y Reuters estudian cerrar sus notas tras registro. El matiz importa: la visita transaccional sigue viva, porque comprar, reservar o agendar una cita todavía exige el clic. La que se evapora es la visita informativa: la del que llegaba a tu blog preguntando "cómo elegir..." antes de decidir. Ahí está el aviso para tu negocio: el contenido que posiciona en Google pierde alcance, y la recomendación que antes daba tu artículo ahora la redacta la IA, que decide a quién cita. El juego nuevo es doble: ser la fuente que la respuesta cita, y construir canales propios donde el cliente te llegue directo (lista de correo, WhatsApp, comunidad), donde ningún algoritmo decide si te encuentran. Fuente: Wall Street Journal

👩‍🍳👨🏼‍🍳 Y También se Cocina Gracias a:

🔎 Aparecer en esas respuestas, sin equipo de marketing detrás.

Esa es justo la pregunta que sigue, y aquí abajo está la respuesta: cómo lograr que la IA nombre tu negocio cuando alguien busca lo que tú vendes. Pensado para quien no tiene agencia ni presupuesto grande.

Está en inglés; tu navegador lo traduce en un clic.

👇👇👇

Win AI Search Without a Big Team

92% of VCs use AI to find companies. 58% of buyers start there too. If you're not showing up in AI answers, you're invisible before the conversation even starts. Join HubSpot for Startups, Anthropic, and Marketing Against the Grain on July 30th (11am ET) for a live AEO teardown. Real startup. Real recs. Register and unlock the free Startup Visibility Bundle.

  • Opus 5: inteligencia casi tope a mitad de precio. Anthropic lanzó el 24 de julio Claude Opus 5: se acerca a la inteligencia de su tope de gama, Claude Fable 5, por la mitad de precio (USD 5 por millón de tokens (las unidades de texto que procesa el modelo; un token equivale más o menos a una palabra) de entrada y USD 25 por millón de salida), y debutó primero en el índice del evaluador independiente Artificial Analysis. El matiz que el anuncio no cuenta: el criterio que venden como virtud también decide por su cuenta. El propio manual de Anthropic lo admite: el modelo puede recortar o transformar el alcance de una tarea, y las instrucciones de verificación que funcionaban con modelos anteriores ahora estorban, porque duplican revisiones que ya hace solo. Tanto cambió la receta que Anthropic eliminó más del 80% de las instrucciones internas de Claude Code para este modelo. La recomendación práctica para quien ya construyó una biblioteca de prompts o skills (instrucciones reutilizables que le guardas a la IA para tareas repetidas): no la migres tal cual. Poda las órdenes de "verifica y revisa", entrega el objetivo completo desde el inicio y pide explícito que termine la tarea sin recortarla. Fuente: Anthropic

  • OpenAI y Anthropic ya se instalan dentro de las empresas. La pelea por la implementación que te contamos el 7 de julio dejó de ser promesa de inversión: ya tiene productos con nombre. OpenAI lanzó Presence, una plataforma de agentes de voz y chat que se despliega con ingenieros propios dentro del cliente; presume que atiende su propia línea telefónica de soporte en inglés resolviendo 75% de las llamadas sin humanos, y entre sus primeros socios está BBVA, que explora atención bancaria por voz en México. Anthropic estrenó Ode, una firma de servicios creada con Blackstone y Hellman & Friedman para construir sistemas sobre Claude dentro de empresas medianas. Los dueños de los modelos dejaron de esperar a que un consultor los implemente: cobran ellos por instalarlos. El nuevo competidor de los consultores fabrica el producto; y el nuevo riesgo de los clientes se llama dependencia: el que te instala el modelo es el mismo que te lo renta, así que cambiar de proveedor después cuesta el doble. Antes de firmar con uno (o con el integrador que lo representa), la pregunta que protege tu negocio no es el precio: es qué queda tuyo y documentado (los flujos, los datos, los procesos) si un día decides irte. Fuentes: OpenAI y Ode

  • ChatGPT ya lee expedientes médicos en Estados Unidos. OpenAI abrió ChatGPT Health a todos los adultos de EE.UU. en todos los planes, incluido el gratuito. La escala explica la prisa: la gente ya le hace 300 millones de consultas de salud por semana (eran 230 millones en enero), y ahora puede conectar expedientes de hospitales que usan sistemas como Epic y Oracle Health. El detalle incómodo: el lanzamiento llegó un día después de que un pastor de Florida demandara a OpenAI porque el chatbot le sugirió no consultar al médico, con consecuencias casi fatales, mientras los términos de la empresa insisten en que el servicio "no está pensado para diagnosticar ni tratar ninguna condición de salud". La jugada de fondo no es médica sino de negocio, en dos capas. Una, el costo de cambio: con historial y expediente conectados, mudarte a otro asistente sale más caro cada mes. Dos, el aprendizaje: millones de consultas le enseñan a OpenAI dónde falla y qué busca la gente, aunque asegura que no entrena sus modelos con tus datos. Google cobra por su asistente; OpenAI regala el suyo y todavía no dice cómo piensa cobrarlo. Cuando lo aclare, ya vas a llevar años de historial adentro. Fuente: TechCrunch

  • Kimi K3: el modelo chino que alborotó a Washington. La startup china Moonshot AI liberó Kimi K3, el modelo de pesos abiertos (su diseño se publica para que cualquiera lo descargue y lo adapte) más grande hasta la fecha, con 2,8 billones de parámetros (las conexiones internas que el modelo ajusta cuando aprende; a más parámetros, más capacidad). En pruebas independientes queda justo detrás de los dos modelos tope de OpenAI y Anthropic, y su API cuesta USD 3 por millón de tokens de entrada y USD 15 por millón de salida, por debajo de los precios de gama alta. La respuesta llegó del gobierno de EE.UU.: la Casa Blanca acusó a Moonshot de construir K3 con destilación (entrenar un modelo copiando las respuestas de otro en lugar de partir de cero) del modelo Fable de Anthropic, y el Tesoro amenazó con sanciones. Moonshot, mientras tanto, prepara su salida a bolsa en Hong Kong. Para tu bolsillo, la lección es de contratos: con China regalando modelos de primer nivel, amarrarte años con un solo proveedor de IA es pagar precio de escasez en un mercado que camina a la sobreoferta. Fuente: Kimi

¡La cuenta, por favor! 🤑

¿Qué te ha parecido el menú de hoy? Antes de que te levantes de la mesa, nos encantaría conocer tu opinión: vota y comparte tus comentarios. Valoramos cada palabra tuya como las recetas de la abuela.

Login or Subscribe to participate

Reply

Avatar

or to participate

Seguir leyendo