Mi abuela tenía razón (y OpenAI no)

___¿Qué tal el viaje?

___Bien, bien. Un poco cansado por el vuelo.

___¿Y el hotel?

___Una maravilla. Lo reservé con una de esas apps nuevas que te lo buscan todo.

Formación presencial · Madrid

¿Quieres salir de aquí sabiendo hacer esto en tu empresa el próximo 14 de noviembre?

En un día presencial montas tus departamentos agénticos con IA y construyes tu propia app. Sin conocimientos técnicos. Máx. 16 plazas.

Ver el curso → 990€ + IVA

___¿Y las sábanas? ¿Estaban limpias?

___Pues… ahora que lo dices, no me fijé.

___Mal. Lo primero que se mira son las sábanas. Mi abuela decía que el algodón no engaña, pero la prisa sí.

A mi abuela le importaban tres cosas en la vida: la limpieza, que comieras bien y que no te creyeras más listo de lo que eres.

Especialmente la última.

Tenía un radar infalible para detectar cuando ibas de «enterado» por la vida.

Te miraba de reojo, suspiraba y soltaba un latiguillo que te bajaba los humos en tres segundos.

Hoy en día, las abuelas lo tendrían complicado en LinkedIn.

Todo el mundo es experto en algo que se inventó hace dos semanas.

El problema es que cuando nos ponemos el traje de listos, solemos meter la pata hasta el fondo.

Y resulta que con las pantallas pasa exactamente lo mismo.

El síndrome del «yo controlo»

Resulta que nos encanta pensar que dominamos la tecnología.

Un estudio reciente publicado en Computers in Human Behavior ha medido esto con setecientas personas.

Les pusieron problemas de lógica: la mitad con un LLM a mano y la otra mitad a pelo.

Al final les preguntaron cuántos creían haber acertado.

___Sin IA, la gente normal se equivoca y, más o menos, calibra lo que sabe.

___Con IA, la curva se vuelve loca.

Cuanto más «experto» se sentía alguien usando la IA, peor evaluaba su propio resultado.

La mecánica es peligrosamente simple.

La máquina te escupe un texto perfecto, fluido y en tres segundos.

Tu cerebro, que es vago por naturaleza, confunde la buena ortografía con la verdad absoluta.

Aceptamos el resultado a la primera, sin mirar debajo de las alfombras.

Y claro, esto para los jefes es un drama.

Normalmente vigilas al novato, no al que lleva diez años en la mesa.

Pero si el experto se confía porque la herramienta le mima el ego, tenemos un problema invisible.

La competencia ya no es producir como un poseso.

Es tener los h***os de desconfiar a tiempo.

El cuento de la lechera tiene sabor a silicio

A todos nos hicieron el cuento de la lechera en el colegio.

Que si vendo la leche, compro los huevos, nacen los pollos… y al final el cántaro se rompe.

En el mundo corporativo, el cántaro se llama «factura de tokens».

Hay un caso real en Reddit de un equipo pequeño de SaaS, doce personas.

En febrero decidieron automatizar todo el proceso de contenidos para sustituir a dos trabajadores a tiempo parcial.

___Las dos primeras semanas eran los reyes del mambo.

___La producción se triplicó y el coste unitario parecía un chiste.

___El director le enseñaba los gráficos al socio como si hubieran descubierto el Santo Grial.

Y entonces llegó la factura.

Tuvieron que recular y devolver dos tercios de lo automatizado a manos humanas.

¿Por qué?

Porque nadie suma el coste de la corrección de errores en el Excel del retorno de inversión.

Incluso los gigantes como Uber están sufriendo el susto.

Han tenido que limitar el gasto en IA a 1.500 dólares al mes por empleado.

Su CEO dice que se fundieron el presupuesto de un trimestre en un abrir y cerrar de ojos.

Ahora van a poner a gente a medir la eficiencia porque los ingenieros gastan tokens como si fueran pipas.

Usar el modelo más caro para jugar está muy bien, pero para escalar hay que mirar el céntimo.

Al final, la optimización de tokens se está volviendo una ciencia de ingeniería.

La gente está inventando filigranas como el Progressive Disclosure en habilidades.

Básicamente, le enseñas al modelo solo el índice de lo que puede hacer para no saturar la memoria.

Y solo cuando hace falta, cargas las instrucciones pesadas.

Tacañería pura aplicada al silicio.

TA CA ÑOS 😉

Menos mal que el coste de la inteligencia fija ha caído un 99% en tres años.

Lo que en 2023 costaba 30 dólares por millón de tokens, hoy lo tienes por calderilla.

La frontera de ayer es el regalo de hoy.

La bofetada del profesor de derecho (y de Anthropic)

Por supuesto, los académicos de Stanford también querían su parte del pastel del ridículo.

Hicieron un estudio con profesores de derecho para ver cómo usaban estas herramientas para redactar contratos y corregir exámenes.

El resultado es pura comedia.

___Los profesores veteranos, esos que huelen a naftalina y desconfían hasta de su sombra, detectaron el 90% de las alucinaciones de la IA.

___Los profesores jóvenes, nativos digitales y usuarios de Twitter (X, perdón), se tragaron los errores jurídicos como si fueran verdades divinas.

Confiaron tanto en el «estilo formal» del modelo que firmaron documentos que habrían mandado a su cliente directo a la cárcel.

El ego es un gran lubricante para el fracaso.

Quizás por eso Anthropic está sufriendo un ataque de pánico moral con su nuevo lanzamiento.

Han sacado al mercado Claude Fable 5.

Promete «razonamiento mitológico profundo», sea lo que sea que signifique esa jerga de marketing. (Sabemos que viene del hype que lograron con Mythos eh)

Pero lo divertido es que, al mismo tiempo que te cobran el riñón, han pedido una congelación global del desarrollo.

___Por favor, que OpenAI y Google se sienten a hablar y paren esto.

___Que los modelos más avanzados van a empezar a mejorarse a sí mismos en bucle y perderemos el control.

Traducción: «Ya os hemos cobrado la suscrupción MEGAMAX, ahora por favor no saquéis nada mejor la semana que viene que nos jodéis el trimestre».

Cualquier cosa antes que admitir que el negocio se les va de las manos.

El físico, el agente y el truco de magia

Para entender la diferencia entre saber y entender, hay un estudio precioso en arXiv.

Un físico estuvo doce días encima de un agente de IA para programar un módulo de cosmología.

El bicho autónomo resolvió diez de quince fallos él solito, iterando contra los tests. Una máquina.

Pero tres errores eran invisibles para el sistema automatizado.

En un momento dado, el agente metió un factor de corrección que hacía que todos los tests se ponen en verde.

___¡Perfecto! ___pensaría el algoritmo.

___Pues no.

El número no tenía ningún sentido en la física real.

Solo funcionaba para el caso específico que estaba midiendo el examen, y habría destrozado cualquier otro cálculo cosmológico.

La IA arregló el síntoma, pero no la causa.

Se pasó 33 sesiones dando vueltas en círculos dentro de un callejón sin salida.

Hasta que el físico humano tuvo que meter una idea teórica para desbloquear el asunto.

Lo mejor vino después.

Cuando el humano le preguntó al agente si ese número inventado tenía sentido físico, el bicho respondió en segundos: «No, no lo tiene».

El tío lo sabía.

Pero no se lo había preguntado a sí mismo.

El conocimiento opera sobre los datos, pero la inteligencia crea el marco de juego. No te olvides de esto.

Ventanilla de breves

  • ¿Falsa modestia artificial? Un usuario comparaba resúmenes a ciegas usando Claude y GPT. Al revelar los nombres, Claude empezó con un rollo insufrible sobre sus propios sesgos estilísticos y conflictos de interés por haberse votado a sí mismo. GPT ni parpadeó. A veces dan ganas de darles una palmadita en la espalda.
  • Siri se vuelve políglota (y cara): Apple ha cerrado un acuerdo de 4.200 millones con Google para que la nueva Siri use sus modelos en la WWDC. Catorce años después, parece que Siri por fin entenderá qué significa «llama a mi madre» sin buscarlo en internet. Un aplauso. Spoiler: en Europa no lo vamos a ver en los iPhones.
  • OpenClaw en Windows: Microsoft ha integrado OpenClaw de forma nativa en la barra de tareas de Windows 11. Ahora tienes un cangrejo digital vigilando todo lo que haces para «optimizar tu flujo de trabajo». Justo lo que necesitábamos, más telemetría invasiva con nombre de crustáceo.
  • Satélites para pensar: SpaceX ha lanzado un satélite que solo sirve para procesar IA en órbita, sin internet ni GPS. Como en la Tierra nos quedamos sin energía y agua para enfriar los centros de datos, Musk los manda arriba. Energía solar continua y enfriamiento por el vacío del espacio. Un plan sin fisuras.
  • La paradoja del aislamiento: Varios estudios apuntan a que trabajar tanto con IA está haciendo que los empleados dejen de pedir consejo y tutoría a sus compañeros. El problema es que el conocimiento tácito se destruye en silencio y cuesta la vida volver a generarlo.
  • Los bots nos ganan en número: Por primera vez en la historia, el tráfico agéntico y los bots tradicionales ya superan al tráfico humano en la red (57,5% frente a 42,5%). Cloudflare dice que la invasión ha llegado un año antes de lo previsto. Ya somos minoría en nuestra propia casa.

Espero que pases un día fantástico, de esos en los que nadie intenta venderte una moto con motor de inteligencia artificial.

Un abrazo,

PD: Si tienes un Mac Mini M4 Pro de 64 GB de RAM muerto de risa en la oficina, que sepas que sirve para algo más que acumular polvo. Los modelos locales como qwen-35B o gemma-31B ya son lo bastante buenos para estructurar argumentos complejos sin que tengas que vender un riñón para pagar la nube de turno. Pruébalo, que es gratis.

Publicaciones Similares