0912 | Agentes, lienzo y la nube: herramientas que recién salen

||Download

Show notes

Esta semana recorremos herramientas nuevas para creadores y para trabajar con agentes de IA: diseñar merch, letras y mockups gratis en el navegador, clientes que ejecutan varios agentes a la vez, conectores y datos para esos agentes, y utilidades de voz, privacidad y productividad. Todo con lo esencial para saber qué probar.

Línea de tiempo

  • 00:00:04 Apertura
  • 00:00:28 Ejecutar agentes de código en paralelo
  • 00:03:24 Conectar agentes a herramientas y datos
  • 00:05:18 Voz y agentes omnimodales
  • 00:07:21 Mover y proteger tus conversaciones con IA
  • 00:08:59 Del código al flujo de trabajo del equipo
  • 00:10:39 Diseño gratuito en el navegador
  • 00:11:31 Nuevos nichos: obra, streaming y anuncios
  • 00:12:43 Cierre

Enlaces relacionados

Este episodio es producido por Bri. Bri usa tecnología avanzada de IA para convertir los feeds que te importan en podcasts pensados para escuchar. Puedes escribirnos a hi@bri.so.

Transcript

Clara Vega: Hola y bienvenidos, soy Clara Vega.

Mateo Ruiz: Y yo soy Mateo Ruiz. Hoy vamos a recorrer lo que pasó en las últimas veinticuatro horas, pero sin hacer una simple lista de lanzamientos. Lo que nos interesa es el hilo que conecta todo: los agentes de IA están pasando de ser una curiosidad a ser herramientas de trabajo, y eso levanta preguntas sobre dónde corren, con qué datos se alimentan, cómo los controlamos y cómo protegemos nuestra información cuando viaja entre ellos.

Clara Vega: Exacto. Empezamos donde está más caliente: ejecutar agentes de código. Y hay dos filosofías enfrentadas en esto. La primera es local. Cline Desktop es una aplicación de código abierto para modelos de pesos abiertos, con sesiones de agente en paralelo. Hablan de once millones de usuarios, que hay que tomar como lo que es: una cifra que ellos comunican, no un resultado verificado.

Clara Vega: Lo interesante es la función de importar tareas desde Claude Code o Codex, o sea, reconocen que la gente ya trabaja con varios asistentes y quieren ser el lugar donde esas tareas convergen.

Mateo Ruiz: Y junto a Cline está Jackalope, que es una propuesta muy concreta para ese problema. Es un espacio de trabajo de escritorio, también de código abierto, donde corres Codex, Claude Code, Grok y OpenCode en paralelo, cada uno en su propio Git worktree. Eso es la pieza técnica clave: como cada agente trabaja en su worktree, no se pisan entre sí sobre el mismo código. Y luego hay una etapa de revisión, que es donde tú decides qué se queda y qué se descarta.

Clara Vega: Me gusta porque obliga a pensar en el agente como un colega junior: le das trabajo, trabaja, y tú revisas. La pregunta que nadie ha respondido todavía es si revisar cuatro agentes a la vez es realmente más rápido que hacer el trabajo tú mismo. Paralelizar genera más cosas que revisar.

Mateo Ruiz: Sí, y hay un coste de contexto mental. Ahora, el lado opuesto de esta moneda es Cadenya. En vez de que el bucle agéntico corra en tu máquina, ellos lo hospedan. Y se hacen cargo de los problemas que aparecen cuando un agente trabaja mucho rato: la compactación, es decir, cómo resumir y recortar el contexto cuando se llena, las aprobaciones humanas en momentos clave, los webhooks para integrarlo con otros sistemas, y widgets para interactuar con el resultado.

Clara Vega: Y otro detalle importante: Cadenya es agnóstico del modelo. Se conecta vía OpenRouter o con cualquier API compatible con OpenAI. O sea, no te casa con un proveedor. Eso contrasta con Cline y Jackalope, que también apuestan por no encerrarte, pero desde el cliente local.

Mateo Ruiz: Entonces la pregunta abierta del tema es clara: ¿los equipos van a preferir clientes locales, donde tienen el control y el código corre en su máquina, o bucles hospedados, donde alguien más resuelve la infraestructura? No hay respuesta todavía. Lo que sí es cierto es que ambos lados están resolviendo problemas reales: paralelismo y revisión por un lado, persistencia y control del bucle por otro.

Clara Vega: Y hay un producto que hace de puente entre estos dos mundos y el que viene: easyspecs.ai. Ellos atacan el problema de qué revisas exactamente cuando un agente escribe código. Su propuesta es documentar la base de código y convertirla en especificaciones con oráculos y rúbricas, de modo que la revisión de especificaciones sustituya a la revisión de código. En vez de leer el diff de dos mil líneas que generó el agente, revisas si la especificación y sus criterios de verificación están bien.

Mateo Ruiz: Que es una apuesta fuerte, porque cambia dónde está la confianza. Confías en que el oráculo define bien qué es correcto. Si la especificación está mal, el agente va a escribir mal el código con mucha seguridad. Es una idea que suena bien en teoría, pero queda por ver si la revisión por especificaciones se adopta en equipos reales, con plazos y presión.

Clara Vega: Vale, y fíjate que todos estos agentes, ya sea en tu escritorio o en un bucle hospedado, tienen una limitación en común: solos no pueden hacer mucho. Necesitan herramientas y datos externos. Y ahí es donde entra MCP, que se está convirtiendo en el estándar para conectar capacidades a los agentes.

Mateo Ruiz: Un ejemplo muy concreto es Accordio. Es un conector MCP gratuito que le da a Claude treinta herramientas de administración: seguimiento de tiempo, contratos, facturas, pagos. O sea, pasas de un asistente que escribe texto a uno que puede, al menos en teoría, gestionar parte de tu operación. Y tienen una capa de pago a treinta y nueve dólares al mes centrada en redacción de documentos.

Clara Vega: Que es un modelo de negocio interesante: el conector es gratis, y monetizan cuando el agente produce trabajo con valor directo, como un contrato. Ahora, del otro lado de la conexión están los datos. Anysite.io se presenta como una capa de datos B2B para agentes de IA, vía MCP o REST. Hablan de más de seiscientas cincuenta fuentes y más de tres mil quinientos endpoints.

Clara Vega: El detalle técnico que me parece más inteligente es la salida compacta, pensada para que no te coman el contexto del agente con datos que no necesita.

Mateo Ruiz: Sí, porque el contexto es un recurso escaso. Si tu agente tiene veinte mil tokens de ventana y le pegas una respuesta JSON gigante, no le queda espacio para razonar. El problema con ambos, y hay que decirlo honestamente, es la fiabilidad en producción. Treinta herramientas suenan muy bien, pero ¿qué pasa cuando una API externa falla, o cuando los datos de Anysite están desactualizados? Nadie ha publicado todavía cómo se comportan estas cosas con carga real.

Mateo Ruiz: Queda por ver, y los costes también: cada llamada a un agente con herramientas es más cara que una llamada simple.

Clara Vega: Un apoyo a esta discusión es chat-recall, que aunque lo vamos a tratar más a fondo más adelante, tiene una función muy relacionada: escanea el historial de tus chats en busca de claves filtradas. Eso recuerda que cuando conectas agentes a herramientas y datos, también estás ampliando la superficie de cosas que pueden filtrarse.

Mateo Ruiz: Bien, pasemos a cómo interactuamos con estos agentes. Y el cambio grande es la voz, pero no la voz de dictado simple, sino la voz como control completo. El ejemplo más ambicioso es Loqua, una aplicación de voz hecha por investigadores del habla. Y lo llamativo es que desarrollan su propio modelo omni, que comparte el contexto de voz y de pantalla. Eso significa que la aplicación puede entender qué estás viendo mientras hablas, no solo lo que dices.

Clara Vega: Con funciones de dictado, sí, pero también "Capture to Ask", que es capturar algo de la pantalla y preguntar sobre ello, y acciones dentro de aplicaciones. Es decir, hablas y el sistema actúa en tus apps. Eso es un salto cualitativo respecto al dictado clásico, donde la voz solo producía texto.

Mateo Ruiz: En la misma línea está Devin Voice, y ojo con esto porque es bastante directo: hablas una tarea, y Devin la planifica, la programa y la entrega. Detrás usan GPT-Live para la voz y el nuevo modelo SWE-2 de Cognition. Es la promesa del agente de ingeniería completo por voz.

Clara Vega: Y en el extremo más cotidiano, Raycast 2.0. Rehicieron su lanzador desde cero, con acciones de IA que cruzan aplicaciones, Automations, Projects, dictado y búsqueda de archivos. Un requisito importante: necesita macOS Tahoe. O sea, te están pidiendo actualizar el sistema operativo, lo cual siempre es una barrera.

Mateo Ruiz: Lo que une los tres es la tesis de que la voz deja de ser un método de entrada más y pasa a ser la interfaz principal del agente. Pero hay dos incógnitas que se repiten en los tres casos: precisión y latencia. ¿Entiende bien en un entorno ruidoso? ¿Responde con suficiente rapidez para que la conversación sea natural, o hay una pausa incómoda cada vez? Son cosas que solo el uso continuado puede responder, y ningún fabricante ha publicado mediciones independientes.

Clara Vega: Un apoyo visual a esto es Sliick, aunque pertenece a otro ámbito: genera mockups 3D de dispositivos en el navegador, sin cuenta, sin marca de agua, y sin subir nada, todo se queda en tu dispositivo. Lo menciono aquí porque es otro ejemplo de que la frontera de lo que se puede hacer en local, en el navegador, sigue moviéndose. Pero hablemos de ello mejor al final, cuando lleguemos a las herramientas visuales.

Mateo Ruiz: Sí. Vamos ahora a algo que los agentes han creado como problema nuevo: tus conversaciones ya no viven en un solo sitio. Estás con Claude, luego saltas a otro asistente, y el contexto se queda atrás. ChatHop ataca exactamente eso: mueve conversaciones de IA entre asistentes con el contexto incluido. Si no quieres transferir todo, puedes copiar los chats como texto o Markdown. El modelo es veinte usos gratis al mes.

Clara Vega: Es decir, la conversación se vuelve portable. Y en cuanto a recuperar lo que has hecho, chat-recall unifica en un solo historial buscable los chats de Claude Code, Codex, Cursor y OpenCode. Todo gratis y de forma local. Y ya lo mencionamos: además escanea en busca de claves filtradas. Porque, pensemos un momento, ¿cuántas veces le hemos pegado a un asistente un fragmento de código que incluía una variable de entorno? Ese escaneo local es una red de seguridad muy práctica.

Mateo Ruiz: Y la tercera pieza de este tema es la protección activa: TIM PG. Es una herramienta de Windows, sin conexión y sin IA, que enmascara datos personales en el portapapeles antes de que pegues algo en un LLM, y luego restaura esos datos en la respuesta. O sea, el asistente ve una versión anonimizada, tú recibes la respuesta con los datos reales. Y el detalle de que sea offline y sin IA es coherente: una herramienta de privacidad que enviara tus datos a algún sitio sería una contradicción.

Clara Vega: El punto clave de los tres productos es el mismo: los datos viajan entre asistentes, entre historiales, entre el portapapeles y la nube, y hay que protegerlos en cada salto. Conecta directamente con el trabajo de los programadores, que son quienes más pegan código y credenciales a estos sistemas. Ahora, del trabajo individual del programador pasemos al flujo de trabajo del equipo.

Mateo Ruiz: Ahí ya mencionamos a easyspecs, pero sumemos el resto. Formesign añade firma electrónica legalmente vinculante a Google Forms. Cuando alguien rellena el formulario, recibe por correo un PDF firmado, se guarda una copia de auditoría en Drive, y todo se sincroniza con Sheets. Es de esas ideas que parecen obvias en retrospectiva: Google Forms llena millones de formularios, y hasta ahora la firma legal requería otro servicio aparte.

Clara Vega: Sí, es formalizar un proceso que antes se rompía en dos herramientas. Y en la misma línea de formalizar y compartir está Spaces, una aplicación de escritorio que da a los equipos un espacio compartido por proyecto, con agentes de IA, chats y archivos compartidos. El precio es de diez dólares con noventa y nueve al año por persona, que es notablemente barato.

Clara Vega: La pregunta, como siempre con este tipo de herramientas, es si el equipo adopta de verdad el espacio compartido o si cada uno sigue en su herramienta.

Mateo Ruiz: Y para redondear el tema de documentar y compartir, Moji: un lector y editor de Markdown gratuito y de código abierto, con licencia MIT. La idea es abrir un punto md como si fuera un PDF, con vista previa en vivo, soporte de diagramas Mermaid, y exportación a PDF, HTML y PNG. Es la herramienta humilde pero diaria: si tu equipo documenta en Markdown, poder leerlo con formato y exportarlo sin fricción importa.

Clara Vega: El hilo común de los cuatro es formalizar el trabajo: convertir conversaciones en especificaciones, formularios en contratos firmados, archivos sueltos en espacios de equipo. Y queda por ver, sobre todo con easyspecs, si la revisión por especificaciones cala en equipos reales. Bueno, y ahora sí: cerremos con las herramientas visuales gratuitas en el navegador, que además tienen una tesis común: sin cuentas, sin marcas de agua, y en varios casos sin subir nada.

Mateo Ruiz: La primera es Design Studio de Monday Merch: un lienzo en el navegador para diseñar merch sobre más de mil productos, en 2D y 3D, con las reglas de impresión ya integradas en la herramienta, que es importante porque evita diseñar algo que luego no se puede imprimir. Y es gratis.

Clara Vega: Luego GLYPH Immersive, gratuito y sin registro: lettering modular con letterforms de píxeles redondeados sobre una cuadrícula ajustable. Es un nicho estético concreto, pero lo hace muy bien y sin ninguna fricción de entrada.

Mateo Ruiz: Y Sliick, que ya adelantamos: mockups 3D de dispositivos en el navegador, para capturas y vídeos, sin cuenta, sin marca de agua, sin subidas, todo se procesa en tu dispositivo. Los tres juntos marcan una tendencia que se nota en todo el episodio: software local-primero, donde tus datos no salen de tu máquina si no hace falta. Es la misma filosofía de TIM PG, de chat-recall, de Jackalope.

Clara Vega: Y para terminar, tres nichos donde la IA está entrando por la puerta lateral. El primero es la construcción: sizeless convierte el vídeo que grabas con el smartphone de una zanja abierta en un modelo 3D, en planos CAD y BIM y en cantidades para facturación. Tienen respaldo de Y Combinator y ETH Zurich. Si funciona como describen, es un ahorro enorme, porque hoy levantar esa información requiere equipo y tiempo especializados.

Clara Vega: Pero, como siempre, la descripción del fabricante es una afirmación, y la construcción es un sector implacable con las herramientas que no funcionan en obra.

Mateo Ruiz: El segundo nicho es el streaming: LiveGrid, de un fundador en solitario llamado Lucas, permite ver varias emisiones en directo de Twitch, YouTube y Kick a la vez, en una cuadrícula en el navegador. Es simple, pero resuelve un deseo real de mucha gente que sigue varios streams el mismo día.

Clara Vega: Y el tercero es el marketing: Wisry usa agentes de IA que escanean las bibliotecas de anuncios de Meta y TikTok, clonan los anuncios ganadores adaptándolos a tu marca, y los lanzan en Meta y Google optimizados para ROAS. Aquí hay que tener mucho cuidado: "clonar el anuncio ganador" suena bien, pero los resultados de otros anunciantes no garantizan nada en tu cuenta, y ninguna cifra de rendimiento está verificada.

Clara Vega: Es de esos productos donde conviene empezar con presupuesto pequeño y medir por ti mismo.

Mateo Ruiz: Así cerramos. Si algo une todo lo de hoy, es que la IA está dejando de ser una ventana de chat: corre en tu escritorio o en un bucle hospedado, se conecta a herramientas y datos reales, se controla con la voz, y obliga a proteger los datos que viajan con ella. Gracias por escucharnos, soy Mateo Ruiz.

Clara Vega: Y yo Clara Vega. Nos vemos en la próxima.