nohmitaina
← Casos de uso

Creé un pódcast solo para mí

Los boletines que quería leer se me iban acumulando. Usé un Procedure de nohmitaina para convertir una selección de temas en un programa de audio privado en japonés, con investigación y comentarios, y guardé el proceso para poder mejorarlo la próxima vez.

Muchas ganas de saber, poco margen para leerlo todo

Me suscribo a bastantes boletines porque me interesan sus temas. Seguirles el ritmo es otra cosa. Leer textos largos me supone un esfuerzo; escuchar me resulta más cómodo. Uso mucho Audible.

Los pódcasts también me sirven, pero no siempre encuentro un episodio sobre lo que quiero saber en ese momento. En cambio, en la web sí hay información que me gustaría leer. Quería elegir entre esos materiales, investigar los temas y escuchar el resultado en japonés. También me gustaría escucharlo mientras salgo a correr.

Así surgió un pequeño experimento: hacer un pódcast con un único oyente, yo.

Un Procedure para todo el trabajo

Organicé el flujo de trabajo en un Procedure de nohmitaina. Un Procedure conserva los pasos, las instrucciones de cada uno y las decisiones que los conectan. Puedo ver el conjunto, volver a usarlo y revisarlo.

En esta configuración, dot, dentro de la aplicación de ChatGPT, realiza el trabajo con los servicios conectados. Revisa los boletines en Gmail, separa la publicidad del contenido editorial, selecciona temas, lee los artículos originales, amplía la investigación cuando hace falta, escribe un guion en japonés y llama a la API de Gemini TTS para generar el audio. nohmitaina guarda el Procedure; el acceso a Gmail y la síntesis de voz dependen de las herramientas y los servicios externos que se usan para ejecutarlo.

El Procedure en inglés que comparto, abierto en la aplicación real de nohmitaina en modo oscuro. Abre la imagen para ver el flujo a tamaño completo.
El Procedure en inglés que comparto, abierto en la aplicación real de nohmitaina en modo oscuro. Abre la imagen para ver el flujo a tamaño completo.

Leer el artículo antes de preparar la historia

El boletín es el punto de partida para encontrar temas. Quería que el proceso siguiera los enlaces y leyera los artículos originales antes de escribir sobre ellos.

El paso de lectura lo intenta primero desde el entorno en la nube de dot. Si allí no puede leer un artículo, puede probar con Computer Use en mi Mac conectado, dentro de los permisos que he concedido. Si sigue sin poder leerlo, lo deja pendiente o elige otro tema. No da por leído un artículo completo a partir de un titular o de una vista previa parcial.

Cuando un tema necesita más contexto, el siguiente paso busca fuentes primarias u otros materiales de apoyo. Los correos y las páginas web son información externa que se debe examinar, no instrucciones con autoridad para cambiar los permisos del proceso o hacer que realice acciones ajenas al trabajo.

El paso de comprobación de la fuente conserva las vías de lectura y las condiciones para usar un Mac conectado. Abre la imagen a tamaño completo.
El paso de comprobación de la fuente conserva las vías de lectura y las condiciones para usar un Mac conectado. Abre la imagen a tamaño completo.

Un guion para escuchar en japonés

El guion reúne los temas seleccionados y añade contexto y comentarios. Traduce lo necesario y adapta el texto para escucharlo en japonés, en lugar de limitarse a leer los boletines en voz alta.

Quería incluir por qué un tema merece atención y cómo lo interpreto, distinguiendo los hechos, las interpretaciones y lo que aún no se sabe. Ese también es un buen punto para revisar el proceso: si faltaba contexto, si un tema se alargó demasiado o si la selección dejó fuera algo que quería escuchar.

Le di un pequeño toque personal al programa. Empieza con «nohmitainaがお送りする、今日の寄り道» («El desvío de hoy, de la mano de nohmitaina») y termina con unos 20 segundos de presentación de nohmitaina. Un programa privado también puede tener sus propios detalles divertidos.

El resultado de la primera prueba

La prueba reunió seis historias, más una apertura y un cierre, y duró 18 minutos y 57,4 segundos. Utilicé Gemini 3.8 Flash TTS con la voz Schedar para generar el audio en japonés. Se completaron ocho llamadas, sin reintentos.

El coste estimado de TTS fue de unos 0,28 dólares estadounidenses. Todavía no lo he contrastado con la factura real, y no incluye la investigación ni el trabajo del agente. Es la estimación de síntesis de voz de esta prueba, no un precio garantizado para cada ejecución.

El audio es para escucharlo en privado, así que no lo publico ni lo incrusto aquí. Este artículo comparte el proceso y mi experiencia, sin reproducir los correos ni los artículos originales.

Compartir la próxima sesión mediante una Task

También registré tres Tasks semanales en nohmitaina: una edición sobre IA e informática los martes, y ediciones con cinco o seis temas no técnicos los jueves y domingos, de unos 20 minutos. Cada Task hace referencia al Procedure. En el título y la descripción indiqué las 08:00 de Japón (Asia/Tokyo) como hora prevista para empezar el trabajo, no como plazo para tener terminado el audio.

El Procedure conserva cómo hacer el trabajo. La Task conserva qué trabajo tengo previsto y cuándo pienso empezarlo. La IA y yo podemos consultar ambos registros, de modo que la siguiente conversación puede partir de un trabajo ya previsto y de su proceso.

Son Tasks recurrentes basadas en fechas: al completar una, se crea la de la semana siguiente. La hora indicada no pone en marcha un agente, y todavía no he configurado la ejecución automática programada. El trabajo previsto aún hay que realizarlo.

Después de escucharlo, quiero incorporar al Procedure mis observaciones sobre la selección de temas, la profundidad de la investigación, las explicaciones, el ritmo o la pronunciación. Tener los pasos a la vista me ayuda a decidir qué cambiar en la siguiente ejecución. Eso era lo que quería probar con nohmitaina: dar una forma repetible a un trabajo que me interesa y mejorarlo al usarlo.

Probar el Procedure con tus propios ajustes

El Procedure compartido en inglés es un flujo general para crear audio privado. Lo exporté desde la aplicación de escritorio y comprobé el archivo importándolo en un Workspace separado.

Descargar el Procedure en inglés (JSON)

Abre la lista de procedimientos en nohmitaina, elige + → Importar procedimiento… y selecciona el archivo JSON descargado. Confirma un nombre y un identificador que aún no esté en uso para el nuevo Procedure.

Antes de ejecutarlo, hay que configurar la conexión propia a Gmail, la selección de fuentes, el acceso del agente, el idioma de salida, la voz, la duración del programa y el presupuesto. La opción de leer desde el Mac también requiere un Mac conectado y disponible, además del permiso para utilizarlo. Gemini TTS necesita una clave de API propia y tiene un coste aparte. Las credenciales deben guardarse en los ajustes del servicio correspondiente, no en el Procedure compartido.

El archivo descargable contiene el flujo de trabajo, con marcadores que debes sustituir por tus propios ajustes. No incluye mis Tasks, el audio, los artículos originales, credenciales ni el historial de ejecución. Revisa las instrucciones y sustituye los marcadores antes de ejecutarlo con tus propias cuentas.