Por Redacción Pangea IA · 8 de septiembre de 2026
Gemini Notebook puede convertir un PDF, unas notas, una presentación o varias páginas web en un resumen de audio parecido a un pódcast. Para obtener algo realmente útil no basta con pulsar «Generar»: hay que seleccionar bien las fuentes, escoger el formato adecuado y explicar a la IA quién va a escuchar el audio y qué debe aprender.
Esta guía enseña el proceso completo para crear un resumen en español, revisarlo y descargarlo. También explica qué información conviene evitar, qué límites tiene la versión gratuita y por qué el resultado debe considerarse una ayuda para comprender documentos, no una grabación infalible ni un sustituto de las fuentes originales.
Qué vas a conseguir
El resultado será un archivo de audio generado a partir de los documentos que tú elijas. Según el formato, una o dos voces sintéticas pueden explicar las ideas principales, preparar un resumen breve, analizar críticamente un texto o enfrentar dos perspectivas. Google llama oficialmente a esta función «Resumen de audio».
Gemini Notebook trabaja sobre las fuentes incluidas en un cuaderno. Esa es su principal diferencia frente a pedir un pódcast genérico a un chatbot: el punto de partida son tus materiales. Si todavía no conoces la herramienta, la guía Gemini Notebook: qué es y cómo funciona ofrece una introducción general. Aquí nos centraremos exclusivamente en convertir documentos en audio.
Requisitos, disponibilidad y límites
- Una cuenta de Google y acceso a Gemini Notebook.
- Al menos una fuente que tengas derecho a utilizar.
- Permiso de edición si trabajas en un cuaderno compartido.
- Preferiblemente, un navegador de ordenador. Google advierte de que algunas funciones pueden estar limitadas en la aplicación móvil.
Gemini Notebook está disponible en navegador para usuarios que hayan alcanzado la edad de consentimiento en los territorios admitidos, entre ellos España. Los resúmenes de audio pueden generarse en más de 80 idiomas, incluidos español de España, catalán, gallego y euskera.
En el acceso Standard sin coste, Google indica un máximo de 100 cuadernos, 50 fuentes por cuaderno y tres resúmenes de audio al día. Los planes Plus, Pro y Ultra elevan esas cuotas. Los límites son susceptibles de cambiar y las cuotas diarias se restablecen al cabo de 24 horas, no necesariamente a medianoche.
Cada fuente puede contener hasta 500.000 palabras y cada archivo subido puede ocupar hasta 200 MB. Se admiten, entre otros formatos, PDF, DOCX, TXT, Markdown, CSV, PowerPoint, ePub, imágenes, archivos de audio, texto pegado, documentos y presentaciones de Google, páginas web y vídeos públicos de YouTube con subtítulos. La aplicación móvil admite una selección más reducida de fuentes.
Antes de empezar: prepara fuentes que se entiendan juntas
La calidad del audio depende más de la selección documental que de una instrucción ingeniosa. Reúne materiales sobre una sola pregunta: por ejemplo, el manual de un producto y tus notas de formación, o un informe y la presentación que lo resume. Mezclar asuntos inconexos obliga al sistema a decidir qué omitir y suele producir una conversación superficial.
Elimina duplicados, versiones antiguas y documentos irrelevantes. Comprueba también que los PDF contienen texto legible; un escaneo borroso puede procesarse mal. Si tus materiales todavía están dispersos, puedes organizarlos primero con el procedimiento de nuestra guía para crear documentos PDF, Word y Excel con Gemini.
No subas información confidencial por comodidad. Google afirma que los datos de cuentas personales no se usan para entrenar Gemini Notebook salvo que el usuario envíe comentarios; en ese caso, la empresa puede revisar el contexto completo de la interacción. Las cuentas de Workspace y Education con las protecciones indicadas por Google tienen condiciones adicionales. En cualquier caso, elimina nombres, teléfonos, datos médicos, secretos comerciales y credenciales si no son imprescindibles.
Cómo crear un pódcast con Gemini Notebook paso a paso
1. Crea un cuaderno y añade las fuentes
Abre Gemini Notebook, crea un cuaderno nuevo y selecciona «Añadir». Sube los archivos o incorpora las fuentes compatibles. Si utilizas Google Drive, los documentos importados se sincronizan automáticamente cada pocos minutos cuando vuelves a abrir el cuaderno; también puedes forzar la sincronización desde la propia fuente.
Una URL aporta únicamente el texto de la página: no incluye imágenes, vídeos insertados ni páginas enlazadas. Los muros de pago no son compatibles. En YouTube solo se importa la transcripción de vídeos públicos con subtítulos, y un vídeo publicado durante las últimas 72 horas puede fallar al añadirlo.
2. Selecciona solo lo que debe entrar en el audio
En el panel «Fuente», marca los documentos que deben servir de base. Este paso evita que un archivo secundario se cuele en la narración. Para un audio de repaso, selecciona el manual y tus apuntes; deja fuera facturas, correos administrativos o versiones antiguas aunque estén guardadas en el mismo cuaderno.
3. Abre Studio y elige «Resumen de audio»
Ve al panel «Studio» y selecciona «Resumen de audio». Se abrirán las opciones de generación. El proceso se ejecuta en segundo plano y, según Google, suele tardar unos minutos. Puedes seguir trabajando en el cuaderno mientras termina.
4. Escoge el formato que corresponda al objetivo
- Información detallada: dos presentadores conectan y explican ideas en una conversación amplia. Es la opción predeterminada y la más adecuada para aprender.
- Resumen: una sola voz presenta los puntos clave en menos de dos minutos. Resulta útil antes de una reunión o para recordar un documento.
- Crítica: dos voces evalúan constructivamente un ensayo, una propuesta o un documento de diseño. No equivale a una revisión profesional.
- Debate: dos presentadores confrontan perspectivas. Funciona mejor cuando las fuentes contienen un desacuerdo real; no conviene forzar una falsa polémica.
5. Configura el idioma
Selecciona «Español (España)» si quieres pronunciación y vocabulario peninsulares. El idioma de salida predeterminado procede de la configuración de tu cuenta de Google, pero puedes cambiarlo en la generación. Las fuentes no tienen que estar todas en español: el sistema puede sintetizar materiales en varios idiomas y producir el audio en el elegido.
Google permite pedir una duración «Más corta», «Predeterminada» o «Más larga», pero documenta este ajuste únicamente para los audios en inglés. En español puedes solicitar brevedad en las instrucciones, aunque no hay garantía de una duración exacta.
6. Personaliza el contenido antes de generar
La petición personalizada debe definir cuatro cosas: quién escucha, qué pregunta debe resolver, qué aspectos son prioritarios y qué debe excluirse. No le pidas una duración exacta ni un guion palabra por palabra; el control es orientativo.
Prepara este audio para una persona sin conocimientos técnicos que debe entender el manual antes de una formación. Explica primero las tres funciones principales, después los pasos de puesta en marcha y termina con los cinco errores que conviene evitar. Define los términos técnicos con palabras sencillas. No incluyas la historia de la empresa ni información comercial. Si las fuentes discrepan, señala la diferencia sin decidir cuál tiene razón.
Esta estructura suele funcionar mejor que «hazme un pódcast interesante» porque reduce decisiones ambiguas. También impide que una introducción secundaria ocupe buena parte del audio.
7. Genera, escucha y contrasta
Inicia la generación y escucha el resultado con las fuentes abiertas. Puedes cambiar la velocidad desde el menú «Más» y continuar consultando documentos mientras suena. Anota cualquier cifra, fecha o afirmación importante y vuelve al pasaje original: un audio fluido puede contener errores, omisiones o una relación causal que el documento no establece.
El menú de tres puntos permite consultar «Ver petición personalizada», útil para recordar con qué instrucciones se creó cada versión. Si el enfoque no es correcto, genera otro audio después de ajustar las fuentes o la petición. Gemini Notebook no es un editor multipista: corregir una frase concreta suele exigir una nueva generación.
8. Descarga o comparte con cuidado
Selecciona «Descargar» para guardar el audio. También puedes compartir un enlace o el cuaderno completo. Hay una diferencia importante: para que otra persona abra el enlace, el cuaderno debe estar compartido con ella o ser público, y los lectores podrán acceder al cuaderno completo. La publicación abierta de cuadernos está disponible para cuentas personales, pero no para Workspace Enterprise o Education.
Antes de compartir, comprueba los derechos de los documentos y escucha el archivo entero. Un resumen generado no elimina derechos de autor, confidencialidad ni obligaciones de protección de datos. Si el audio va a publicarse, explica que las voces y el contenido se han generado con IA.
Ejemplo práctico: transformar un manual en audio de repaso
Imagina que debes aprender a utilizar un nuevo programa antes de una formación. Tienes un manual de 60 páginas, una hoja con atajos y las notas del responsable. Crea un cuaderno, añade las tres fuentes y selecciona «Información detallada». En la petición, identifica al oyente, pide que siga el orden real de trabajo y exige que distinga las instrucciones obligatorias de los consejos.
Al revisar el audio, prepara una lista de comprobación: ¿menciona los requisitos previos?, ¿explica el proceso en orden?, ¿atribuye correctamente las limitaciones?, ¿ha omitido alguna advertencia de seguridad? Si una respuesta es negativa, no intentes arreglarla solo con un adjetivo. Desmarca la fuente irrelevante o añade una instrucción específica y vuelve a generar.
Para una revisión final de dos minutos, crea después una versión «Resumen» con las mismas fuentes y pide únicamente los pasos que debes recordar justo antes de empezar. Así obtendrás dos audios con funciones distintas, no dos versiones redundantes.
Errores frecuentes y cómo resolverlos
- El audio habla demasiado de un tema secundario. Selecciona menos fuentes y nombra en la petición los apartados prioritarios y los que deben omitirse.
- Mezcla información antigua y nueva. Elimina duplicados o deja solo la versión vigente. Comprueba la sincronización de los archivos de Drive.
- Una página web aparece incompleta. Gemini Notebook importa su texto, no las imágenes ni el contenido incrustado. Añade el documento original o pega el fragmento autorizado que falta.
- Un vídeo de YouTube no se carga. Comprueba que sea público, tenga subtítulos y no acabe de publicarse. La ayuda advierte de posibles fallos durante las primeras 72 horas.
- Se ha agotado la cuota. En Standard hay tres generaciones de audio al día y el reinicio se produce al cabo de 24 horas. Espera o revisa el plan asociado a la cuenta.
- Las voces cambian o suenan extrañas. Google reconoce posibles fallos de audio. Regenera el archivo y no uses una versión defectuosa para distribución pública.
Límites y alternativas
Un resumen de audio sirve para orientarse, repasar y detectar temas que conviene estudiar. No conserva todos los matices de un documento ni ofrece citas auditivas verificables. Para decisiones legales, médicas, financieras o de seguridad, vuelve siempre a la fuente y consulta a un profesional cuando corresponda.
El «Modo interactivo» permite intervenir por voz y pedir aclaraciones, pero Google lo limita actualmente al inglés y solo a resúmenes recién creados. Las interacciones y la voz no se almacenan ni se comparten, según la ayuda oficial; los destinatarios de un enlace tampoco pueden usar esa interacción. Pueden producirse retrasos o cambios inesperados de voz.
Si necesitas un guion exacto, edición por frases, voces elegidas, música, licencia comercial clara o publicación automática en plataformas de pódcast, utiliza una herramienta específica de producción de audio. Gemini Notebook resulta más adecuado para comprender y sintetizar fuentes que para terminar una pieza sonora profesional. Para explorar otro uso creativo del audio de Google, consulta nuestra guía para crear canciones con Gemini Lyria, que responde a una necesidad distinta.
Conclusión
La forma más eficaz de convertir documentos en un pódcast con Gemini Notebook consiste en limitar el tema, escoger fuentes coherentes y dar una instrucción pensada para un oyente concreto. El botón genera el audio; el trabajo editorial —seleccionar, enfocar y verificar— determina si merece la pena escucharlo.
Empieza con una versión breve y un conjunto pequeño de documentos. Si el resumen respeta las fuentes, crea después una explicación detallada. Y antes de compartir cualquier archivo, revisa datos, permisos y privacidad: una conversación convincente no deja de ser una síntesis generada por IA.
Fuentes consultadas
- Ayuda oficial de Google: generar un resumen de audio en Gemini Notebook.
- Ayuda oficial de Google: añadir fuentes y formatos admitidos.
- Ayuda oficial de Google: planes, límites y tratamiento de datos.
- Google Labs: expansión de los resúmenes de audio a más idiomas.
- Google Labs: personalización de los resúmenes de audio.
Documentación comprobada el 8 de septiembre de 2026. El procedimiento y los nombres de los controles se han verificado en la ayuda oficial de Google; no se ha ejecutado la generación dentro de una cuenta de Gemini Notebook durante esta revisión. La interfaz y las cuotas pueden cambiar.


Deja una respuesta