Mostrando entradas con la etiqueta voz. Mostrar todas las entradas
Mostrando entradas con la etiqueta voz. Mostrar todas las entradas

lunes, 21 de julio de 2025

💻 Nuevo método NaturalVoiceSAPIAdapter voces Microsoft(2025)!

    Hola Gente, qué tal les va!?

Muy atentos, hoy Libardo Nova nos enseña un nuevo procedimiento para usar las voces naturales de Microsoft Azure en cualquier aplicación que utilice síntesis de voz, a través de NaturalVoiceSAPIAdapter.

Pero, ¿Qué es ¿NaturalVoiceSAPIAdapter?

NaturalVoiceSAPIAdapter es un motor de texto a voz (TTS) SAPI 5 que nos permite usar las voces naturales y neuronales del servicio Azure AI Speech en cualquier aplicación que utilice síntesis de voz.

 

¿Qué voces admite?

• Voces naturales descargadas para NaturalVoiceSAPIAdapter. Son independientes de las instaladas en el Narrador de Windows 11

• Voces naturales en línea de la función "Leer en voz alta" de Microsoft Edge

• Voces naturales en línea del servicio Azure AI Speech (con clave de suscripción)

¿Qué programas pueden usar estas voces?

Cualquier lector de pantalla o programa compatible con voces SAPI 5 las puede usar a través de este motor TTS, por ejemplo, NVDA; Jaws; Balabolka, Bookworm).

 

Preguntas frecuentes

¿Puedo usar las voces del Narrador de Windows 11 en Windows 10?

Sí. Si se descargan y configuran las voces, tal y como se explica en el tutorial, funcionan en cualquier versión de Windows 10.

¿Funcionan en Windows XP?

Sí. Si se descargan y configuran las voces, tal y como se explica en el tutorial, también funcionan en Windows XP

¿Funcionan en versiones futuras de Windows?

Probablemente sí porque ahora se descargan las voces que son funcionales con NaturalVoiceSAPIAdapter, las cuales son independientes de las que se instalan en el Narrador.

 

¿Qué necesitamos para utilizar NaturalVoiceSAPIAdapter?

• cualquier versión de Windows x86 (32)/64 bits.

• Descargar las voces indicadas para NaturalVoiceSAPIAdapter

• Tener instalado el navegador Microsoft Edge (necesario para usar las voces online).

 

Tutorial: 💻 Nuevo método NaturalVoiceSAPIAdapter voces Microsoft(2025)!

En este tutorial Libardo nos mostrará:

• Cómo descargar la última versión de NaturalVoiceSAPIAdapter desde su página de lanzamientos en GitHub

• Cómo descomprimir, cortar y pegar la carpeta de NaturalVoiceSAPIAdapter, preferiblemente en la raíz de la unidad donde está instalado el sistema operativo

• Cómo ejecutar el instalador de NaturalVoiceSAPIAdapter, Para ir primero a la página de Enlaces de descarga de las voces naturales del narrador

• Cómo navegar por la tabla de las voces disponibles y funcionales para NaturalVoiceSAPIAdapter

• Cómo descargar cada voz de forma independiente

• Cómo cambiar la extensión .msix por .rar de cada archivo de voz descargado

• Cómo descomprimir en una carpeta cada archivo de voz

• Cómo recortar y pegar cada carpeta de voz en la raíz d la unidad C, dentro de una carpeta principal

• Cómo modificar un archivo .ini de las voces en español para mejorar su verbalización española

• Cómo configurar la ruta de la carpeta de las voces en el instalador de NaturalVoiceSAPIAdapter

• Cómo agregar a la lista las voces de Microsoft Edge que vamos a usar online

• Cómo instalar NaturalVoiceSAPIAdapter simultáneamente para 32 y 64 bits siguiendo las recomendaciones

•   Dónde desinstalar eventualmente alguna de las arquitecturas instaladas

• Indicaciones importantes sobre la carpeta dónde se encuentran las voces que fueron descargadas

• demostración del funcionamiento de las voces neurales, tanto locales como online, en el lector de pantalla NVDA

 

La descarga.

Les dejaremos en la descarga:

• El audio tutorial (en los canales Odysse y YouTube estará en video tutorial)

• Enlace de descarga directa de la carpeta de las cuatro voces en español. Listas para ser usadas con NaturalVoiceSAPIAdapter

• Link a la página de lanzamientos de NaturalVoiceSAPIAdapter

 

Esperamos les sea de mucha utilidad y que lo disfruten.

Este es un excelente programa muy sencillo, para poder utilizar las voces naturales neurales MS Asure, tanto en nuestros lectores de pantalla favoritos, como en cualquier programa de texto a voz TTS (tipo Balabolka).

Y ya sabes, Si te gusta este contenido,

Apóyanos haciendo una donación.

Dona aquí en Paypal

compártelo en: Facebook, X.

Deja un comentario sobre esta entrada.

Síguenos en X:

Abajo tienes el botón.

Suscríbete al blog:

 

Ahora puedes unirte a nuestros grupos de WhatsApp o Telegram:

Puedes escribir al mail del blog con tus datos si deseas ingresar a los mismos.

Escucha todos nuestros audio tutoriales, cómodamente:

Entrando desde aquí a nuestro canal en Youtube:

 

Ahora también, en nuestro canal en Odysse:

Entra al canal de Tecnoconocimiento Accesible en Odysse:

O si prefieres escúchanos en:

Anchor:

Escúchanos en Anchor:

Ahora puedes seguirnos también en Facebook

Entra al Facebook de Tecnoconocimiento Accesible:

Ponte en contacto con nosotros, déjanos tus sugerencias, dudas, o comentarios,

abajo tienes un sencillo formulario,

o si lo prefieres,

 escríbenos al correo del blog:

tecnoconocimientoaccesible@gmail.com

Los aportes siempre serán bienvenidos.

cuando nos escribas por uno de los medios con alguna sugerencia, se publicará con tu nombre.

además, como ya se sabe, puedes publicar esta entrada en otro sitio, pero no te olvides citar la fuente.

Saludos, y hasta otro post.

Descargaaquí el audiotutorial

Descargaaquí la carpeta con las cuatro voces en español                            

Página de lanzamientos de NaturalVoiceSAPIAdapter


lunes, 23 de junio de 2025

Gemini 2.5 Speech Generation, Voces (IA) super realistas!

Hola gente, ¿qué tal les va?

Muy atentos, nueva función de Gemini 2.5: Native Speech Generation!

Pero ¿Qué es Native Speech Generation?

En mayo de 2025, Google presentó en su evento I/O una de sus funciones más destacadas: la generación nativa de voz (Native Speech Generation), integrada en Gemini 2.5 y disponible directamente desde Google AI Studio.

Native Speech Generation es una tecnología de texto a voz (TTS) que permite convertir texto en audio de forma natural, expresiva y personalizable. No solo transforma el texto en voz, sino que lo hace controlando el estilo, el tono y las emociones mediante instrucciones escritas en lenguaje natural. Por ejemplo, puedes pedir que la voz suene “alegre”, “seria”, “susurrando” o con un acento específico.

Además, ofrece dos modos de generación:

•

Single-speaker: la narración completa es realizada por una sola voz.

•

Multi-speaker: permite combinar hasta dos voces diferentes en un mismo audio, ideal para diálogos, podcasts o narraciones más dinámicas.

Principales ventajas

•

Calidad de audio en alta definición y baja latencia, ideal para respuestas en tiempo real.

•

Narraciones naturales: con pausas, ritmo y entonación similares al habla humana.

•

Aplicaciones accesibles: mejora la lectura de contenido para personas con discapacidad visual.

•

Multilingüe y con variedad de acentos, adaptado a un mundo global.

•

Integración directa en el flujo de trabajo dentro de Google AI Studio, sin necesidad de herramientas externas.

¿Por qué es tan relevante?

A diferencia de las voces robóticas del pasado, esta tecnología logra un nivel de realismo impresionante. Gracias al uso de redes neuronales avanzadas y aprendizaje profundo, las voces no solo suenan claras, sino también humanas y emocionales. Esto abre un mundo de posibilidades para desarrolladores, creadores de contenido, educadores y proyectos inclusivos.

 

Hoy te vamos a enseñar, como utilizar esta fantástica herramienta, de forma sencilla, accesible y totalmente gratuita.

 

¿Qué necesitamos para utilizar: Native Speech Generation?

Solo necesitaremos:

• Una cuenta de Google (Gmail).

• Un navegador de internet (mejor los basados en chromium).

• Conexión a internet.

 

Tutorial: Gemini 2.5 Speech Generation, Voces (IA) super realistas!

En este tutorial les mostraré:

• Recomendación de que, navegadores utilizar para que este servicio (Native Speech Generation) funcione de forma correcta.

• Como llegar mas rápido al botón: Native Speech Generation, en Google AI Studio.

• Como convertir de texto a voz (TTS) en el modo Single Speaker Audio (una sola voz o persona).

• Como darle las instrucciones para que la voz se comporte o tenga las inflexiones que nosotros le indiquemos.

• Como escribir, o pegar el texto del diálogo que deseamos que convierta Speech Generation.

• Como seleccionar el modelo de Gemini a utilizar para la conversión TTS.

• Como seleccionar una voz.

• Como lanzar la conversión (Run Prompt).

• Como descargar el archivo de audio resultante de la conversión de texto a voz con: Speech Generation.

• Como crear un diálogo con Speech Generation (modo Multi Speaker Audio).

• Muestra de como estructurar el texto, para que Gemini Speech Generation, lo interprete como un diálogo entre dos personas.

• Como colocar el texto que queremos convertir a voz (en el Speaker 1).

• Como cambiar el nombre del Speaker 1 y el Speaker 2.

• Como seleccionarlas voces 1 y la 2.

• Ejecución, muestra del diálogo, descarga del audio resultante.

 

La descarga.

Les dejaré en la descarga:

• El audio tutorial (en los canales Odysse y YouTube estará en video tutorial).

• Link a la web de: Google AI Studio.

 

Espero disfruten de este fantástico servicio de Google que sigue creciendo en cuestión de inteligencia artificial.

Estas voces, y generar estos diálogos es de lo más realista que habíamos podido conocer en materia de TTS. Espero le saquen todo el partido, seguramente así será.

 

Y ya sabes, Si te gusta este contenido,

Apóyanos haciendo una donación:

Dona aquí en PayPal.

compártelo en: Facebook, X.

Deja un comentario sobre esta entrada.

Síguenos en X:

Abajo tienes el botón.

Ahora puedes seguirnos también en Facebook:

Entra aquí a nuestro Facebook.

Suscríbete al blog:

Ahora puedes unirte a nuestros grupos de WhatsApp o Telegram:

Puedes escribir al mail del blog con tus datos si deseas ingresar a los mismos.

Escucha todos nuestros audio tutoriales, cómodamente:

Entrando desde aquí, a nuestro canal en YouTube.

Ahora también, en nuestro canal en Odysse:

Entra al canal de Tecnoconocimiento Accesible en Odysse.

O si prefieres escúchanos en:

Anchor:

Escúchanos en Anchor.

Ponte en contacto con nosotros, déjanos tus sugerencias, dudas, o comentarios,

abajo tienes un sencillo formulario,

o si lo prefieres,

 escríbenos al correo del blog:

tecnoconocimientoaccesible@gmail.com

Los aportes siempre serán bienvenidos.

cuando nos escribas por uno de los medios con alguna sugerencia, se publicará con tu nombre.

además, como ya se sabe, puedes publicar esta entrada en otro sitio, pero no te olvides citar la fuente.

Saludos, y hasta otro post.

 

Descarga aquí el tutorial.

 

Ve aquí a Google AI Studio.


lunes, 3 de febrero de 2025

💻 Crea tus covers Cambiando la voz de una canción con IA en Replay!

Hola gente, ¿qué tal les va?

Muy atentos. Hoy Libardo Nova nos trae el séptimo de una serie de tutoriales relacionados con modelos de voz; inferencias; clonaciones y conversión de texto a voz utilizando la inteligencia artificial.

En los dos primeros tutoriales y, en el quinto: aprendimos a convertir de texto a voz utilizando como referencia, un archivo de audio.

En los tutoriales 3 y 4 aprendimos a convertir de texto a voz, utilizando como referencia modelos de voz. En el Tutorial 6 aprendimos a descargar modelos de voz a través de la plataforma Weights.

   En el tutorial de hoy aprenderemos a utilizar esos modelos para crear covers. Dicho de otro modo, aprenderemos a convertir de voz a voz a través de la aplicación Replay, reemplazando su voz original por la de un modelo RVC.

 

Nota Aclaratoria:

En este tutorial se proporciona información general sobre el uso de modelos de voz en Replay con fines didácticos. De manera personal, cada usuario es responsable de lo que haga con esta herramienta. Por lo tanto, Tecnoconocimiento Accesible no se hace responsable por cualquier mal uso o consecuencia derivada de la misma.

¿Qué es Replay?

Replay es una herramienta de inteligencia artificial que utiliza modelos de voz para crear covers musicales de manera sencilla y divertida.

Además de usar modelos de voz procedentes de cualquier lugar, Replay también nos permite crear nuestros modelos, bien sea de nuestra propia voz, o el de nuestro artista favorito.

Tutorial: 💻Crea tus covers Cambiando la voz de una canción con IA en Replay!

En este tutorial Libardo nos mostrará:

• Cómo descargar e instalar Replay.

• Ruta donde se deben colocar los modelos de voz previamente descargados.

• Cómo cargar en Replay el audio de una canción o locución para reemplazar su voz.

• Cómo quitar un audio previamente cargado para subir otro.

• Cómo seleccionar el modelo de voz que se usará para realizar la inferencia.

• Cómo quitar un modelo de voz previamente cargado para seleccionar otro.

• Cómo ajustar el tono que se usará en la inferencia (grave para voces masculinas, agudo para voces femeninas).

• Otras configuraciones relacionadas con el tipo de audio cargado, cantidad de audio procesado, eco y reverberación.

• Cómo realizar y reproducir el resultado de la inferencia.

• Cómo descargar el audio creado.

• Cómo quitar del historial los audios creados.

La Descarga.

Les dejaré en la descarga:

• El audio tutorial (en los canales   Odysse y YouTube estará en video tutorial).

• Link directo a la web de Replay para su descarga.

 

Y ya sabes, Si te gusta este contenido,

compártelo en: Facebook; X e Instagram.

Deja un comentario sobre esta entrada.

Síguenos en X:

Ahora también nos puedes seguir en Facebook:

Entra al Facebook de Tecnoconocimiento Accesible:

Abajo tienes el botón.

Suscríbete al blog:

Para solicitar el ingreso a nuestros grupos de WhatsApp o Telegram:

Puedes escribir al mail del blog con tus datos si deseas ingresar a los mismos.

Escucha todos nuestros audios tutoriales, cómodamente:

Entrando desde aquí en nuestro canal en you tube:

Ahora también, en nuestro canal en   Odysse

Entra al canal de Tecnoconocimiento Accesible en Odisse:

O si prefieres escúchanos en: Anchor:

Escúchanos en Anchor:

Ponte en contacto con nosotros, déjanos tus sugerencias, dudas, o comentarios,

abajo tienes un sencillo formulario,

o si lo prefieres,

 escríbenos al correo del blog:

tecnoconocimientoaccesible@gmail.com

Los aportes siempre serán bienvenidos.

cuando nos escribas por uno de los medios con alguna sugerencia, se publicará con tu nombre.

además, como ya se sabe, puedes publicar esta entrada en otro sitio, pero no te olvides citar la fuente.

Saludos, y hasta otro post.

 

Descarga aquí el audio tutorial.

Link a la web oficial de Replay.

 

lunes, 6 de enero de 2025

💻🎙️ Equalizer APO; Amplificar el volumen de altavoz y micrófono!

 Hola gente, ¿qué tal les va?

Muy atentos. Hoy Libardo Nova nos trae un tutorial para poder amplificar, tanto el volumen de los altavoces cómo del micrófono del computador🎙️. Muy útil sobre todo en aquellos casos dónde el micrófono se escucha muy bajo.

¿Qué es Equalizer APO?

Equalizer APO Es un ecualizador grafico de código abierto para Microsoft Windows y se encuentra gratuitamente disponible para descargar. Es muy liviano y utiliza recursos mínimos del sistema.

Viene con filtros ilimitados; compatibilidad con múltiples canales, tiempos de respuesta rápidos y una interfaz muy fácil de usar que también admite la integración de complementos VST.

¿Qué necesitamos para amplificar el volumen de los altavoces y el micrófono en Windows?

• Descargar e instalar Equalizer APO.

• Disponer de altavoces y micrófono en el computador.

Tutorial Equalizer APO; Amplificar el volumen de los altavoces y el micrófono!

En este tutorial Libardo nos mostrará:

• Cómo descargar la ultima versión del programa desde su web oficial.

• Instalar Equalizer APO.

• Seleccionar los dispositivos de entrada y salida a los que les vamos a amplificar su volumen.

• Buscar la ruta de la carpeta de Equalizer APO en archivo de programas.

• Cómo crearles un acceso directo en el escritorio a los archivos “editor.exe” y “device selector.exe”.

• Cómo editar los accesos directos.

• Cómo amplificar en tiempo real el volumen de los altavoces y el micrófono.

 

La Descarga.

• Les dejaré en la descarga:

• El audio tutorial (en los canales Odysse y YouTube estará en video tutorial).

• Link a la web de Equalizer APO para su descarga.

Y ya sabes, Si te gusta este contenido, compártelo en: Facebook; X e Instagram.

Deja un comentario sobre esta entrada.

Síguenos en X:

Abajo tienes el botón.

Suscríbete al blog.

Ahora puedes unirte a nuestros grupos de WhatsApp o Telegram.

Puedes escribir al mail del blog con tus datos si deseas ingresar a los mismos.

Escucha todos nuestros audios tutoriales, cómodamente:

Entrando desde aquí, a nuestro canal en YouTube.

Ahora también, en nuestro canal en Odysse:

Entra al canal de Tecnoconocimiento Accesible en Odysse.

O si prefieres escúchanos en:

Anchor:

Escúchanos en Anchor.

Ponte en contacto con nosotros, déjanos tus sugerencias, dudas, o comentarios,

abajo tienes un sencillo formulario,

o si lo prefieres,

 escríbenos al correo del blog:

tecnoconocimientoaccesible@gmail.com

Los aportes siempre serán bienvenidos.

cuando nos escribas por uno de los medios con alguna sugerencia, se publicará con tu nombre.

Además, como ya se sabe, puedes publicar esta entrada en otro sitio, pero no te olvides citar la fuente.

Saludos, y hasta otro post.

Descarga aquí el audio tutorial.

Descarga Equalizer APO desde su web oficial:

lunes, 23 de diciembre de 2024

WasapiRecording1.1: Graba Voz y Sonido sin Mezcla Estéreo!

Hola gente, ¿qué tal les va?

Hoy muy atentos. Nueva aplicación creada por Héctor Benítez: WasapiRecording 1.1!

Pero ¿Qué es WASAPIRecording?

¿Sabías que puedes grabar audio desde tu micrófono y el sistema sin necesidad de tener habilitada la opción de mezcla estéreo (stereo mix) en tu equipo? Con WasapiRecordingv1.1, esta limitación queda en el pasado.

Esta herramienta aprovecha la tecnología WASAPI (Windows Audio Session API) para capturar directamente el sonido del sistema (loopback) y el micrófono de forma simultánea. ¿El resultado? Una experiencia de grabación completa y sin complicaciones, ideal para podcasts, reuniones o cualquier tipo de proyecto de audio.

Principales ventajas de WasapiRecordingv1.1:

• Sin mezcla estéreo: No importa si tu equipo no cuenta con esta función, podrás grabar tanto tu voz como el sonido que reproduce tu PC.

• Configuración avanzada: Elige entre múltiples formatos (MP3, WAV, FLAC, OGG, AIFF), ajusta la calidad de grabación y configura el bitrate.

• Grabaciones separadas: Guarda las pistas de micrófono y sistema como archivos independientes con un solo clic.

• Fácil de usar: Interfaz intuitiva diseñada tanto para principiantes como para usuarios experimentados.

 

Requisitos para usar WasapiRecording1.1:

• WasapiRecordingv1.1 funciona en sistemas operativos Windows 10 o superior.

• Es portable y funciona tanto en arquitecturas de 32, como 64 bits.

 

Tutorial: WasapiRecording1.1: Graba Voz y Sonido sin Mezcla Estéreo!

En este tutorial les mostraré:

• Recorrido por la interfaz de WasapiRecording, muestra de sus controles (elegir dispositivos de entrada y salida, formato, y más).

• Primera prueba de grabación.

• Muestra de la carpeta donde se guardan los archivos resultantes.

• Muestra de grabar con la casilla Mezcla monoaural habilitada.

• Muestra de iniciar y detener la grabación, con el atajo de teclado global (desde cualquier ventana de Windows).

• Muestra de grabar micrófono y audio del sistema separados.

 

 

La descarga.

Les dejaré en la descarga:

• El audio tutorial (en los canales Odysse y YouTube estará en video tutorial).

• Link al repositorio de WasapiRecording en GitHub.

• Link a los lanzamientos (releases) de WasapiRecording, para descarga de la última versión del programa.

 

Espero les sea de mucha utilidad.

Este es otra opción para poder grabar sin necesidad de mezcla estéreo tanto nuestro micrófono, como los sonidos del sistema, de una forma sencilla.

Otra aplicación útil creada por Héctor Benítez.

Desde aquí agradecemos a Héctor en nombre de todos los seguidores de Tecnoconocimiento Accesible, por todos los aportes al colectivo de verdad muchísimas gracias.

 

Y ya sabes, Si te gusta este contenido,

compártelo en: Facebook, X.

Deja un comentario sobre esta entrada.

Síguenos en X:

Abajo tienes el botón.

Suscríbete al blog:

Ahora puedes unirte a nuestros grupos de WhatsApp o Telegram:

Puedes escribir al mail del blog con tus datos si deseas ingresar a los mismos.

Escucha todos nuestros audio tutoriales, cómodamente:

Entrando desde aquí, a nuestro canal en YouTube.

Ahora también, en nuestro canal en Odysse:

Entra al canal de Tecnoconocimiento Accesible en Odysse.

O si prefieres escúchanos en:

Anchor:

Escúchanos en Anchor.

Ponte en contacto con nosotros, déjanos tus sugerencias, dudas, o comentarios,

abajo tienes un sencillo formulario,

o si lo prefieres,

 escríbenos al correo del blog:

tecnoconocimientoaccesible@gmail.com

Los aportes siempre serán bienvenidos.

cuando nos escribas por uno de los medios con alguna sugerencia, se publicará con tu nombre.

además, como ya se sabe, puedes publicar esta entrada en otro sitio, pero no te olvides citar la fuente.

Saludos, y hasta otro post.

 

Descarga aqí el tutorial.

 

Link a los lanzamientos (releases) de WasapiRecording, para descarga de la última versión del programa.

 

Ve aquí al repositorio.