Mostrando entradas con la etiqueta inteligencia artificial. Mostrar todas las entradas
Mostrando entradas con la etiqueta inteligencia artificial. Mostrar todas las entradas

viernes, 19 de octubre de 2012

Reconocimiento automático del habla



El reconocimiento automático del habla (RAH) o reconocimiento automático de voz es una parte de la inteligencia artificial que tiene como objetivo permitir la comunicación hablada entre los seres humanos y los ordenadores.
Es una herramienta computacional capaz de procesar la señal de voz emitida por el ser humano y reconocer la información contenida en ella, convirtiéndola en texto o emitiendo órdenes.


Los sistemas de reconocimiento de voz pueden clasificarse según los siguientes criterios:
  • Entrenabilidad: determina si el sistema necesita un entrenamiento previo antes de empezar a usarse.
  • Dependencia del hablante: determina si el sistema debe entrenarse para cada usuario o es independiente del hablante.
  • Continuidad: determina si el sistema puede reconocer habla continua o el usuario debe hacer pausas entre palabra y palabra.
  • Robustez: determina si el sistema está diseñado para usarse con señales poco ruidosas o si puede funcionar aceptablemente en condiciones ruidosas.
  • Tamaño del dominio: determina si el sistema está diseñado para reconocer lenguaje de un dominio reducido o extenso.

Aunque cualquier tarea en la que se interactúe con un ordenador puede utilizar el reconocimiento de voz, las siguientes aplicaciones son las más comunes:
  • Dictado automático: El dictado automático es el uso más común de las tecnologías de reconocimiento de voz. En algunos casos, como en el dictado de recetas médicas y diagnósticos o en el dictado de textos legales, se usan corpus especiales para incrementar la precisión del sistema.
  • Control por comandos: Se trata de los sistemas de reconocimiento de habla diseñados para dar órdenes a un computador (por ejemplo, «cerrar ventana»).
  • Telefonía: Algunos sistemas permiten a los usuarios ejecutar comandos mediante el habla en vez de pulsar tonos.
  • Sistemas portátiles: Los sistemas portátiles de pequeño tamaño, como los relojes o los teléfonos móviles, tienen unas restricciones muy concretas de tamaño y forma, así que el habla es una solución natural para introducir datos en estos dispositivos.
  • Sistemas diseñados para discapacitados: Los sistemas de reconocimiento de voz pueden ser útiles para personas con discapacidades que les impidan teclear con fluidez, así como para personas con problemas auditivos, que pueden usarlos para obtener texto escrito a partir de habla.


lunes, 8 de octubre de 2012

La lingüística computacional



La lingüística computacional (o lingüística informática) es un campo científico interdisciplinar cuyo objetivo radica en incorporar en los ordenadores la habilidad de manejo del lenguaje humano.
Desde el punto de vista de su vinculación a la informática, y también por motivos históricos, la lingüística com­putacional suele ser considerada como una subdisciplina de la inteligencia artificial, que es una subdisciplina de la informática que se ocupa de la comprensión de la inteligencia y del diseño de maquinas inteligentes, es decir, de maquinas que presentan características que se relacionan con el entendimiento hu­mano, como el raciocinio, la comprensión del lenguaje hablado y escrito, el aprendizaje o la toma de decisiones.
Por otra parte, desde el punto de vista de su vinculación a la lingüística, la lingüística computacional puede ser considerada una su disciplina de la lingüística teórica debido a que uno de sus objetivos es la elaboración de modelos formales (e implementables informáticamente) del lenguaje humano.
Por último, la lingüística computacional forma parte de las denominadas industrias de la lengua, un sector in­dustrial cada vez más amplio que proporciona datos y programas informáticos aplicados al tratamiento del len­guaje. Datos tales como diccionarios electrónicos e impresos, bancos de datos terminológicos y pro­gramas tales como sistemas de traducción automática o correctores ortográficos y estilísticos. Esta actividad vincula la lingüística computacional con la lingüística aplicada, que es una rama de la lingüística dedicada a aplicar los resultados y métodos de la investigación lingüística en campos como la enseñanza de idiomas, la traducción o la interpretación.

Fuente: Gómez Guinovart, Javier: Fundamentos de Lingüística Computacional: bases teóricas, líneas de investigación y aplicaciones, Universidad de Vigo. [Consultado en línea: http://www.raco.cat/index.php/Bibliodoc/article/viewFile/56629/66051]

viernes, 31 de agosto de 2012

Web 1.0, Web 2.0 y Web 3.0


La Web 1.0 empezó en los ‘60 de la forma más básica que existe, con navegadores de sólo texto como ELISA. Después surgió el HTML (Hyper Text Markup Language) que hizo las páginas más agradables a la vista, así como los navegadores visuales.
La Web 1.0 era de sólo lectura. El usuario no podía interactuar con el contenido de la página y estaba totalmente limitado a lo que el Webmaster sube a esta. La información se movía unidireccionalmente, es decir, de las webs a las personas. Además, las páginas web eran estáticas y no eran actualizadas frecuentemente.


El término Web 2.0 surgió en el año 2004 y fue acuñado por Tim O’Reilly en 2004. Se refiere a una segunda generación de Web basada en comunidades de usuarios y una gama especial de servicios, como las redes sociales, los blogs, los wikis o las folcsonomías, que fomentan la colaboración y el intercambio ágil de información entre los usuarios, donde el estaticismo de las páginas pasa a transformarse en una matriz de interacción del usuario con la red pudiendo él mismo incluir su propia información en el sistema.
Se entiende a la Web 2.0 como «todas aquellas utilidades y servicios de Internet que se sustentan en una base de datos, la cual puede ser modificada por los usuarios del servicio».
Algunas de las ventajas de la Web 2.0 son:
§  Interactividad: se posibilita la comunicación total y la interacción.
§  Aprendizaje colaborativo: la Web 2.0 propicia el trabajo en grupo y el cultivo de actitudes sociales.
§  Multidireccionalidad: los documentos, opiniones y respuestas tienen simultáneamente diferentes y múltiples destinatarios.
§  Libertad de edición y difusión: todos los internautas pueden editar sus trabajos y difundir sus ideas.


El término Web 3.0 es asociado por la prensa al concepto de Web semántica que se está desarrollando bajo la tutela de Tim Berners-Lee, quien inventó la Web a principios de los ‘90. Algunas características que diferencian esta etapa de las anteriores son la transformación de la estructura Web actual en la de Web semántica, la utilización de inteligencia artificial, la prevalencia del usuario en la creación, organización y rendimiento del contenido a través de un modelo de cooperación globalizada y la potenciación de nuevas formas de ocio y comunicación entre usuarios.
El primer paso hacia la Web 3.0 es el nacimiento de la Data Web, ya que los formatos en los que se publica la información en Internet son dispares, como XML, RDF y microformatos; el reciente crecimiento de la tecnología SPARQL permite un lenguaje estandarizado y API para la búsqueda a través de bases de datos en la red. La "Data Web" permite un nuevo nivel de integración de datos y aplicación interoperable, haciendo los datos tan accesibles y enlazables como las páginas web. La Data Web es el primer paso hacia la completa Web Semántica.