En este BLOG podrás aprender y compartir tus conocimientos relacionados al maravilloso mundo de la Tecnología de Internet (TI), a través de diversos tópicos, que en este caso se centran específicamente en las "Herramientas de la Web 3.0" o "Web Semántica".
Ajax, acrónimo de Asynchronous JavaScript And XML (JavaScript asíncrono y XML), es una técnica de desarrollo web para crear aplicaciones interactivas o RIA (Rich Internet Applications). Estas aplicaciones se ejecutan en el cliente, es decir, en el navegador de los usuarios mientras se mantiene la comunicación asincrona con el servidor en segundo plano. De esta forma es posible realizar cambios sobre las páginas sin necesidad de recargarlas, lo que significa aumentar la interactividad, velocidad y usabilidad en las aplicaciones.
Ajax es una tecnología asíncrona, en el sentido de que los datos adicionales se requieren al servidor y se cargan en segundo plano sin interferir con la visualización ni el comportamiento de la página. JavaScript es el lenguaje interpretado (scripting language) en el que normalmente se efectúan las funciones de llamada de Ajax mientras que el acceso a los datos se realiza mediante XMLHttpRequest, objeto disponible en los navegadores actuales. En cualquier caso, no es necesario que el contenido asíncrono esté formateado en XML.
Ajax es una técnica válida para múltiples plataformas y utilizable en muchos sistemas operativos y navegadores dado que está basado en estándares abiertos como JavaScript y Document Object Model (DOM).
Problemas e inconvenientes:
Las páginas con AJAX son más difíciles de desarrollar que las páginas estáticas.
Las páginas creadas dinámicamente mediante peticiones sucesivas AJAX, no son registradas de forma automática en el historial del navegador, así que haciendo clic en el botón de "volver" del navegador, el usuario no será devuelto a un estado anterior de la página, en cambio puede volver a la última página que visitó. Soluciones incluyen el uso de IFrames invisible para desencadenar cambios en el historial del navegador y el cambio de la porción de anclaje de la dirección (después de un #).
Los motores de búsquedas no entienden JavaScript. La información en la página dinámica no se almacena en los registros del buscador.
Hay problemas usando Ajax entre nombres de dominios. Eso es una función de seguridad.
El sitio con Ajax usa más recursos en el servidor.
Es posible que páginas con Ajax no puedan funcionar en teléfonos moviles, PDA u otros aparatos. Ajax no es compatible con todos los software para ciegos u otras discapacidades.
Navegadores que permiten AJAX:
Ha de tenerse en cuenta que ésta es una lista general, y el soporte de las aplicaciones Ajax dependerá de las características que el navegador permita.
Navegadores basados en Gecko como Mozilla, Mozilla Firefox, SeaMonkey, Camino, K-Meleon, IceWeasel, Flock, Epiphany, Galeon yNetscape versión 7.1 y superiores.
Google Chrome.
Microsoft Internet Explorer para Windows versión 5.0 y superiores, y los navegadores basados en él
Navegadores con el API KHTML versión 3.2 y superiores implementado, incluyendo Konqueror versión 3.2 y superiores, Apple Safariversión 1.2 y superiores, y el Web Browser for S60 de Nokia tercera generación y posteriores.
Opera versión 8.0 y superiores, incluyendo Opera Mobile Browser versión 8.0 y superiores.
Navegadores que no permiten AJAX:
Opera 7 y anteriores.
Microsoft Internet Explorer para Windows versión 4.0 y anteriores.
Anteriores a Safari 1.2.
Dillo.
Navegadores basados en texto como Lynx y Links.
Navegadores para personas con capacidades especiales visuales (Braille).
«Archivo RSS» o «Feed RSS» (o «XML») es un archivo generado por algunos sitios web (y por muchos weblogs) que contiene una versión específica de la información publicada en esa web. Cada elemento de información contenido dentro de un archivo RSS se llama "ítem".
Cada ítem consta normalmente de un título, un resumen y un enlace o URL a la página web de origen o que contiene el texto completo. Además puede contener información adicional como la fecha de publicación o el nombre del autor del texto. Es decir, un feed sirve para enterarte de cualquier novedad que se incluya en cualquier sitio web (una nueva noticia en un periódico online, un nuevo post en un blog) puedes, o bien acceder al sitio web cada hora y descubrirlo con tus propios ojos, o bien dejar que un programa informático haga el trabajo por ti.
Para que el programa informático trabaje por ti y descubra si existe alguna novedad que te pueda interesar, los sitios web han comenzado a incluir 'feeds', que son ficheros que contienen la misma información del sitio web, pero estructurada de una manera especial que pueda ser comprendida por ese programa informático.Para enterarte de cualquier novedad que se incluya en cualquier sitio web (una nueva noticia en un periódico online, un nuevo post en un blog) puedes, o bien acceder al sitio web cada hora y descubrirlo con tus propios ojos, o bien dejar que un programa informático haga el trabajo por ti. De esta manera, el programa informático accederá regularmente a leer este 'feed' y te enviará un aviso cuando descubra una novedad, porque significará que hay nuevos contenidos en el sitio web.
'Rich Site Summary (RSS)' es un formato para crear feeds, que transmite la información basándose en el estandar XML. A su vez, los documentos RSS deben cumplir ciertas especificaciones para que todas los programas informáticos sean capaces de poder leerlos. En otras palabras, el archivo RSS se reescribe automáticamente cuando se produce alguna actualización en los contenidos del sitio web. Accediendo al archivo RSS es posible saber si se han actualizado los contenidos y con qué noticias o textos, pero sin necesidad de acceder al sitio web salvo para leer la versión extendida.
Lectores de Feeds
Cada feed o canal de información dispone de su propia dirección en Internet o URL del mismo modo que las páginas HTML convencionales. Sin embargo a diferencia de éstas no se pueden visualizar directamente con el navegador, de modo que es necesario utilizar un lector de feeds.
Los lectores de feeds funcionan de forma similar a los programas de correo electrónico. Pero en lugar de consultar un buzón de correo cada cierto tiempo para coger los mensajes consultan periódicamente las direcciones de los feeds para obtener la última versión disponible de su archivo RSS.
Para ello, existen varios programas que permiter leer noticias RSS: -NewzCrawler (MS Windows) -FeedReader (MS Windows) -AmphetaDesk (Mac OS X, MS Windows, Linux) -HotSheet (Mac OS X, MS Windows, Linux)
Actualmente, existen infinidad de métodos de extracción y gestión de datos de un repositorio de información o Base de Datos (BD), y en este artículo quisiera hablarles específicamente de dos que he conocido recientemente: ETL y XQuery.
Quizá ambos métodos o tecnologías tengan diferencias radicales, pero lo importante en este caso son sus similitudes, y si hablamos de ellas ¿cuál es la principal? ¡pues sus objetivos!. Ambas están creadas con el firme propósito de ayudarnos a tratar la información de una manera eficiente. Ahora les hablaré un poco de cada una de ellas.
ETL
Las siglas ETL no me parecían conocidas, pero me encontré con ellas mientras investigaba para un proyecto laboral, me recomendaron firmemente esta tecnología como la solución a mi proyecto. Para que tengan idea del contexto, se trata de un proyecto, es un sistema que deberá ser el repositorio de información migrada de distintos sistemas, deberá homologarla, permitir gestionarla, exportarla a otro sistema y luego, lo que parece más complejo, recibirla de vuelta para actualizarla. Todo esto, bajo premisas de cuidar los recursos, el desempeño de los sistemas que interactúan con éste, la correctitud de la información, etc., entonces, según, ETL resuelve parte de estos requerimientos.
Procedí a buscar sobre ETL, y tenemos su definición, tal cual la publiqué en el Glosario del grupo de Tecnología en Internet, que es:
"Sus siglas en inglés significan: Extract, Transform and Load (extracción, transformación y carga), y se ubica en el contexto de administración de sistemas de información y almacenes de datos.
Es el proceso que permite a las organizaciones mover datos desde múltiples fuentes, re-formatearlos y limpiarlos, y cargarlos en otra base de datos, data mart, o data warehouse para analizar, o en otro sistema operacional para apoyar un proceso de negocio."
Luego de ver esto, parece tener sentido su aplicación en lo que necesito, y lo principal que hay que decir, es que es una herramienta BI (Business Intelligence), para aplicar ETL, nos podemos valer de diversas herramientas, la que yo investigué se llama Pentaho.
Al final de este artículo, encontrarán enlaces a documentos interesantes al respecto, algunos en español. A continuación, les dejo una presentación que está en inglés pero es bastante descriptiva de ETL:
XQuery
Otra herramienta que nos ofrece capacidades atractivas para el manejo de datos es XQuery. Según el concepto que encontré para el glosario de términos del Aula Virtual, su definición es la siguiente:
"Es un lenguaje de consulta que proporciona los medios para extraer y manipular información de documentos XML o de cualquier fuente de datos que pueda ser representada mediante XML, como por ejemplo Bases de Datos relacionales o documentos ofimáticos.
Es semánticamente similar a SQL, pero incluye algunas capacidades de programación."
En este particular, podemos observar a simple vista que combina dos herramientas comúnmente utilizadas por los programadores de sistemas, como lo son XML y SQL (en semántica), y ambas son tecnologías fuertemente difundidas, por lo cual podemos a priori suponer que XQuery ofrece muchas bondades.
XQuery es un lenguaje de programación funcional que consta en su totalidad de expresiones. No hay sentencias, aun cuando algunas de las palabras claves utilizadas puede sugerir un comportamiento similar al de una sentencia.
A continuación, un video donde explican, una de las aplicaciones de XQuery, con WebServices:
Por último, encontré un concepto muy útil que complementa lo relacionado a la extracción y manipulación de datos de forma efectiva, y que también dejé una breve descripción de él en el Glosario, se trata de la Minería de Datos Minería de Datos
La minería de datos (DM, Data Mining) consiste en la extracción no trivial de información que reside de manera implícita en los datos. Dicha información era previamente desconocida y podrá resultar útil para algún proceso. En otras palabras, la minería de datos prepara, sondea y explora los datos para sacar la información oculta en ellos.
Bajo el nombre de minería de datos se engloba todo un conjunto de técnicas encaminadas a la extracción de conocimiento procesable, implícito en las bases de datos. Está fuertemente ligado con la supervisión de procesos industriales ya que resulta muy útil para aprovechar los datos almacenados en las bases de datos.
Las bases de la minería de datos se encuentran en la inteligencia artificial y en el análisis estadístico. Mediante los modelos extraídos utilizando técnicas de minería de datos se aborda la solución a problemas de predicción, clasificación y segmentación.
¿Alguna vez has querido personalizar un video en línea mediante la adición de sus propios comentarios o subtítulos en cualquier idioma, o quería enviar una postal de vídeo personalizado?
Overstream es un servicio en línea que ofrece al usuario la posibilidad de adicionar leyendas o etiquetas a los videos youtube. Todo esto es posible gracias a que Overstream brinda al usuario el servicio de un editor en línea, con el cual usted puede crear fácilmente y sincronizar los subtítulos a cualquier de vídeo en línea, guardarlos en el servidor Overstream, y enviar el enlace al vídeo subtitulado overstream a tus amigos.
Se pueden subtitular videos a partir de una lista de proveedores de video soportados por Overstream. Por el momento, YouTube, Google Video, MySpace Video, Veoh, Blip.tv, Archive.org y Vimeo.com son compatibles. Esta lista seguirá creciendo.
Tutorial:
A continuación les dejo un video tutorial, que les enseñara como crear subtítulos a sus videos haciendo uso del Servicio Overstream: