<?xml version="1.0" encoding="ISO-8859-1"?><article xmlns:mml="http://www.w3.org/1998/Math/MathML" xmlns:xlink="http://www.w3.org/1999/xlink" xmlns:xsi="http://www.w3.org/2001/XMLSchema-instance">
<front>
<journal-meta>
<journal-id>1997-4044</journal-id>
<journal-title><![CDATA[Revista de Información, Tecnología y Sociedad]]></journal-title>
<abbrev-journal-title><![CDATA[RITS]]></abbrev-journal-title>
<issn>1997-4044</issn>
<publisher>
<publisher-name><![CDATA[Msc. Aldo Ramiro Valdez Alvarado]]></publisher-name>
</publisher>
</journal-meta>
<article-meta>
<article-id>S1997-40442014000100010</article-id>
<title-group>
<article-title xml:lang="es"><![CDATA[Usos y funciones de Lexibot]]></article-title>
</title-group>
<contrib-group>
<contrib contrib-type="author">
<name>
<surname><![CDATA[Coca Rojas]]></surname>
<given-names><![CDATA[Reynaldo Gonzalo]]></given-names>
</name>
</contrib>
</contrib-group>
<aff id="A">
<institution><![CDATA[,  ]]></institution>
<addr-line><![CDATA[ ]]></addr-line>
</aff>
<pub-date pub-type="pub">
<day>00</day>
<month>11</month>
<year>2014</year>
</pub-date>
<pub-date pub-type="epub">
<day>00</day>
<month>11</month>
<year>2014</year>
</pub-date>
<numero>9</numero>
<fpage>22</fpage>
<lpage>23</lpage>
<copyright-statement/>
<copyright-year/>
<self-uri xlink:href="http://www.scielo.br/scielo.php?script=sci_arttext&amp;pid=S1997-40442014000100010&amp;lng=en&amp;nrm=iso&amp;tlng=en"></self-uri><self-uri xlink:href="http://www.scielo.br/scielo.php?script=sci_abstract&amp;pid=S1997-40442014000100010&amp;lng=en&amp;nrm=iso&amp;tlng=en"></self-uri><self-uri xlink:href="http://www.scielo.br/scielo.php?script=sci_pdf&amp;pid=S1997-40442014000100010&amp;lng=en&amp;nrm=iso&amp;tlng=en"></self-uri><abstract abstract-type="short" xml:lang="es"><p><![CDATA[En el presente artículo se ve como ha influenciado el novedoso motor de búsqueda Lexibot dentro de la Web profunda (Deep Web). Este motor de búsqueda se caracteriza por realizar búsquedas tanto en Web's tradicionales (o superficiales) y Web's profundas. En pocas palabras se describe su uso, funciones, la clasificación de sitios, calidad de los resultados.]]></p></abstract>
<kwd-group>
<kwd lng="es"><![CDATA[Motor de Búsqueda]]></kwd>
<kwd lng="es"><![CDATA[Web Profunda]]></kwd>
<kwd lng="es"><![CDATA[Deep Web]]></kwd>
<kwd lng="es"><![CDATA[VSM]]></kwd>
<kwd lng="es"><![CDATA[eBIR]]></kwd>
<kwd lng="es"><![CDATA[mEBIR]]></kwd>
<kwd lng="es"><![CDATA[Lexibot]]></kwd>
</kwd-group>
</article-meta>
</front><body><![CDATA[ <p align="right"><font size="2" face="Verdana"><b>ARTICULOS ORIGINALES</b></font></p>     <p align="right">&nbsp;</p>     <p align="center"><font face="Verdana" size="4"><b>Usos y funciones de Lexibot</b></font></p>     <p align="center">&nbsp;</p>     <p align="center">&nbsp;</p>     <p align="center"><font face="Verdana" size="2">Univ. Reynaldo Gonzalo Coca    Rojas    <br>   Universidad Mayor de</font> <font face="Verdana" size="2">San Andrés    <br>   Carrera de Informática    <br>   Análisis y Diseño de Sistemas de Información    <br> <a href="mailto:r9coca6194(S)hotmail.com">r9coca6194(S)hotmail.com</a></font></p>     ]]></body>
<body><![CDATA[<p align="center">&nbsp;</p>     <p align="center">&nbsp;</p> <hr>     <p align="justify"><b><font size="2" face="Verdana">Resumen</font></b></p>     <p align="justify"><font face="Verdana" size="2">En el presente artículo se ve como ha influenciado el novedoso motor de búsqueda <i>Lexibot </i>dentro de la <i>Web profunda (Deep Web). </i>Este motor de búsqueda se caracteriza por realizar búsquedas tanto en Web's tradicionales (o superficiales) y Web's profundas. En pocas palabras se describe su <i>uso, funciones, </i>la <i>clasificación de sitios, calidad de los resultados.</i></font></p>     <p align="justify"><font face="Verdana" size="2"><b>Palabras Clave</b></font></p>     <p align="justify"><font face="Verdana" size="2">Motor de Búsqueda, Web Profunda, Deep Web, VSM, eBIR, mEBIR, Lexibot.</font></p> <hr>     <p align="justify">&nbsp;</p>     <p align="justify">&nbsp;</p>     <p align="justify"><font face="Verdana" size="3"><b>1.&nbsp; &nbsp;INTRODUCCIÓN</b></font></p>     <p align="justify"><font face="Verdana" size="2">En la actualidad con un mundo globalizado, cuando la población requiere buscar información sobre algún tema en específico, evita la lectura de libros ya que piensan que pueden encontrar su información de forma más rápida a través del Internet, el cual usa <i>motores de búsquedas </i>que permiten a los navegantes encontrar páginas con información útil.</font></p>     ]]></body>
<body><![CDATA[<p align="justify"><font face="Verdana" size="2">Internet ha llegado a ser repositorio de inmensa cantidad de información, es decir la más grande del mundo y de esa forma todo el mundo aprende, investiga y a encontrar cosas de interés.</font></p>     <p align="justify"><font face="Verdana" size="2">El marketing dentro de los diferentes motores de búsqueda es fácil de comprender, ya que experimentamos a diario desde la perspectiva como usuarios de la Web. En la actualidad existen tres principales motores de búsqueda disponibles en la Web (Google, Yahoo y MSN) y otros menos populares.</font></p>     <p align="justify"><font face="Verdana" size="2">Pero dentro de la Web Profunda (Deep Web) aparece <i>Lexibot </i>de <i>BrightPlanet </i>insustituible para aprovechar la Web profunda y ponga sus resultados a la superficie.</font></p>     <p align="justify"><font face="Verdana" size="2">La forma más sencilla de describir la <i>Lexibot </i>es un &quot;motor de consulta dirigido.&quot; El <i>Lexibot </i>tiene otras características de gran alcance en los resultados de la calificación y clasificación, pero es esta capacidad de consultar múltiples sitios de búsqueda directa y simultánea que permite a contenido Web profunda para ser recuperada.</font></p>     <p align="justify"><font face="Verdana" size="2">Por supuesto, los motores de búsqueda son a su vez las bases de datos de búsqueda. Por lo tanto, Resultados se integran fácilmente con Lexibot para las búsquedas dentro de la Web Profunda. Por definición, sin embargo, los motores de búsqueda son limitadas a la superficie de los documentos web que pueden ser descubiertos por el rastreo.</font></p>     <p align="justify">&nbsp;</p>     <p align="justify"><font face="Verdana" size="3"><b>2.&nbsp; &nbsp;¿QUÉ ES LEXIBOT?</b></font></p>     <p align="justify"><font face="Verdana" size="2"><i>Lexibot </i>es una <i>herramienta de búsqueda especializado, </i>desarrollado por <i>BrightPlanet, </i>como una forma de buscar en la</font> <font face="Verdana" size="2">Web profunda (la parte oculta de la Web que pueden contener 500 veces el contenido accesible a los motores de búsqueda convencionales).</font></p>     <p align="justify">&nbsp;</p>     <p align="justify"><font face="Verdana" size="3"><b>3.    USOS</b></font></p>     ]]></body>
<body><![CDATA[<p align="justify"><font face="Verdana" size="2"><i>Lexibot </i>utiliza lo que llama <i>BrightPlanet </i>una tecnología integral e inteligente de búsqueda que permite a los usuarios realizar búsquedas utilizando texto simple, lenguaje natural, o consultas booleanas en cientos de bases de datos al mismo tiempo, filtrar y analizar los datos, y publicar los resultados como páginas Web.</font></p>     <p align="justify"><font face="Verdana" size="2">Lexibot fue diseñado para realizar búsquedas complejas para identificar y recuperar contenido de todas las áreas de la Web, y para procesar la información.</font></p>     <p align="justify"><font face="Verdana" size="2">Todas las recuperaciones, agregaciones y documentos caracterizaciones en este estudio utilizan la tecnología Lexibot de BrightPlanet. El Lexibot utiliza varios hilos para las consultas de origen simultáneas y luego documentan las descargas. En Lexibot todos los índices se obtienen de documentos recuperados (incluyendo el contenido de HTML).</font></p>     <p align="justify"><font face="Verdana" size="2">Después de la descarga y la indexación, los documentos se califican como de relevancia utilizando cuatro diferentes <i>algoritmos de puntuación, </i>un lugar destacado de <i>modelización espacio vectorial (VSM) </i>y el estándar y recuperación de información del modelo extendido de Boole <i>(eBIR).</i></font></p>     <p align="justify">&nbsp;</p>     <p align="justify"><font face="Verdana" size="3"><b>4.   FUNCIONES</b></font></p>     <p align="justify"><font face="Verdana" size="2">El contenido de la &quot;Web Profunda <i>(Deep Web)&quot; </i>ha sido accesible sólo a aquellos que conocían la dirección correcta para el sitio Web.</font></p>     <p align="justify"><font face="Verdana" size="2">Entonces, aunque un usuario se haya conectado a una base de datos, sus datos sólo podrían tener acceso a consultas directas individuales.</font></p>     <p align="justify"><font face="Verdana" size="2">Lexibot actúa como un motor de consulta directa automatizado para hacer decenas de consultas simultáneamente a múltiples bases de datos. Las búsquedas se admiten en cerca de 600 bases de datos.</font></p>     <p align="justify"><font face="Verdana" size="2">Una vez que se encuentran en los enlaces, Lexibot descarga los enlaces, los analiza, elimina los irrelevantes, a continuación, descarga las porciones de texto de los documentos en el disco duro del usuario.</font></p>     ]]></body>
<body><![CDATA[<p align="justify"><font face="Verdana" size="2">La aplicación se puede utilizar con aplicaciones de escritorio, así como la Internet, es adaptable a las preferencias del usuario, y se puede configurar ya sea para uso simple o avanzada.</font></p>     <p align="justify">&nbsp;</p>     <p align="justify"><font face="Verdana" size="3"><b>5&nbsp; &nbsp; &nbsp;CLASIFICACIÓN DE SITIOS DE LA DEEP WEB</b></font></p>     <p align="justify"><font face="Verdana" size="2">El Lexibot se utiliza para recuperar las páginas completas e Índices plenamente, tanto con las fuentes iniciales únicas y las fuentes eliminadas de un enlace. Algunos 43.348 URLs resultantes se recuperan en realidad.</font></p>     <p align="justify"><font face="Verdana" size="2">Aplicando un <i>criterio inicial de filtro </i>a estos sitios, permiten determinar si eran los sitios de búsqueda iniciales. Este filtro inspecciona el contenido HTML de las páginas, además de analizar el contenido de la página. Este filtro se tradujo en 17.579 URLs precalificados.</font></p>     <p align="justify"><font face="Verdana" size="2">Inspeccionando el lado posterior de 700 sitios asignados al azar de esta lista identifica otros criterios de filtro. Noventa y cinco de 700, o el 13,6%, no reunía los requisitos plenamente como sitios de búsqueda. Esta corrección se ha aplicado a todo el conjunto candidato y los resultados presentados.</font></p>     <p align="justify"><font face="Verdana" size="2">La prueba de los sitios calificados en una prueba automatizada en el Lexibot para sitios de búsqueda donde la clasificación es del 98% de precisión.</font></p>     <p align="justify"><font face="Verdana" size="2">Además, los medios automatizados para descubrir nuevos sitios de búsqueda se han incorporado en nuestra versión base que se encuentra dentro del Lexibot.</font></p>     <p align="justify">&nbsp;</p>     <p align="justify"><font face="Verdana" size="3"><b>6&nbsp; &nbsp; ANÁLISIS DE CALIDAD DE RESULTADOS</b></font></p>     ]]></body>
<body><![CDATA[<p align="justify"><font face="Verdana" size="2">Las comparaciones de calidad entre el contenido de la Web profunda y superficial se basaron en cinco consultas diversas, sobre temas específicos emitidos a través de Lexibot ciertos motores de búsqueda convencionales y tres sitios profundos específicos para un tema. Las cinco áreas temáticas fueron la agricultura, la medicina, las finanzas / negocios, la ciencia y el derecho.</font></p>     <p align="justify"><font face="Verdana" size="2">Las consultas fueron diseñadas específicamente para limitar los resultados devueltos por el total de cualquiera de las seis fuentes para un máximo de 200 para asegurar la recuperación completa de cada source.</font></p>     <p align="justify"><font face="Verdana" size="2">La determinación de &quot;calidad&quot; se basa en un promedio de VSM del Lexibot y métodos de calificación lingüística computacional mEBIR. El medidor de &quot;calidad&quot; se fijó en la puntuación 82 para Lexibot, empíricamente determinado como más o menos precisión de millones de puntuaciones Lexibot anteriores de documentos subidos en Web tradicional.</font></p>     <p align="justify"><font face="Verdana" size="2">La Web profunda vs las Web's superficiales se obtuvieron mediante el uso de la selección de la opción de Lexibot fuente y luego contar los documentos y los documentos que superen el medidor de puntuación de la calidad total.</font></p>     <p align="justify">&nbsp;</p>     <p align="justify"><font face="Verdana" size="3"><b>7.&nbsp; &nbsp;CONCLUSIONES</b></font></p>     <p align="justify"><font face="Verdana" size="2">Se da a conocer el motor de búsqueda Lexibot dentro de la Deep Web, ya que es novedosa y efectiva al momento de recuperar los registros de datos en una página Web.</font></p>     <p align="justify"><font face="Verdana" size="2">Su algoritmo se basa en dos observaciones importantes sobre los registros de datos en la web y un algoritmo de coincidencia de cadenas.</font></p>     <p align="justify"><font face="Verdana" size="2">Es automático y por lo tanto no requiere ningún esfuerzo manual. Además, es capaz de descubrir registros de datos no contiguos, que no pueden ser manejados por las técnicas existentes, ni siquiera por los motores de búsqueda tradicionales que se conocen actualmente.</font></p>     <p align="justify">&nbsp;</p>     ]]></body>
<body><![CDATA[<p align="justify"><font face="Verdana" size="3"><b>8.&nbsp; &nbsp; &nbsp;BIBLIOGRAFÍA</b></font></p>     <!-- ref --><p align="justify"><font face="Verdana" size="2">[1]&nbsp; &nbsp; &nbsp;Rouse, M. <i>What is LexiBot?, </i>(Sep. 2005),</font> <font face="Verdana" size="2"><u><A href=http://whatis.techtarget.com/definition/LexiBot target="_blank">http://whatis.techtarget.com/definition/LexiBot</A></u></font>&nbsp;&nbsp;&nbsp;&nbsp;&nbsp;&nbsp;&nbsp;&nbsp;[&#160;<a href="javascript:void(0);" onclick="javascript: window.open('/scieloOrg/php/reflinks.php?refpid=S1997-4044201400010001000001&pid=S1997-40442014000100010&lng=','','width=640,height=500,resizable=yes,scrollbars=1,menubar=yes,');"></a>&#160;]<!-- end-ref --><!-- ref --><p align="justify"><font face="Verdana" size="2">[2] BrightPlanet. <i>The Deep Web: Surfacing Hidden Valué, </i>White Paper, (Jul. 2000), </font><font face="Verdana" size="2"><A href=http://brightplanet.com/wp- target="_blank">http://brightplanet.com/wp-content/uploads/2012/03/12550176481-deepwebwhitepaperl.pdf</A></font>&nbsp;&nbsp;&nbsp;&nbsp;&nbsp;&nbsp;&nbsp;&nbsp;[&#160;<a href="javascript:void(0);" onclick="javascript: window.open('/scieloOrg/php/reflinks.php?refpid=S1997-4044201400010001000002&pid=S1997-40442014000100010&lng=','','width=640,height=500,resizable=yes,scrollbars=1,menubar=yes,');"></a>&#160;]<!-- end-ref --><!-- ref --><p align="justify"><font face="Verdana" size="2">[3]   Grasso, A. <i>La 'deep web', el lado oscuro de la internet que no conocemos, </i>(Jul. 2013), </font><font face="Verdana" size="2"><A href=http://www.eset- target="_blank">http://www.eset-la.com/pdf/prensa/concurso/677_AgustinaGrasso_DeepWeb Perfil-AR.pdf</A></font>&nbsp;&nbsp;&nbsp;&nbsp;&nbsp;&nbsp;&nbsp;&nbsp;[&#160;<a href="javascript:void(0);" onclick="javascript: window.open('/scieloOrg/php/reflinks.php?refpid=S1997-4044201400010001000003&pid=S1997-40442014000100010&lng=','','width=640,height=500,resizable=yes,scrollbars=1,menubar=yes,');"></a>&#160;]<!-- end-ref --><p align="justify">&nbsp;</p>      ]]></body><back>
<ref-list>
<ref id="B1">
<label>1</label><nlm-citation citation-type="">
<person-group person-group-type="author">
<name>
<surname><![CDATA[M.]]></surname>
<given-names><![CDATA[Rouse]]></given-names>
</name>
</person-group>
<source><![CDATA[What is LexiBot?]]></source>
<year></year>
</nlm-citation>
</ref>
<ref id="B2">
<label>2</label><nlm-citation citation-type="">
<collab>BrightPlanet.</collab>
<source><![CDATA[The Deep Web: Surfacing Hidden Valué, White Paper]]></source>
<year></year>
</nlm-citation>
</ref>
<ref id="B3">
<label>3</label><nlm-citation citation-type="">
<person-group person-group-type="author">
<name>
<surname><![CDATA[Grasso]]></surname>
<given-names><![CDATA[A.]]></given-names>
</name>
</person-group>
<source><![CDATA[La 'deep web', el lado oscuro de la internet que no conocemos]]></source>
<year></year>
</nlm-citation>
</ref>
</ref-list>
</back>
</article>
