Entradas

MOTIVOS DE DEEP WEB

Imagen
Motivos de Deep web Motivos por los que los motores de búsqueda no pueden indexar algunas páginas: Documentos o información oculta: Archivos pdf que no se encuentran en las páginas indexadas, listas de datos no públicas (sobre todo los ciber-criminales). Web contextual: páginas cuyo contenido varía dependiendo del contexto (por ejemplo, la dirección IP del cliente, de las visitas anteriores, etc). Contenido dinámico: páginas dinámicas obtenidas como respuesta a parámetros, por ejemplo, datos enviados a través de un formulario. Contenido de acceso restringido: páginas protegidas con contraseña, contenido protegido por un Captcha, etc. Contenido No HTML: contenido textual en archivos multimedia, otras extensiones como exe, rar, zip, etc. Software: Contenido oculto intencionadamente, que requiere un programa o protocolo específico para poder acceder (ejemplos: Tor, I2P, Freenet) Páginas no enlazadas: páginas de cuya existencia no tienen referencia los buscado...

DENOMINACION DE DEEP WEB

Imagen
Denominación de Deep web La Web profunda se refiere a la colección de sitios o bases de datos que un buscador común, como Google, no puede o no quiere indexar. Es un lugar específico del internet que se distingue por el anonimato. Nada que se haga en esta zona puede ser asociado con la identidad de uno, a menos que uno lo desee. Bergman, en un artículo semanal sobre la Web profunda publicado en el Journal of Electronic Publishing, mencionó que Jill Ellsworth utilizó el término «Web invisible» en 1994 para referirse a los sitios web que no están registrados por ningún motor de búsqueda. En su artículo, Bergman citó la entrevista que Frank García hizo a Ellsworth en 1996: Sería un sitio que, posiblemente, esté diseñado razonablemente, pero no se molestaron en registrarlo en alguno de los motores de búsqueda. ¡Por lo tanto, nadie puede encontrarlos! Estás oculto. Yo llamo a esto la Web invisible. Otro uso temprano del término Web Invisible o web profunda fue por B...

RECURSOS DE LA INTERNET PPOFUNDA

Imagen
Recursos de la Internet Profunda Los recursos de la internet profunda pueden estar clasificados en las siguientes categorías: Contenido de acceso limitado : los sitios que limitan el acceso a sus páginas de una manera técnica (Por ejemplo, utilizando el  estándar de exclusión de robots  o  captcha , que prohíben los motores de búsqueda de la navegación por y la creación de copias en caché. 24 ​ Contenido dinámico : las páginas dinámicas que devuelven respuesta a una pregunta presentada o acceder a través de un formulario, especialmente si se utilizan elementos de entrada en el dominio abierto como campos de texto. Contenido no enlazado : páginas que no están conectadas con otras páginas, que pueden impedir que los programas de rastreo  web  tengan acceso al contenido. Este material se conoce como páginas sin enlaces entrantes. Contenido programado : páginas que solo son accesibles a través de  enlaces  producidos por  ...

INTERNET ACADEMIA INVISIBLE DE DEEP WEB

Imagen
Internet academia  invisible de Deep web Se denomina Internet Académica Invisible o  Academic Invisible Web  (AIW) a el conjunto de bases de datos y colecciones relevantes para la academia, o con fines académicos, que no es posible ser buscado por los motores de búsqueda convencionales. La preocupación sobre este tema radica en que millones de documentos permanecen invisibles frente a los ojos de los usuarios convencionales. Dentro de estos documentos se pueden encontrar artículos, libros, reportes, documentos de acceso abierto, datos de encuestas, entre otros. El problema con los motores de búsqueda convencionales es que no muestran aquellos datos que cambian constantemente, como información climática o imágenes satelitales y dicha información, al cambiar de manera tan rápida es imposible de ser indexada por lo que restringe su aparición en los motores de búsqueda convencionales. Una aproximación al indexamiento y apertura de la Internet académica invi...