Домой / Видео / Поиск в кэше яндекса. Как посмотреть удаленную страницу вконтакте — копия в яндекс и гугл

Поиск в кэше яндекса. Как посмотреть удаленную страницу вконтакте — копия в яндекс и гугл

Кеш используется во многих веб-сферах для того, чтобы ускорить доступ до тех или иных данных через интернет. Например, мы уже говорили о плагине который сохраняет копии страниц сайта на хостинге для того, чтобы пользователи могли загрузить их быстрее, и уменьшить этим нагрузку на хостинг.

Также кеш есть и во всех браузерах. Он сохраняет на компьютере пользователя копии всех сайтов, которые посещались, а затем, когда к ним осуществляется очередной запрос, они подгружаются в большей части с компьютера, что также ускоряет загрузку.

И, исходя из выше сказанного, сложно предположить, что у поисковых систем нет кеша. На самом деле есть и там тоже сохраняются все ваши сайты для того, чтобы поисковик меньше напрягался, когда показывает ваш сайт. В данной статье рассмотрим, как добраться до кеш Google, узнаем, что там есть, и как это можно использовать.

Кеш Google

Кеш Google хранится на сервере поисковика и никак не затрагивает хостинг, который оплачиваете вы. Ссылка, ведущая на кеш вашего сайта отличается от настоящих ссылок вашего сайта, поэтому это никак не влияет на продвижение. В общем, ничего плохого в кеш поисковика нет.

Чтобы добраться до кеша Google, введите в поисковике необходимый запрос, и на поисковой выдаче, около искомого сайта, рядом с его ссылкой вы увидите маленький треугольник в виде стрелки вниз. Кликните на него и выберите пункт «Сохранённая копия». В новой вкладке откроется кеш этого сайта, который сохранил Google.В кеше вы увидите, от какого он числа, и вам покажут ссылку на актуальную версию страницы.

В таком виде некоторые элементы сайта могут не отображаться, например, не будет изображений или каких-то частей дизайна. Но весь текст и HTML-разметка останется.

Для нужен кеш Google

То, что кеш Google необходим для быстрой обработки сайтов поисковиком, мы уже рассказали. Теперь посмотрим, чем он может быть полезен для нас.

Представьте грустную ситуацию, что вы написали какую-то статью и на хостинге случился сбой – всё потеряно. У вас, конечно же, есть бекап сайта и можете восстановить его, но той статьи, которую вы писали, там ещё нет, ещё не успела сохраниться в бекап. Что вы тогда будете делать? Неужели станете переписывать статью заново. Гораздо легче обратиться к кешу Google и посмотреть, его робот уже успел сходить на ваш сайт, и сохранил все данные в кеше. А вообще, чтобы не пришлось это всё делать, создавайте бекап чаще. Подробнее .

Другая ситуация. Допустим, снова случилось что-то на хостинге и ваш сайт временно не доступен. Не терять же из-за этого посетителей. Так вот, многих из них устроит кеш-версия страниц, и они могут посмотреть их в поисковике.

У самого значимого в мире поисковика «все ходы записаны» — информация, попавшая в поле зрения поисковых роботов Google, раз и навсегда сохраняется в виде сохранённой копии. Эта копия иногда очень нужна веб-журналистам — чтобы получить важные, но уже удалённые сведения. Но как получить к ним доступ? Как осуществлять поиск по кэшу Google?

Если вы ищете что-то через Google, то найти сохраненную копию можно и через обычный интерфейс поисковика. Нажмите на зелёный треугольничек справа от ссылки на сайт, затем — на надпись «Сохраненная копия». Нажмите на неё — и посмотрите резервную копию имеющейся информации, которая попала в цепкие лапы «гугла».


Поиск через адресную строку

Есть два способа:

Способ №1

Введите в адресную строку своего веб-браузера (Ghrome, Safari, Mozilla, Internet Explorer, Opera и т.д.) следующую информацию:

http://webcache.googleusercontent.com/search?q=cache:http://сайт Вместо сайт подставьте нужный вам сайт.

При желании можно посмотреть версию страницы без графики (только текст, своего рода режим Readability). Для этого достаточно нажать на «Текстовая версия» в правом верхнем углу экрана.

Способ №2

В браузере перед адресом страницы допишите слово «cache: ». В результате вместо самой страницы откроется её копия в кэше Google. Например:

Важно: Google в вашем браузере должен быть поиском по умолчанию. Если у вас не так — вводите «cache: » и адрес страницы в поисковой строке на google.com.

Вот и всё! Теперь вы можете искать в веб-кэше Google всё, что захотите — и когда захотите.

P.S. Хотите, чтобы запрос на кэш Google всегда был под рукой? Добавьте эту страницу в закладки. Как это сделать быстро и эффективно? Для Мас работает сочетание клавиш Cmd + D, для Windows — Ctrl + D.

Страница в социальной сети ВКонтакте может многое рассказать о человеке, особенно если он ее ведет активно. На ней можно узнать список его увлечений, дату рождения, посмотреть фотографии, интересующие его записи из различных групп и многое другое. Но если пользователь решил удалить свою страницу ВКонтакте, вся эта информация скрывается. На его странице появляется сообщение, что данный пользователь удалил свой аккаунт, и посмотреть сведения на ней больше не представляется возможным. Но есть несколько способов, как просмотреть удаленную страницу ВКонтакте, о которых мы и расскажем в рамках данной статьи.

Оглавление: Обратите внимание: Приведенные ниже советы актуальные не только когда страница удалена по воле самого пользователя. Также они позволяют посмотреть информацию на страницах, которые были заблокированы администраторами ВКонтакте по той или иной причине.

Поиск удаленной страницы ВКонтакте в кеше поисковых систем

Поисковые системы хранят свою базу с информацией обо всех сайтах, в том числе делая их резервные копии. Ими может воспользоваться любой желающий, что позволяет, в том числе, посмотреть информацию о странице удаленного пользователя ВКонтакте.

Важно: Данный метод действует только в том случае, если пользователь удалил свой профиль из ВКонтакте недавно. Если страница удалена уже давно, скорее всего, ее вновь посетил поисковый робот и обновил сохраненную копию.

Следующим образом можно посмотреть информацию об удаленной странице ВКонтакте при помощи поисковой системы Google:


В поисковой системе Yandex открытие сохраненных копий страниц ВКонтакте происходит примерно таким же образом.

Обратите внимание: Социальная сеть ВКонтакте позволяет пользователям настраивать свою приватность. В личных настройках аккаунта имеется возможность настроить видимость страницы в сети. Если в данной настройке указано, что страница видна всем, кроме поисковых сайтов, то найти в Google и Яндекс сохраненные копии страницы не получится, поскольку поисковому роботу воспрещен обход такой страницы.

Просмотр удаленной страницы ВКонтакте в вебархиве

В интернете каждый день сотни сайтов меняются, удаляются, на их месте появляются новые и происходят другие подобные манипуляции. Есть несколько сервисов, которые следят за этими действиями, сохраняя копии сайтов и отдельных страниц. Используя такой сервис, можно посмотреть информацию, которая была размещена на удаленной странице ВКонтакте. Делается это следующим образом:


Стоит отметить, что сервис вебархив не лучшим образом работает с сохранением информации о страницах пользователей ВКонтакте, и если аккаунт был зарегистрирован недавно, велика вероятность, что информация о нем в базе данных сервиса не будет найдена.

Просмотр удаленной страницы ВКонтакте в кеше браузера

Важно: Данный способ могут использовать только те пользователи, которые захотят посмотреть страницу человека, к которому они ранее заходили, но после он ее удалил.

Метод основывается на том, что браузеры хранят копии сайтов, что необходимо для их более быстрой загрузки при необходимости. Если вы некоторое время назад заходили на страницу к пользователю, после чего он ее удалил, у вас есть возможность посмотреть ее сохраненную копию в браузере. Сделать это можно практически в любом браузере, рассмотрим на примере Opera :

Это все способы, позволяющие посмотреть информацию, которая ранее была расположена на удаленной странице ВКонтакте.

Решение рассматривается (пока) только для одного сайта - того, на котором мы находимся. Идея появилась в результате того, что один пользователь сделал юзерскрипт, который переадресует страницу на кеш Гугла, если вместо статьи видим «Доступ к публикации закрыт». Понятно, что это решение будет работать лишь частично, но полного решения пока не существует. Можно повысить вероятность нахождения копии выбором результата из нескольких сервисов. Этим стал заниматься скрипт HabrAjax (наряду с 3 десятками других функций). Теперь (с версии 0.859), если пользователь увидел полупустую страницу, с которой можно перейти лишь на главную, в личную страницу автора (если повезёт) и назад, юзерскрипт предоставляет несколько альтернативных ссылок, в которых можно попытаться найти потерю. И тут начинается самое интересное, потому что ни один сервис не заточен на качественное архивирование одного сайта.

Кстати, статья и исследования порождены интересным опросом А вас раздражает постоянное «Доступ к публикации закрыт»? и скриптом пользователя dotneter - комментарий habrahabr.ru/post/146070/#comment_4914947 .

Требуется, конечно, более качественный сервис, поэтому, кроме описания нынешней скромной функциональности (вероятность найти в Гугл-кеше и на нескольких сайтах-копировщиках), поднимем в статье краудсорсинговые вопросы - чтобы «всем миром» задачу порешать и прийти к качественному решению, тем более, что решение видится близким для тех, кто имеет сервис копирования контента. Но давайте обо всём по порядку, рассмотрим все предложенные на данный момент решения.

Кеш Гугла

В отличие от кеша Яндекса, к нему имеется прямой доступ по ссылке, не надо просить пользователя «затем нажать кнопку „копия“». Однако, все кеширователи, как и известный archive.org, имеют ряд ненужных особенностей.

1) они просто не успевают мгновенно и многократно копировать появившиеся ссылки. Хотя надо отдать должное, что к популярным сайтам обращение у них частое, и за 2 и более часов они кешируют новые страницы. Каждый в своё время.

3) поэтому результат кеширования - как повезёт. Можно обойти все такие кеширующие ссылки, если очень надо, но и оттуда информацию стоит скопировать себе, потому что вскоре может пропасть или замениться «более актуальной» бессмысленной копией пустой страницы.

Кеш archive.org

Он работает на весь интернет с мощностями, меньшими, чем у поисковиков, поэтому обходит страницы какого-то далёкого русскоязычного сайта редко. Частоту можно увидеть здесь: wayback.archive.org/web/20120801000000*/http://habrahabr.ru
Да и цель сайта - запечатлеть фрагменты истории веба, а не все события на каждом сайте. Поэтому мы редко будем попадать на полезную информацию.

Кеш Яндекса

Нет прямой ссылки, поэтому нужно просить (самое простое) пользователя нажать на ссылку «копия» на странице поиска, на которой будет одна эта статья (если её Яндекс вообще успел увидеть).

Как показывает опыт, статья, повисевшая пару часов и закрытая автором, довольно успешно сохраняется в кешах поисковиков. Впоследствии, скорее всего, довольно быстро заменится на пустую. Всё это, конечно, не устроит пользователей веба, который по определению должен хранить попавшую в него информацию.

Из живых я нашёл пока что 4, некоторые давно существовавшие (itgator) на данный момент не работали. В общем, пока что они почти бесполезны, потому что заставляют искать статью по названию или ключевым словам, а не по адресу, по которому пользователь пришёл на закрытую страницу (а по словам отлично ищет Яндекс и не только по одному их сайту). Приведены в скрипте для какой-нибудь полезной информации.

Задача

Перед сообществом стоит задача, не утруждая организаторов сайта, довести продукт до качественного, не теряющего информацию ресурса. Для этого, как правильно заметили в комментариях к опросу, нужен архиватор актуальных полноценных статей (и комментариев к ним заодно).

В настоящее время неполное решение её, как описано выше, выглядит так:

Если искать в Яндексе, то подобранный адрес выведет единственную ссылку (или ничего):


Нажав ссылку «копия», увидим (если повезёт) сохранённую копию (страница выбрана исключительно для актуального на данный момент примера):

В Гугле несколько проще - сразу попадаем на копию, если тоже повезёт, и Гугл успел сохранить именно то, что нам надо, а не дубль отсутствующей страницы.

Забавно, что скрипт теперь предлагает «выбор альтернативных сервисов» и в этом случае («профилактические работы»):

Жду предложений по добавлению сервисов и копировщиков (или хотя бы проектов) (для неавторизованных - на почту spmbt0 на известном гуглоресурсе, далее выберем удобный формат).

UPD 23:00: опытным путём для mail.ru было выяснено строение прямой ссылки на кеш:
"http://hl.mailru.su/gcached?q=cache:"+ window.location Знатоки или инсайдеры, расскажите, что это за ссылка, насколько она стабильна (не изменится ли, например, домен 3-го уровня), что значит приставка «g»-cached? Значит ли это кеш Гугла или это кеш движка Gogo?

Возможно, сайт был подвергнут блокировке из-за нарушения закона, а может этот сайт просто пока что не отвечает на запрос. Как бы ни была причина, иногда вам нужно взять какую информацию с сайта, который совсем недавно перестал работать или был взломан и лишился всего контента. В большинстве случаев удача может повернуться к вам лицом. Вы можете просмотреть кэшированную версию этого сайта в Google?

Кэшированные сайты: что это?

Для того чтобы быстро отыскать все эти сайты, Google и другие поисковые системы сохраняют внутреннюю копии этих сайтов на серверах. Эти сохраненные файлы и называются кэшем, и Google позволяет их просматривать, если такая копия существует. Раньше этот процесс был очень понятен – вам просто нужно было нажать ссылку, представленную под результатом, выданном в поиске. Сейчас все немного сложнее, но вам не стоит беспокоиться, так как кэшированные сайты по-прежнему существуют.

Смотрим кэш сайта в Гугл :

1. Попробуйте найти что-нибудь. В данном случае, мы будем искать по ключу «кеширование», и предположим, что в коем-то веке Wikipedia ушла в даун.

2. Наведите курсор мыши на результат поиска, но не кликайте.
3. Вы увидите, что рядом справа от результата появится стрелка вправо. Кликните по этой стрелке.
4. Теперь вы можете видеть миниатюру сайта. Вы также увидите ссылку Cached сверху от миниатюры. Можете кликать по этой ссылке.

Таким образом, вы будете перенаправлены к кэшированной версии сайта. И эта версия не обязательно будет содержать актуальные данные. Это просто копия сайта в том состоянии, в котором бот Google последний раз его сканировал, и на самом деле эта страница хранится на сервере Google, и поэтому ссылка будет начинаться с webcache.googleusercontent.com, а не с Wikipedia.org. Google также расскажет вам о том, насколько свежая эта копия.

Иногда бывает так, что на страницах отсутствуют изображения или фоны. Вы можете кликнуть по ссылке в верхней части страницы и увидеть текстовую версию сайта, который вы на данный момент читаете. Иногда это помогает найти необходимую вам информацию. Вы также можете кликнуть по ссылке, которая приведет вас к актуальной странице, если вам вдруг нужно будет сравнить две эти версии.

Если вам нужно найти определенный термин, вы можете воспользоваться сочетанием клавиш Ctrl+F, и просто отыскать его при помощи вашего браузера.

Сайты, которые не кэшируются

У большинства сайтов есть кэшированные копии, но бывают и исключения. Владельцы сайтов могут использовать файл robots.txt для того, чтобы попросить поисковую систему не индексировать сайт, либо удалять кэш. Иногда такое бывает, когда владелец хочет полностью удалить сайт, и не хочет, чтобы где-то появлялся его контент. Ведь существует довольно много сайтов с «черным» контентом или контентом, который не обязательно должен индексироваться (приватные форумы, информация о кредитных картах или сайты с платным доступом к контенту).

Вы можете проследить за тем, как изменялся сайт, воспользовавшись инструментом от Google под названием WebArchive , но функционал этого инструмента также может быть запрещен файлом robots.txt.