Google Code Search
| Google Code Search | |
|---|---|
| Тип | Поиск по исходным кодам |
| Владелец | |
| Текущий статус | Применяется для поиска в формате проектов, размещенных на Google Code |
| Сайт | http://www.google.com/codesearch (архивная копия) |
Google Code Search — проект поисковой машины от Google Labs, индексировавшей исходные коды открытых программ, и позволявшей использовать в поисковых запросах регулярные выражения. В виде бета-версии работал с 5 октября 2006 года по 15 января 2012 года. Закрыт в связи с закрытием Google Labs.
Кроме поддержки регулярных выражений, имелась возможность более точного поиска с помощью специальных операторов. Среди них: lang: (указание языка программирования), package: (имя проекта), license: (лицензия) и file: (имя файла). Индексировался код программ, хранившихся в различных форматах, включая tar.gz, tar.bz2,.tar,.zip, репозитории CVS и Subversion.
В ограниченном виде наработки Google Code Search продолжают использоваться для поиска в пределах кодов проекта Chromium, код которого расположен на сайте Google Code.
Автором проекта, Russ Cox, была опубликована пара консольных утилит Cindex/Csearch, предоставляющая возможность индексирования и поиска по исходным кодам. Утилиты используют схожие с Google Code Search принципы, хотя не могут масштабироваться более чем на несколько десятков гигабайт исходников.
Движок регулярных выражений
Сайт позволял использовать Регулярные выражения в запросах и искал любые символы (в отличие от обычных поисковиков, которые игнорируют нетекстовые символы). На момент создания такими возможностями не обладали другие поисковые системы. Это делало его похожим на программу Grep, который выполняет поиск по огромной базе открытого исходного кода. Используется поиск на базе индекса триграмм и собственной реализации POSIX-совместимых регулярных выражений — RE2, написанной Russ Cox. Исходные коды RE2 были открыты в марте 2010.
Google Code Search поддерживал POSIX-расширенный Синтаксис регулярных выражений, за исключением обратных ссылок, сопоставления элементов и сортировки классов.
Интересные факты
Некоторое время в 2008 году результаты поиска Code Search могли интегрироваться в основную поисковую выдачу Google. Google code search использовался активно в комитете ISO при выборе имен некоторых новых функций в стандарте языка программирования Си (стандарт C11 от 2011 года). Code Search применялся хакерами для поиска уязвимостей в программах. Были найдены тысячи небезопасных фрагментов кода
Примечания
- Ed Burnette: Google: Code search and movies and gadgets, oh my! — http://www.zdnet.com/blog/burnette/google-code-search-and-movies-and-gadgets-oh-my/181
- http://www.zdnet.com/blog/burnette/google-code-search-and-movies-and-gadgets-oh-my/181
- https://www.theregister.co.uk/2011/09/05/google_shuts_ten_services/
- Google Shuts Ten Services — https://www.theregister.co.uk/2011/09/05/google_shuts_ten_services/ // The Register, 2011-09-05
- https://code.google.com/p/chromium/codesearch
- Code search — https://code.google.com/p/chromium/codesearch по проекту Chromium.
- https://code.google.com/p/codesearch/
- Cindex/Csearch — https://code.google.com/p/codesearch/ — command-line file search tool, based on ideas from GCS
- http://0pointer.de/blog/projects/a-big-loss.html
- A Big Loss — http://0pointer.de/blog/projects/a-big-loss.html
- http://swtch.com/~rsc/regexp/regexp4.html
- , Russ Cox, January 2012
- Google Open Source Blog: RE2: a principled approach to regular expression matching — http://google-opensource.blogspot.ru/2010/03/re2-principled-approach-to-regular.html
- http://google-opensource.blogspot.ru/2010/03/re2-principled-approach-to-regular.html
- https://www.webcitation.org/6E9pSGGJU?url=http://google-opensource.blogspot.ru/2010/03/re2-principled-approach-to-regular.html
- https://web.archive.org/web/20080724183051/http://www.google.com/intl/en/help/faq_codesearch.html
- Google Code Search: FAQ — https://web.archive.org/web/20080724183051/http://www.google.com/intl/en/help/faq_codesearch.html // Google, архивная копия от 2008 года
- Nik Cubrilovic: Google Now Displaying Code Search Results — https://articles.washingtonpost.com/2008-07-13/news/36882744_1_search-results-page-google-source-code
- https://articles.washingtonpost.com/2008-07-13/news/36882744_1_search-results-page-google-source-code
- https://archive.today/20131117233527/http://articles.washingtonpost.com/2008-07-13/news/36882744_1_search-results-page-google-source-code
- http://www.open-std.org/jtc1/sc22/wg14/www/docs/n1327.htm
- P.J. Plauger, Abandoning a Process — http://www.open-std.org/jtc1/sc22/wg14/www/docs/n1327.htm, ISO/IEC JTC1 SC22 WG14 N1327: "while there are no occurances of quick_exit in a Google code search. "
- Johnny Long: Google Hacking for Penetration Testers, Volume 2 — https://books.google.ru/books?id=bvB1-MmhEjQC&pg=PA227&lpg=PA227&dq=Google+%22Code+Search%22
- https://books.google.ru/books?id=bvB1-MmhEjQC&pg=PA227&lpg=PA227&dq=Google+%22Code+Search%22
- http://searchsecurity.techtarget.com/news/1222898/Google-Code-Search-gives-security-experts-a-sinking-feeling
- Google Code Search gives security experts a sinking feeling — http://searchsecurity.techtarget.com/news/1222898/Google-Code-Search-gives-security-experts-a-sinking-feeling // Dennis Fisher, Executive Editor, TechTarget, Oct 11, 2006
- Bill Brenner: Security Blog Log: Taking Google Code Search for a spin — http://searchsecurity.techtarget.com/news/1224349/Security-Blog-Log-Taking-Google-Code-Search-for-a-spin
- http://searchsecurity.techtarget.com/news/1224349/Security-Blog-Log-Taking-Google-Code-Search-for-a-spin
- https://web.archive.org/web/20130713132419/http://searchsecurity.techtarget.com/news/1224349/Security-Blog-Log-Taking-Google-Code-Search-for-a-spin
- http://monkey.org/~jose/blog/viewpage.php?page=google_code_search_stats
- https://web.archive.org/web/20150610202757/http://monkey.org/~jose/blog/viewpage.php?page=google_code_search_stats
- insecurity stats via google codesearch — http://monkey.org/~jose/blog/viewpage.php?page=google_code_search_stats // Jose Blog
Ссылки
- http://www.google.com/codesearch — https://web.archive.org/web/20101112131244/http://www.google.com//codesearch
- Cindex/Csearch — https://code.google.com/p/codesearch/
- Вариант Code Search — https://code.google.com/p/chromium/codesearch
- Debian code search — http://codesearch.debian.net/
- http://www.google.com/codesearch — Архивная копия страницы, ноябрь 2010 года.
- Cindex/Csearch — command-line file search tool, based on ideas from GCS (Russ Cox)
- Вариант Code Search для поиска по кодам проекта Chromium на Google Code
- Debian code search — сходный поиск по исходным кодам Debian