DEFINISI SITUS JEJARING SOSIAL

Layanan jejaring sosial adalah layanan dalam jaringan, platform, atau situs yang bertujuan memfasilitasi pembangunanjaringan sosial atau hubungan sosial di antara orang-orang yang memiliki ketertarikan, aktivitas, latar belakang, atau hubungan dunia nyata yang sama. Suatu layanan jejaring sosial terdiri dari perwakilan masing-masing pengguna (biasanya berupa profil), hubungan sosialnya, dan berbagai layanan tambahan. Kebanyakan layanan ini berbasis web dan penggunanya berinteraksi melalui Internet, seperti surat elektronik dan pesan instan. Layanan komunitas dalam jaringankadang dianggap sebagai layanan jejaring sosial, meski dalam artian yang lebih luas layanan jejaring sosial bersifat terpusat pada individu, sementara layanan komunitas daring bersifat terpusat pada grup. Situs-situs jejaring sosial memungkinkan pengguna berbagi ide, aktivitas, acara, dan ketertarikan di dalam jaringan individunya masing-masing.

SUMBER : http://decembermel.blogspot.co.id/2014/06/softskill-bab-6.html

CONTOH-CONTOH WEB CRAWLER

Beberapa contoh web crawler:

1.      Teleport Pro
Salah satu software web crawler untuk keperluan offline browsing. Software ini sudah cukup lama popular, terutama pada saat koneksi internet tidak semudah dan secepat sekarang. Software ini berbayar dan beralamatkan di http://www.tenmax.com.

2.      HTTrack
Ditulis dengan menggunakan C, seperti juga Teleport Pro, HTTrack merupakan software yang dapat mendownload konten website menjadi sebuah mirror pada harddisk anda, agar dapat dilihat secara offline. Yang menarik software ini free dan dapat di download pada website resminya di http://www.httrack.com

3.      Googlebot
Merupakan web crawler untuk membangun index pencarian yang digunakan oleh search engine Google. Kalau website anda ditemukan orang melalui Google, bisa jadi itu merupakan jasa dari Googlebot. Walau konsekuensinya, sebagian bandwidth anda akan tersita karena proses crawling ini.

4.      Yahoo!Slurp
Kalau Googlebot adalah web crawler andalan Google, maka search engine Yahoo mengandalkan Yahoo!Slurp. Teknologinya dikembangkan oleh Inktomi Corporation yang diakuisisi oleh Yahoo!.

5.      YaCy
Sedikit berbeda dengan web crawler  lainnya di atas, YaCy dibangun atas prinsip jaringan P2P (peer-to-peer), di develop dengan menggunakan java, dan didistribusikan pada beberapa ratus mesin computer (disebut YaCy peers). Tiap-tiap peer di share dengan prinsip P2P untuk berbagi index, sehingga tidak memerlukan server central. Contoh search engine yang menggunakan YaCy adalah Sciencenet (http://sciencenet.fzk.de), untuk pencarian dokumen di bidang sains. 

SUMBER:http://muhammadyusuf-gunadarma.blogspot.co.id/2013/04/apa-itu-web-crawler.html

PENGUKURAN WEB

Di bawah ini ada beberapa tools yang digunakan untuk mengeukur website dari segi kecepatan akses dan performanya, serta mengukut banyaknya pengunjung suatu website, berikut ini penjelasan mengenai beberapa tools yang digunakan untuk mengukur kecepatan akses website.
Tools-tools pengukur analisis web :
  • SEO (Search Engine Optimization) adalah mengoptimalkan sebuah blog/web dengan memanfaatkan mesin pencari dan mendapatkan peringkat yang tinggi di halaman pertama mesin pencari dengan menggunakan keyword agar dibanjiri pengunjung yang datang dari search engine.
  • GTmetrix merupakan sebuah situs dimana kita dapat mengetahui berbagai hal yang membuat blog/web kita lambat dan performa blog/web ketika akses, tersedia secara gratis dengan mengunakan yahoo Yslow dan Google page speed sebagai mesin penganalisa dan menampilkan hasil juga rekomendasi yang harus dilakukan.
Kelebihan dari GTmetrix :
  1. dapat membandingkan beberapa URL secara bersamaan.
  2. dapt menjadwalkan pengecekan web/blog secara otomatis dan dapat menyimpan laporan.
kekurangan dari GTmetrix :
Dalam penggunaan GTmetrix harus menggunakan koneksi internet yang cepat.
  • Keynote Internet Testing Environment (KITE)
  • Alat pengujian dan pengukur berbasis desktop yang digunakan untuk merekam atau mengedittransaksi web dan menganalis kinerja dari aplikasi web. KITE sangat mudah untuk digunakan dan sebagai salah satu alat yang sudah cukup terkenal didunia.
  • CloudStatus
CloudStatus adalah alat pengukur web yang berfungsi menelusuri kinerja utama dari layanan-layanan cloud computing. CloudStatus terdiri dari 5 layanan dasar yang ditawarkan oleh amazon, dan memiliki kemampuan monitoring yang lebih baik.
  • Jiffy
jiffy tersedia secara bebas(open source). Cara kerja jiffy adalah dengan memasukan kode jiffy ke dalam halamanhalaman web yang akan di telusuri. Dengan jiffy kita dapat mengukur page rendering times, melaporkan hasil pengukuran dari web server, aggregate log into database, dan membuat laporan-laporan.
Pembasan berikutnya tentang bagaimana sebuah web perlu dianalisis , yaitu :
1. membantu mengetahui nilai yang akan didapat dari suatu web maupun blog
2. membantu memantau beberapa lama pengunjung yang membuka situs web tersebut
3. membantu mengoptimalkan situs web dalam hal penampilan dan menambah informasi.  
SUMBER : https://elsietelibertador76.wordpress.com/tag/pengukuran-web/

DEFINISI WEB CRAWLER

Web crawler adalah suatu program atau script otomat yang relatif simple, yang dengan metode tertentu melakukan scan atau “crawl” ke semua halaman-halaman Internet untuk membuat index dari data yang dicarinya. Nama lain untuk web crawl adalah web spider, web robot, bot, crawl dan automatic indexer.
Web crawl dapat digunakan untuk beragam tujuan. Penggunaan yang paling umum adalah yang terkait dengan search engine. Search engine menggunakan web crawl untuk mengumpulkan informasi mengenai apa yang ada di halaman-halaman web publik. Tujuan utamanya adalah mengumpukan data sehingga ketika pengguna Internet mengetikkan kata pencarian di komputernya, search engine dapat dengan segera menampilkan web site yang relevan.
Ketika web crawl suatu search engine mengunjungi halaman web, ia “membaca” teks yang terlihat, hyperlink, dan konten berbagai tag yang digunakan dalam situs seperti meta tag yang banyak berisi keyword. Berdasar informasi yang dikumpulkan web crawl, search engine akan menentukan mengenai apakah suatu situs dan mengindex informasinya. Website itu kemudian dimasukkan ke dalam database search engine dan dilakukan proses penentuan ranking halaman-halamannya.
Namun search engine bukanlah satu-satunya pengguna web crawl. Linguist bisa menggunakan web crawl untuk melakukan analisis tekstual; yakni, mereka bisa menyisir Internet untuk menentukan kata apa yang paling umum digunakan hari ini. Peneliti pasar dapat menggunakan web crawl untuk menentukan dan memanipulasi trend pada suatu pasar tertentu. Ini semua merupakan contoh beragam penggunaan web crawl. Web crawl dapat digunakan oleh siapapun yang melakukan pencarian informasi di Internet.
Web crawl bisa beroperasi hanya sekali, misalnya untuk suatu projek yang hanya sekali jalan, atau jika tujuannya untuk jangka panjang seperti pada kasus search engine, mereka bisa diprogram untuk menyisir Internet secara periodik untuk menentukan apakah sudah berlangsung perubahan signifikan. Jika suatu situs mengalami trafik sangat padat atau kesulitan teknis, spider atau crawl dapat diprogram untuk mencatat hal ini dan mengunjunginya kembali setelah kesulitan teknis itu terselesaikan.
SUMBER : https://djuyadi.wordpress.com/2010/03/06/web-crawl-web-spider-web-robot-bot-crawl-automatic-indexer/

PROSES PENCARIAN PADA SERACH ENGINE

Melakukan pencarian dokumen yang dimuat pada suatu situs bisa begitu mudah dan kelihatannya mungkin sulit juga. apalagi mengingat begitu menyebarnya informasi di mana-mana, bahkan University of Calofornia menyebutkan saat ini telah terdapat lebih dari 50 miliar halaman web di internet, meskipun tidak ada ada satupun yang benar-benar tahu jumlah persisnya.
kesulitan yang mungkin terjadi adalah karena WWW tersebut tidak terdata dalam bentuk yang terstandardisasi isinya. tidak sama halnya dengan katalog yang ada di perpustakaan, yang memiliki standardisasi secara mendunia berdasarkan subjek dari judul buku, meskipun jumlahnya juga tidak sedikit.
Dalam pencarian di web, pengguna selalu memperkirakan kata apa yang di kira-kira terdapat pada halaman yang ingin anda temukan. atau kira-kira apa subjek yang dipilih oleh seseorang untuk mengelola halaman situs yang mereka kelola, topik apa saja kira-kira yang di bahas.
Jika pengguna melakukan apa yang dikenal dengan pencarian pada halaman web, sebenarnya tidaklah melakukan pencarian. tidak mungkin melakukan pencarian di WWWsecara langsung.
Pada web benar-benar terdiri dari banyak sekali halaman web yang ingin disimpan dari berbagai server diseluruh dunia. Komputer pengguna tidak langsung melakukan pencarian kepada seluruh komputer tersebut secara langsung.
Apa yang mungkin pengguna lakukan hanyalah melalui komputer untuk mengakses satu atau lebih perantara yang disebut dengan alat bantu pencarian yang ada saat ini. Melakukan pencarian pada alat bantu itu tadi ke database yang dimiliki. database tersebut mengkoleksi situs-situs yang ditemukan dan simpan.
alat bantu pencarian ini menyediakan hasil pencarian dalam bentuk hypertext link dengan URL menuju halaman lainnya. ketika anda klik link ini, dan menuju ke alamat tersebut maka dokumen, gambar, suara dan banyak lagi bentuk lainnya yang ada pada server tersebut disediakan, sesuai dengan informasi yang terdapat di dalamnya. layanan ini bisa menjangkau ke manapun di seluruh dunia.
Tidak mungkin seseorang untuk melakukan pencarian ke seluruh komputer yang terhubung internet ini, atau bahkan alat bantu pencarian yang mengklaim bahwa melakukannya, tidak benar

SUMBER : https://id.wikipedia.org/wiki/Mesin_pencari_web

KOMPONEN SEARCH ENGINE

1. Query Interface
Query interface adalah komponen penting pertama yang merupakan bentuk tampilan atau format situs yang menyediakan fasilitas searching engine. Bentuk yang paling sederhana adalah tersedianya sebuah kotak kosong di situs dimana user dapat menuliskan data atau informasi yang ingin dicari . Yang harus diketahui oleh user adalah bahwa tidak semua situs memiliki kemampuan yang sama dalam membantu user untuk mengekspresikan jenis data atau informasi yang ingin dicari. Dalam bahasa komputer cara mengekspresikan ini disebut sebagai query. Contohnya adalah seseorang yang ingin mencari data atau informasi mengenai hal-hal yang berkaitan dengan resep makanan jawa, dapat menggunakan query seperti: “resep”and “makanan” and “jawa”.
Walaupun secara internasional telah diusulkan dan ditentukan standar baku dalam menuliskan sebuah query, namun terlihat bahwa masing-masing situs menawarkan beragam cara yang berbeda. Yang utama bagi user adalah bahwa Query Interface yang ditawarkan mudah dipergunakan dan efektif.
2. Query Engine
Komponen kedua adalah Query Engine, merupakan sebuah program yang bertugas untuk menterjemahkan keinginan user ke dalam bahasa yang dimengerti oleh mesin komputer. Secara teknis, perusahaan-perusahaan penyedia search engine berlomba-lomba membuat query engine yang baik sehingga selain tepat dalam mengekspresikan keinginan user, dapat pula melakukan tugas pencarian secara cepat. Query Engine ini pulalah yang segera melakukan pencarian arsip dan dokumen yang tepat di dalam sistem basis data (database) yang bersangkutan.
3. Database
Database pada dasarnya merupakan kumpulan atau daftar dari dokumen maupun arsip dari seluruh situs yang ada di internet. Semakin besar skala internet, akan semakin besar pula kapasitas penyimpan yang dibutuhkan.
4. Spider
Spider merupakan komponen terpenting dalam sebuah searching engine. Secara berkala dan kontinyu, spider akan mendata setiap situs yang ada di internet, baik yang baru maupun yang lama. kepada masing-masing situs, selain alamatnya, akan diambil kata-kata kunci dari arsip maupun dokumen yang ditemukan. Katakanlah dari situs bukainfo.com akan diambil setiap kata pada kalimat judul artikel, disinilah sebenarnya persaingan antara situs terjadi, yaitu strategi dan teknik apa yang dipergunakan dalam melakukan sampling terhadap kata-kata yang akan menjadi kunci dalam pencarian arsip dan dokumen. Harap diingat bahwa tidak semua situs melakukan proses updating dan sampling ini secara kontinyu / 24 jam sehari, yang dapat menyebabkan telah hilangnya beberapa arsip dan dokumen dari internet saat user mencarinya.
5. Indexer
Indexer merupakan sebuah program untuk mempercepat proses pencarian. Filosofi yang dipergunakan mirip dengan prinsip penggunaan indeks pada kamus atau buku-buku. Perang antar situs pun terjadi di sini, karena teknik melakukan indeks akan sangat berpengaruh terhadap kecepatan pencarian data atau informasi. Biasanya yang terjadi di sini adalah adu algoritma ata alur logika sebuah program antar para programmer yang direkrut oleh masing-masing perusahaan. Berikut disajikan gambar yang memperlihatkan 5 (lima) komponen utama dari arsitektur sebuah program searching engine
SUMBER : https://bukainfo.com/pengertian-search-engine-atau-mesin-penelusur/

Profil Search Engine : Google

Merupakan sebuah perusahaan Amerika Serikat yang fokus pada jasa dan produk Internet. Search engine ini didirikan oleh Larry Page alumnus Universitas Michigan dan Sergey Brin. Google berasal dari kata Gogol yang mempunyai arti kata yang menunjukkan sebuah bilangan yang sangat besar jumlahnya melebihi bilangan miliar atau triliun.
Google adalah search engine yang paling populer dan banyak digunakan di dunia maya untuk mencari informasi yang diinginkan, dapat berupa pencarian alamat website, gambar, file, atau mengetahui situs – situs dan topik – topik yang paling populer yang dikunjungi orang melalui google trends.
Dengan adanya Google maka semua masalah yang membutuhkan waktu yang cepat ketika harus mencari file atau data di internet dapat diselesaikan dalam hanya hitungan detik saja. Hanya dengan mengetikan kata kunci yang akan kita cari, maka secara otomatis google akan memberikan jawaban yang diberikan melebihi dari yang kita inginkan.

SUMBER : http://ayufahrina14.blogspot.co.id/2013/10/macam-macam-search-egine.html