İçeriğe geç

Web Archive Site Geri Yükleme: Nasıl Yapılır, Yasal mı?

Web archive site geri yükleme nasıl yapılır? Wayback Machine’den eski sayfaları indirmenin yollarını ve içeriği aynen yayınlamanın telif riskini anlatıyoruz.

6 dk okuma

Web archive site geri yükleme, silinmiş ya da kapanmış bir sitenin eski sayfalarını arşiv kayıtlarından çıkarıp yeniden kullanılabilir hale getirmektir. Bunun için en bilinen kaynak Wayback Machine, yani archive.org’un ücretsiz web arşividir. Teknik olarak sayfaları indirmek mümkün. Asıl soru, indirdiğini ne yapacağın: içerik hâlâ eski sahibine ait olduğu için metni aynen yayınlamak telif sorunu yaratır ve eski bir domaini kullanıyorsan SEO tarafında da işine yaramaz. Aşağıda arşivden ne alınabildiğini, tek sayfa ve toplu indirme yollarını, telif sınırını ve güvenli kullanımı bulacaksın.

Arşivden ne alınabilir

Wayback Machine, bir sitenin belirli tarihlerdeki kopyalarını (capture) saklar. Her kopya, o günkü HTML’i ve o anda erişilebilen kaynakları içerir. Pratikte üç şey işine yarar:

  • HTML ve metin. Sayfanın yapısını, başlıklarını, menüsünü ve metnini görebilirsin.
  • Görseller, CSS ve script dosyaları. Arşiv bunları da kaydetmeye çalışır, ama her zaman başarılı olmaz. Eksik kalan görseller yaygındır.
  • URL listesi. Sitenin arşivde hangi adreslerinin kayıtlı olduğunu görebilirsin. Bu, eski site yapısını anlamak için en değerli veridir.

Önemli bir sınır var: kopyalar örneklemedir. Arşiv bir sitenin her gününü kaydetmez. Bu yüzden belirli bir sayfanın ya da kısa bir dönemin kaydı hiç bulunmayabilir. Wayback Machine’in nasıl okunacağını Wayback Machine nasıl kullanılır yazısında adım adım anlattık.

Tek sayfa ve toplu indirme yöntemleri

Tek sayfa için

Küçük işlerde elle ilerlemek yeterli:

  1. web.archive.org adresine git ve sitenin adresini yaz.
  2. Takvim görünümünde kayıtların olduğu yılı ve günü seç. Sitenin en dolu ve en tutarlı döneminden bir kopya seçmek genellikle işe yarar. Son aylardaki kopyalar, site kapanırken bozulmuş ya da boşalmış olabilir.
  3. Kopyayı aç ve sayfanın içeriğini, görsellerini ve yapısını incele.
  4. İhtiyacın olan metni ya da yapıyı not al. Sayfayı tarayıcıdan kaydedebilirsin, ama arşivin eklediği yönlendirmelerin ve kaynak adreslerinin kaydedilen dosyaya karışabileceğini unutma.

Tüm site için

Arşivde sitenin hangi adresleri olduğunu görmek için sitenin adresinin sonuna /* ekleyerek arşiv URL görünümünü açabilirsin. Bu görünüm, arşivde kayıtlı adresleri listeler. Listeyi elle taramak küçük siteler için yeterli olur.

Büyük siteler için toplu indirme araçları var. "Wayback machine downloader" adıyla anılan, çoğu üçüncü taraf geliştiricilerin yazdığı bu araçlar, arşivdeki kopyaları sırayla indirir. Hangi aracı seçersen seç, şunlara dikkat et:

  • Araç archive.org’un kendi ürünü olmayabilir. Çalışma şeklini ve sınırlarını aracın kendi dokümantasyonundan öğren.
  • Toplu istekler arşiv sunucusunu yorar. Hız sınırlarına saygı göster ve istekleri yavaş gönder, aksi halde erişimin engellenebilir.
  • İndirilen dosyaların eksik ya da bozuk çıkabileceğini baştan kabul et. Arşiv örneklemeli olduğu için tam bir kopya beklememelisin.

Telif: içerik eski sahibine aittir

Bu bölüm bir hukuki tavsiye değildir, ama temel mantığı bilmek gerekir. Bir site kapanmış ya da domaini düşmüş olması, içeriğinin sahipsiz olduğu anlamına gelmez. Metinler, fotoğraflar, çizimler ve tasarımlar genellikle yazarlarının ya da eski site sahibinin hakkıdır. Arşivde herkese açık görünmesi, onu yeniden yayınlama izni vermez.

Domaini sen satın almış olman da bu hakları sana devretmez. Domain bir adrestir. Üzerinde yayınlanmış içerik ise ayrı bir mülkiyettir. Eski sitenin metinlerini aynen yayınlarsan hem telif sahibiyle sorun yaşayabilirsin, hem de bu içerik arama motorları için kopya sayılır. Ayrıca arşivden alınan içerik yıllar önce yayınlanmış olduğu için bilgi eskimiş de olabilir.

Telifle ilgili kesin sorular için bir avukata danış. Hangi içeriğin serbestçe kullanılabildiğini lisansından ve yasalardan öğrenmek gerekir, bir tahmin yürütmek riskli olur.

Güvenli kullanım: yapı ve konu için referans, metni yeniden yaz

Arşivi yasal ve SEO açısından en güvenli kullanmanın yolu, onu bir referans kaynağı olarak görmektir:

  • Yapıyı referans al. Eski sitenin menüsünü, kategori yapısını ve hangi konulara odaklandığını incele. Bu bilgi, yeni sitenin planını çıkarırken zaman kazandırır.
  • Konuyu referans al. Eski sitenin hangi sorulara cevap verdiğini, hangi sayfalarının en çok işe yaradığını anla.
  • Metni sıfırdan yaz. Eski içeriği kopyalamak yerine aynı konuyu kendi bilginle, güncel bilgiyle ve kendi cümlelerinle yeniden anlat.
  • URL’leri değerlendir. Eski adreslerin hangilerine hâlâ link geliyorsa o sayfaların karşılığını yeni sitede oluşturmak mantıklı olabilir. Böyle sayfalar için yeni sitede aynı konuda güncel bir sayfa kurmak, eski linklerin değerini kullanmanın en temiz yoludur.

Küçük bir örnek verelim. Eski bir seyahat blogunun arşivinde 40 sayfalık bir yapı görüyorsun: şehir rehberleri, otel yazıları ve bir "gezi ipuçları" kategorisi. Bu yapıyı kopyalamana gerek yok, ama hangi şehirlerin en çok sayfa aldığını görmek yeni sitenin içerik planını hızla çıkarmana yardım eder. Sonra her şehir rehberini güncel bilgiyle, kendi gezi notlarınla ve kendi cümlelerinle yazarsın. Sonuçta ortaya çıkan site eski sitenin konusunu sürdürür, ama içeriği sana aittir.

Bu yaklaşımın SEO tarafında da bir avantajı var. Google, expired domain abuse politikasında kullanıcıya çok az değer sunan ya da hiç sunmayan içeriği hedefler. Arşivden kopyalanmış, güncel olmayan ve özgün olmayan bir site de bu tarife yaklaşabilir. Politikanın ayrıntıları expired domain abuse nedir yazısında. Eski bir domaini doğru yoldan canlandırma adımları ise expired domain canlandırma rehberinde.

Kendi eski siten ise

Eğer geri getirmek istediğin site senin kendi sitense durum çok daha rahat. İçerik sana ait olduğu için arşivdeki kopyalardan metinlerini, görsellerini ve yapını doğrudan kurtarabilirsin. Yine de birkaç kontrol yap:

  • Metinleri ya da görselleri bir başkasından aldıysan (stok görsel, serbest çalışan yazar, ajans) lisans ve sözleşme koşullarına bak. Hakların sende olmayabilir.
  • Eski bilgilerin güncel olup olmadığını kontrol et. Fiyat, mevzuat ya da teknik bilgiler yıllar içinde değişir.
  • Arşivde eksik kalan sayfaları ve görselleri kendi yedeklerinden, e-postalarından ya da eski bir hosting hesabından tamamlamaya çalış.

Yeni bir domain kullanıyorsan eski adreslerden yenilerine yönlendirme kurmayı unutma, böylece eski linkler ve ziyaretçiler boşa gitmez.

Eksik kayıtlarla baş etmek

Arşiv her zaman istediğin sayfayı vermez. Eksik kayıtlarla karşılaşırsan şunları deneyebilirsin:

  1. Farklı tarihlere bak. Aynı sayfanın başka bir yıldaki ya da başka bir aydaki kopyası dolu olabilir.
  2. URL varyasyonlarını dene. Adresin sonunda eğik çizgi olup olmaması, www ile www’siz sürüm ya da http ve https farkı ayrı kayıtlar olarak tutulmuş olabilir.
  3. Sitenin başka sayfalarından izle. Ana sayfa ya da site haritası kayıtlıysa, oradan iç linklerle diğer sayfalara ulaşmayı dene.
  4. Konuyu sıfırdan kur. Kayıp bir sayfanın yerine, yapıyı ve konuyu referans alarak yeni bir sayfa yazmak çoğu zaman en temiz çözümdür.
  5. Geçmişi yıllar boyunca oku. Tek bir kopyaya bakmak yetmez. Sitenin ilk yılını, ortasını ve son yıllarını karşılaştırmak, neyin kaybolduğunu anlamana yardım eder. Bunun için domain geçmişi sorgulama yazısındaki kontrolleri kullanabilirsin.

hunter.domains’te Pro planda yer alan canlandırma paketi (revival kit), bir domainin eski URL’lerini ve arşivlenmiş içeriğini bir arada gösterir. Böylece hangi sayfaların kayıtlı olduğunu tek tek aramadan görebilirsin. Sonuçlanmış domainlerin geçmişine de arşiv sayfasından bakabilirsin. Ücretsiz plan ve Pro farkı için fiyatlar sayfasına, filtrelemenin nasıl çalıştığı için yöntem sayfasına ve güncel adaylar için domain listesine göz at. Eski domainlerin taşıdığı riskleri de expired domain riskleri yazısından okuyabilirsin.

Sık sorulan sorular

Arşivdeki içeriği kendi sitemde yayınlayabilir miyim?

Yalnızca içerik sana aitse. Arşivde herkese açık olması, yeniden yayınlama izni vermez; metin ve görseller genellikle eski sahibinin hakkıdır. Domaini satın almak da içeriğin haklarını devretmez. Güvenli yol, eski içeriği referans alıp metni kendi cümlelerinle yeniden yazmaktır. Bu bir hukuki tavsiye değildir, emin olamadığın durumda bir avukata danış.

Wayback Machine’den site indirmek ücretsiz mi?

Wayback Machine’i kullanmak ve kopyaları görüntülemek ücretsizdir. Toplu indirme için kullanılan üçüncü taraf araçlar ise kendi koşullarına sahip olabilir, bazıları ücretsiz bazıları ücretli olabilir. Ücret ve kullanım koşulları için aracın kendi sayfasını kontrol et.

Görseller de kurtarılır mı?

Kısmen. Arşiv, sayfalardaki görselleri de kaydetmeye çalışır, ama kopyalar örneklemedir ve görsellerin bir kısmı eksik kalabilir. Bazı sayfalar görselleri olmadan açılır. Eksik görselleri başka bir tarihteki kopyada aramak ya da kendi kaynaklarından tamamlamak gerekebilir. Görselin telifi de sayfanın metni gibi eski sahibine aittir.

İlgili yazılar

Bir sonraki iyi domaini kaçırma.

Kuralını kur, gerisini bize bırak. Uyan domain bulunduğu an haberin olur.

Ücretsiz başla