หอจดหมายเหตุอินเทอร์เน็ต ห้องสมุดดิจิทัลเพื่อการเข้าถึงความรู้ระดับโลก
สรุปใจความสำคัญ
- ก่อตั้งในปี ค.ศ. 1996 โดย บรูสเตอร์ คาห์เล เพื่อให้ทุกคนเข้าถึงความรู้ได้ฟรี
- Wayback Machine เป็นเครื่องมือหลักในการเก็บถาวรหน้าเว็บ ซึ่งปัจจุบันมีข้อมูลมากกว่า 1 ล้านล้านรายการ
- ให้บริการสื่อหลากหลายประเภท ทั้งเว็บไซต์ หนังสือ ซอฟต์แวร์ และสื่อมัลติมีเดีย
- เผชิญคดีความด้านลิขสิทธิ์กับสำนักพิมพ์รายใหญ่และค่ายเพลงระดับโลกเกี่ยวกับการให้ยืมหนังสือดิจิทัลและการเก็บแผ่นเสียงเก่า
หอจดหมายเหตุอินเทอร์เน็ต (Internet Archive) เป็นห้องสมุดดิจิทัลไม่แสวงหาผลกำไรของสหรัฐอเมริกา ก่อตั้งขึ้นในปี ค.ศ. 1996 โดย บรูสเตอร์ คาห์เล (Brewster Kahle) โดยมีพันธกิจหลักคือการสร้าง "การเข้าถึงความรู้ทั้งหมดอย่างเป็นสากล" (universal access to all knowledge) ผ่านเว็บไซต์ archive.org ซึ่งให้บริการเข้าถึงสื่อดิจิทัลที่ถูกแปลงเป็นรูปแบบดิจิทัลฟรี ทั้งในส่วนของเว็บไซต์ แอปพลิเคชันซอฟต์แวร์ ดนตรี โสตทัศนูปกรณ์ และสิ่งพิมพ์

ประวัติและการพัฒนา
บรูสเตอร์ คาห์เล ก่อตั้งหอจดหมายเหตุอินเทอร์เน็ตในเดือนพฤษภาคม ค.ศ. 1996 ในช่วงเวลาใกล้เคียงกับการก่อตั้งบริษัท Alexa Internet ซึ่งเป็นบริษัทเก็บข้อมูลเว็บเพื่อการค้า โดยหน้าเว็บหน้าแรกที่ถูกเก็บถาวรคือฉบับเดือนธันวาคม ค.ศ. 1996 ของหนังสือพิมพ์ USA Today และภายในเดือนตุลาคมของปีเดียวกัน ทางหอจดหมายเหตุฯ ได้เริ่มดำเนินการเก็บรวบรวมข้อมูลจาก World Wide Web ในปริมาณมหาศาล
ในปี ค.ศ. 2001 ได้มีการเปิดตัว Wayback Machine ซึ่งทำให้สาธารณชนสามารถเข้าถึงเนื้อหาที่ถูกเก็บถาวรได้ง่ายขึ้น ต่อมาในปี ค.ศ. 1999 หอจดหมายเหตุฯ ได้ขยายขอบเขตการจัดเก็บให้ครอบคลุมมากกว่าเพียงแค่หน้าเว็บ โดยเริ่มจาก Prelinger Archives และขยายไปยังข้อความ เสียง ภาพเคลื่อนไหว และซอฟต์แวร์

โครงการสำคัญภายใต้การดำเนินงาน
- Wayback Machine: ระบบเก็บถาวรเว็บที่ปัจจุบันมีข้อมูลการบันทึกหน้าเว็บมากกว่า 1 ล้านล้านครั้ง
- Open Library: โครงการสร้างแคตตาล็อกห้องสมุดแบบวิกิที่เปิดให้แก้ไขได้ เพื่อให้ข้อมูลเกี่ยวกับหนังสือทุกเล่มที่เคยตีพิมพ์
- Archive-It: บริการเก็บถาวรเว็บแบบสัญญาจ้างสำหรับองค์กร
- NASA Images Archive: การจัดเก็บและให้บริการรูปภาพจากองค์การนาซา
การดำเนินงานและรูปแบบการจัดเก็บข้อมูล
ข้อมูลส่วนใหญ่ของหอจดหมายเหตุอินเทอร์เน็ตถูกรวบรวมโดยอัตโนมัติผ่านโปรแกรมเก็บข้อมูลเว็บ (Web Crawlers) เพื่อรักษาเนื้อหาบนเว็บสาธารณะให้ได้มากที่สุด อย่างไรก็ตาม ทางหอจดหมายเหตุฯ ยังเปิดให้สาธารณชนสามารถอัปโหลดเนื้อหาดิจิทัลเข้าสู่ระบบได้ด้วยตนเอง
ในส่วนของสิ่งพิมพ์ ทางหอจดหมายเหตุฯ ได้รับบริจาคหนังสือและสื่อต่างๆ จำนวนมาก เช่น แผ่นเสียง 78 rpm จากห้องสมุดสาธารณะบอสตันในปี ค.ศ. 2017 และหนังสือจากมหาวิทยาลัยเทรนต์ในปี ค.ศ. 2018 โดยใช้หลักการ Controlled Digital Lending (CDL) ซึ่งเป็นการให้ยืมหนังสือดิจิทัลทีละเล่มตามจำนวนเล่มที่มีอยู่จริงในรูปแบบเล่มพิมพ์
ข้อพิพาททางกฎหมาย
การดำเนินงานของหอจดหมายเหตุอินเทอร์เน็ตเผชิญกับความท้าทายทางกฎหมายที่สำคัญ โดยเฉพาะในประเด็นลิขสิทธิ์:
- คดีการให้ยืมหนังสือดิจิทัล: ในปี ค.ศ. 2020 สำนักพิมพ์รายใหญ่ 4 แห่ง ได้แก่ Hachette Book Group, Penguin Random House, HarperCollins และ John Wiley ได้ยื่นฟ้องต่อศาลแขวงสหรัฐฯ เขตใต้แห่งนิวยอร์ก โดยอ้างว่าการให้ยืมแบบ CDL เป็นการละเมิดลิขสิทธิ์ ซึ่งในวันที่ 25 มีนาคม ค.ศ. 2023 ศาลได้ตัดสินให้สำนักพิมพ์เป็นฝ่ายชนะ และสั่งห้ามไม่ให้หอจดหมายเหตุฯ ให้ยืมหนังสือดิจิทัลที่มีฉบับอิเล็กทรอนิกส์วางจำหน่ายอยู่
- คดีโครงการ Great 78: ในเดือนสิงหาคม ค.ศ. 2023 บริษัทยักษ์ใหญ่ในอุตสาหกรรมดนตรี เช่น Universal Music Group และ Sony Music ได้ยื่นฟ้องเรียกค่าเสียหาย 621 ล้านดอลลาร์สหรัฐ จากการละเมิดลิขสิทธิ์ในโครงการจัดเก็บแผ่นเสียงเก่า ซึ่งคดีนี้ได้ข้อยุติในเดือนกันยายน ค.ศ. 2025
ความร่วมมือและสถานะปัจจุบัน
ในเดือนกันยายน ค.ศ. 2024 Google และหอจดหมายเหตุอินเทอร์เน็ตได้ประกาศความร่วมมือในการนำลิงก์ของ Wayback Machine ไปใส่ไว้ในเมนู 'ข้อมูลเพิ่มเติมเกี่ยวกับหน้านี้' (more about this page) ใน Google Search เพื่อทดแทนบริการ Google Cache ที่ถูกยกเลิกไป
นอกจากนี้ ในวันที่ 24 กรกฎาคม ค.ศ. 2025 วุฒิสภาสหรัฐฯ ได้กำหนดให้หอจดหมายเหตุอินเทอร์เน็ตเป็น Federal Depository Library ซึ่งทำให้สามารถจัดเก็บระเบียนข้อมูลของรัฐบาลที่เปิดให้สาธารณชนเข้าถึงได้ และมีการเปิดสำนักงานใหญ่แห่งใหม่สำหรับสาขาในยุโรปเมื่อวันที่ 19 กันยายน ค.ศ. 2025
คำถามที่พบบ่อย
Wayback Machine คืออะไร?
Wayback Machine คือบริการเก็บถาวรเว็บของ Internet Archive ที่ช่วยให้ผู้ใช้สามารถย้อนกลับไปดูหน้าเว็บไซต์ในอดีตตามวันที่และเวลาที่ถูกบันทึกไว้ได้
Internet Archive ให้บริการฟรีหรือไม่?
ใช่ Internet Archive เป็นองค์กรไม่แสวงหาผลกำไรที่ให้บริการเข้าถึงคอลเลกชันสื่อดิจิทัลฟรีแก่สาธารณชน
Open Library แตกต่างจาก Internet Archive อย่างไร?
Open Library เป็นโครงการหนึ่งภายใต้ Internet Archive ที่เน้นการสร้างแคตตาล็อกหนังสือแบบวิกิ เพื่อให้ข้อมูลเกี่ยวกับหนังสือทุกเล่มที่เคยมีการตีพิมพ์
Internet Archive เก็บข้อมูลเว็บไซต์ได้อย่างไร?
ส่วนใหญ่ใช้โปรแกรมเก็บข้อมูลเว็บอัตโนมัติ (Web Crawlers) ในการบันทึกหน้าเว็บสาธารณะ และยังเปิดให้ผู้ใช้ทั่วไปอัปโหลดเนื้อหาดิจิทัลได้ด้วยตนเอง