webdata
การบีบไฟล์ขนาดใหญ่ให้เล็กลงเป็น zip ดูเหมือนมายากล แต่จริง ๆ แล้วอาศัยเทคนิคง่าย ๆ ในการจับรูปแบบซ้ำ ๆ ของข้อมูล
การบีบอัดไฟล์อาศัยการค้นหาแบบแผนที่ซ้ำ ๆ กันแล้วเขียนใหม่ด้วยสัญกรณ์ที่สั้นกว่า ชุดข้อมูลอย่าง 'AAAA' สามารถเก็บเป็น 'A คูณ 4' แทนที่จะเป็นตัวอักษรสี่ตัวแยกกัน และเนื่องจากไฟล์จริงเต็มไปด้วยการซ้ำแบบนี้ การเขียนใหม่นี้จึงลดขนาดไฟล์ลงได้ในขณะที่ยังคงคืนกลับเป็นต้นฉบับได้เต็มรูปแบบ
ไฟล์ไม่ได้มี 'พื้นที่ว่าง' ทางกายภาพที่ถูกบีบออกไปในความหมายตรงตัวใด ๆ และการบีบอัดแบบไม่สูญเสียข้อมูล (lossless) ก็ไม่ได้ลบเนื้อหาที่สำคัญน้อยกว่าออกไปด้วย คำอธิบายนั้นเป็นของการบีบอัดแบบสูญเสียข้อมูล (lossy) ซึ่งเป็นอีกประเภทหนึ่งไปเลย
ภาพ JPG และเสียง MP3 ใช้การบีบอัดแบบสูญเสียข้อมูลแทน ซึ่งจงใจทิ้งรายละเอียดปลีกย่อยที่ตากับหูมนุษย์แทบไม่สังเกตเห็น ทำให้ไฟล์เล็กลงได้มากกว่าวิธีแบบไม่สูญเสียข้อมูล แต่หมายความว่าข้อมูลต้นฉบับจะไม่มีทางกู้คืนได้อย่างสมบูรณ์แบบอีกในภายหลัง
webdata
กฎทั่วไปในการเลือกใช้ระหว่างสองคลื่นนี้คืออะไร?คุณทำอะไรได้บ้างที่นั่น?'สมุดโทรศัพท์ของอินเทอร์เน็ต' นี้คืออะไร?ตัวอักษร s ตัวเดียวนั้นหมายถึงอะไร?คุกกี้จริง ๆ แล้วคืออะไร?แคชคืออะไรกันแน่?ความจริงทางกายภาพที่ใกล้เคียงที่สุดเบื้องหลัง 'ฉันเซฟไว้บนคลาวด์' คืออะไร?IP address นี้ คำอธิบายไหนเหมาะสมที่สุด?ใน https://shop.example.com/items?id=42 ส่วน example.com เรียกว่าอะไร?ภาษาไหนที่เป็นมาตรฐานในการพูดคุยกับฐานข้อมูลมาครึ่งศตวรรษ?นามสกุลไฟล์นี้คืออะไร?เมื่อคนพูดว่า 'เซิร์ฟเวอร์ล่ม' เซิร์ฟเวอร์คืออะไรกันแน่?Quration — Quration AIQ