<?xml version="1.0"?>
<feed xmlns="http://www.w3.org/2005/Atom" xml:lang="de">
	<id>https://xinux.net/index.php?action=history&amp;feed=atom&amp;title=Deduplikation</id>
	<title>Deduplikation - Versionsgeschichte</title>
	<link rel="self" type="application/atom+xml" href="https://xinux.net/index.php?action=history&amp;feed=atom&amp;title=Deduplikation"/>
	<link rel="alternate" type="text/html" href="https://xinux.net/index.php?title=Deduplikation&amp;action=history"/>
	<updated>2026-08-24T00:38:31Z</updated>
	<subtitle>Versionsgeschichte dieser Seite in Xinux Wiki</subtitle>
	<generator>MediaWiki 1.35.1</generator>
	<entry>
		<id>https://xinux.net/index.php?title=Deduplikation&amp;diff=72906&amp;oldid=prev</id>
		<title>Thomas.will: Die Seite wurde neu angelegt: „'''Deduplikation''' bezeichnet das Erkennen und Zusammenfassen identischer Datenblöcke. Statt denselben Inhalt mehrfach zu speichern, wird er nur einmal abgel…“</title>
		<link rel="alternate" type="text/html" href="https://xinux.net/index.php?title=Deduplikation&amp;diff=72906&amp;oldid=prev"/>
		<updated>2026-08-20T05:13:10Z</updated>

		<summary type="html">&lt;p&gt;Die Seite wurde neu angelegt: „&amp;#039;&amp;#039;&amp;#039;Deduplikation&amp;#039;&amp;#039;&amp;#039; bezeichnet das Erkennen und Zusammenfassen identischer Datenblöcke. Statt denselben Inhalt mehrfach zu speichern, wird er nur einmal abgel…“&lt;/p&gt;
&lt;p&gt;&lt;b&gt;Neue Seite&lt;/b&gt;&lt;/p&gt;&lt;div&gt;'''Deduplikation''' bezeichnet das Erkennen und Zusammenfassen identischer Datenblöcke. Statt denselben Inhalt mehrfach zu speichern, wird er nur einmal abgelegt; alle weiteren Vorkommen verweisen auf denselben Block. Das spart Platz, ohne dass für den Nutzer etwas anders aussieht – jede Datei bleibt als eigene Datei sichtbar.&lt;br /&gt;
&lt;br /&gt;
=Wie es funktioniert=&lt;br /&gt;
*Über jeden Block wird eine Prüfsumme (Hash) gebildet.&lt;br /&gt;
*Treffen zwei Blöcke auf denselben Hash, wird der zweite nicht neu geschrieben, sondern durch einen Verweis auf den ersten ersetzt.&lt;br /&gt;
*Ändert sich später einer der Blöcke, wird dank Copy-on-Write eine eigene Kopie angelegt – die anderen Verweise bleiben unberührt.&lt;br /&gt;
&lt;br /&gt;
=Zwei Zeitpunkte=&lt;br /&gt;
;Inline&lt;br /&gt;
*Die Prüfung läuft schon beim Schreiben. Doppelte Blöcke landen gar nicht erst auf der Platte. Kostet Rechenzeit und Arbeitsspeicher während des Schreibens.&lt;br /&gt;
;Offline (nachgelagert)&lt;br /&gt;
*Die Daten werden zunächst normal geschrieben, ein späterer Lauf sucht die Dubletten und räumt auf. Belastet das laufende Schreiben nicht, braucht aber zwischenzeitlich den vollen Platz.&lt;br /&gt;
&lt;br /&gt;
=Bei Btrfs=&lt;br /&gt;
Btrfs beherrscht keine automatische Inline-Deduplikation im Kernel. Stattdessen arbeitet man nachgelagert mit Zusatzwerkzeugen wie &amp;lt;code&amp;gt;duperemove&amp;lt;/code&amp;gt; oder &amp;lt;code&amp;gt;bees&amp;lt;/code&amp;gt;, die das Dateisystem nach gleichen Blöcken durchsuchen und sie über den Reflink-Mechanismus zusammenlegen.&lt;br /&gt;
&lt;br /&gt;
=Abgrenzung=&lt;br /&gt;
*'''Deduplikation''' entfernt ''gleiche'' Blöcke über Dateigrenzen hinweg – auch zwischen völlig verschiedenen Dateien.&lt;br /&gt;
*'''Kompression''' verkleinert die Blöcke selbst, unabhängig davon, ob sie doppelt vorkommen.&lt;br /&gt;
*Beides lässt sich kombinieren.&lt;br /&gt;
&lt;br /&gt;
=Wo es sich lohnt=&lt;br /&gt;
*Viele ähnliche virtuelle Maschinen oder Container-Images.&lt;br /&gt;
*Backup-Server mit vielen fast identischen Ständen.&lt;br /&gt;
*Weniger sinnvoll bei bereits einzigartigen Daten (Fotos, Videos, verschlüsselte Dateien) – dort findet die Deduplikation kaum Dubletten und kostet nur Rechenzeit.&lt;/div&gt;</summary>
		<author><name>Thomas.will</name></author>
	</entry>
</feed>