/blog/perl


substr() in Perl
[134779 mal gelesen]
foreach in Perl
[120641 mal gelesen]
Arrays in Perl - Besonderheiten
[114501 mal gelesen]
open() - Dateien öffnen in Perl
[101261 mal gelesen]
split() in Perl - Zeichenketten teilen
[97115 mal gelesen]
chomp() in Perl
[88013 mal gelesen]
grep - Listen durchsuchen in Perl
[85287 mal gelesen]
push in Perl
[83089 mal gelesen]
sleep in Perl - Das aktuelle Script warten lassen
[65779 mal gelesen]
print in Perl
[51879 mal gelesen]


Arrays
Dateien
HTPC
Hashes
Leistungsoptimiert
PHP
Perl
RegEx
Schleifen
Script
Skalare
Sonstiges
System
Webserver
Zur Startseite


Mittwoch, 21.2.2007, 13:40:30 Uhr

chomp() in Perl


Im Gegensatz zu chop() entfernt chomp() nur dann das letzte Zeichen eines Skalars (Strings) oder Arrays (Liste), wenn dieses Zeichen gleich dem Zeichen ist, das in $/ gesetzt ist. Hört sich jetzt etwas verquert an, also im Klartext:
In $/ ist das Zeichen enthalten, das als INPUT_RECORD_SEPARATOR bekannt ist. Normalerweise ist das das \n bzw. der Zeilenumbruch. Und jetzt kommt man der Sache schon näher: Es wird, wenn vorhanden, jeder Zeilenumbruch am Ende eines Skalars oder eines Arrayelements gelöscht.

Beispiel:

open (in,"<test.txt");
@a=<in>;
close in;
chomp (@a);


Hier wird eine fiktive Datei test.txt geöffnet und alle Werte werden eingelesen. Da jedes Arrayelement eine Zeile darstellt, kann man per chomp(@a) auf einen Schlag alle Zeilen vom abschließenden \n bereinigen.

Übrigens
Ich hab mir mal den Spaß gemacht und die Performance der folgenden drei Varianten getestet, natürlich in Bezug auf die Verarbeitungsgeschwindigkeit.

1. chomp (@a);
2. foreach (@a){$_=~ s/\n//;}
3. foreach (@a){chomp($_);}

Ergebnis:
Die schnellste Variante ist die Erste. Anscheinend kann Perl intern ziemlich gut optimieren. (22 Sekunden bei 10000 * 10000 Zeilen)
Die zweitschnellste Variante ist die 3. (31 Sekunden bei 10000 * 10000 Zeilen)
Die langsamste Variante ist die mit dem regulären Ausdruck (47 Sekunden bei 10000 * 10000 Zeilen). Hier sieht man, daß Reguläre Ausdrücke sehr mächtig und universell sind, aber eben auch langsam.

Was will mir der Autor damit sagen?
Also, die erste Variante kann man benutzen, wenn man keine allzu großen Dateien einlesen und verarbeiten muß.
Variante drei ist für große Dateien oder natürlich eizelne Zeilen. Die zweite Variante kann man eigentlich in die Tonne werfen, zumindest für diese Problemstellung.





Kommentare zum Beitrag "chomp() in Perl"

Kommentar von SoKoBan
Ich finde die Zeitvergleiche sehr interessant. Ich habe bisher immer via ~s eventuelle Zeilenumbrüche entfernt, aber jetzt werde ich wohl auch auf chomp umsteigen, wenn das so viel schneller ist. Danke für den Hinweis!

Kommentar von mad
Ich hab auch immer eine Konstrukt wie Lösung 3 verwendet, aber wenn Perl intern so efektiv arbeitet lohnt sich der Umwege nicht.

Kommentar von Oliver Victor
Mich würde mal interessieren, wie schnell es wäre, wenn man dem regulären Ausdruck das "o"-flag hinzufügen würde (also regex nur 1x analysieren und nicht bei jedem Schleifendurchlauf).

Kommentar von perluser
Bei
foreach (@a){$_=~ s/\n//;}
muss jedes Zeichen überprüft werden. Für einen fairen Vergleich sollte der Ausdruck wie folgt heissen:
foreach (@a){$_=~ s/\n$//;}
In diesem Fall wird nur das letzte Zeichen überprüft, so wie bei chomp auch. Das sollte also schneller sein.



Thema: Perl Skalare Arrays Leistungsoptimiert

Der Beitrag "chomp() in Perl" wurde 88014 mal gelesen.

Es wurde 23 x über diesen Beitrag abgestimmt.
Die durchschnittliche Beurteilung liegt bei
1.3 (1 = sehr gut - 6 = grottenschlecht).

Kommentar schreiben  Druckansicht  Seitenanfang 
Beurteilen 






 Zufällige Beiträge im /blog/perl

Doppelte Einträge aus Array entfernen in Perl

reverse in Perl()

ord() in Perl - ASCII-Zeichenwert eines Zeichens ermitteln

Mein Cache-Modul für Perl - Fortsetzung

Doppelte Elemente aus Array entfernen - Und die Reihenfolge beibehalten!

die - Perl-Script wegen eines Fehlers abbrechen

values() - Alle Werte eines Hashes ermitteln

seek() - Dateizeiger neu positionieren

Perl-Scripte einbinden in Webseiten mit SHTML-Dateien

head einer Webseite einlesen mit Statuscode



0.0173759460449219 sec. to build



...Blogsoftware in pure Perl - Powered by a lot of Coffee...


SSD-Festplatte - Wassn das???
Die Transliteration - Nur ein Zeichen in einem Skalar ersetzen
Select - Case in Perl
Windows 7 XP Mode – Wo finde ich den XP-Modus unter Windows 7?
Mac-Adresse beim Apple Macintosh herausfinden
SGN-Funktion für Perl
truncate - Dateigröße verändern in Perl
Eigene IP herausfinden mit Perl
Epoche live in Datum umwandeln
Firefox 3 - Exe-Files downloaden


Von: Hummel
Kommentar:
@ Peter

Zum Beitrag


Von: Fabian
Kommentar:
Hallo zusammen,
ich suche schon etwas im Internet und bin bisher nicht fündig geworden.
Zum Beitrag


Von: Schorschel eastcoast
Kommentar:
Danke. Das hat mir weitergeholfen.
Zum Beitrag


Von: Jessica
Kommentar:
Kann man auch zwei Datein parallel einlesen?

Zum Beitrag


Von: Xtravaganz
Kommentar:
Für

Zum Beitrag



Gesamtverzeichnis
Februar 2010
Dezember 2009
Oktober 2009
Januar 2009
Dezember 2008
November 2008
September 2008
August 2008
Juli 2008
Juni 2008
Mai 2008
April 2008
Januar 2008
Dezember 2007
November 2007
Oktober 2007
September 2007
August 2007
Juni 2007
Mai 2007
April 2007
März 2007
Februar 2007
Januar 2007
Dezember 2006


Mister Wong

RSS-Feed

Heute ist der
17.10.2019

Es ist
10:37:10 Uhr

Ihre IP:
3.227.233.78

Blog-Einträge: 186

Die letzten 24 Stunden im Überblick


Gelesene Beiträge insgesamt:
3882417


Webseiten vergleichen
Kalender mit Feiertagen - 2028
Links finden und testen
Menschliche Datumsangaben
IP zu Domain herausfinden
Time live in Datum umwandeln
Perl für Windows



Mo Di Mi Do Fr Sa So
123456
78910111213
14151617181920
21222324252627
28293031

Impressum