/blog/perl


substr() in Perl
[138998 mal gelesen]
foreach in Perl
[122711 mal gelesen]
Arrays in Perl - Besonderheiten
[117235 mal gelesen]
open() - Dateien öffnen in Perl
[103202 mal gelesen]
split() in Perl - Zeichenketten teilen
[101025 mal gelesen]
chomp() in Perl
[89640 mal gelesen]
grep - Listen durchsuchen in Perl
[87013 mal gelesen]
push in Perl
[85415 mal gelesen]
sleep in Perl - Das aktuelle Script warten lassen
[68031 mal gelesen]
print in Perl
[53053 mal gelesen]


Arrays
Dateien
HTPC
Hashes
Leistungsoptimiert
PHP
Perl
RegEx
Schleifen
Script
Skalare
Sonstiges
System
Webserver
Zur Startseite


Mittwoch, 21.2.2007, 13:40:30 Uhr

chomp() in Perl


Im Gegensatz zu chop() entfernt chomp() nur dann das letzte Zeichen eines Skalars (Strings) oder Arrays (Liste), wenn dieses Zeichen gleich dem Zeichen ist, das in $/ gesetzt ist. Hört sich jetzt etwas verquert an, also im Klartext:
In $/ ist das Zeichen enthalten, das als INPUT_RECORD_SEPARATOR bekannt ist. Normalerweise ist das das \n bzw. der Zeilenumbruch. Und jetzt kommt man der Sache schon näher: Es wird, wenn vorhanden, jeder Zeilenumbruch am Ende eines Skalars oder eines Arrayelements gelöscht.

Beispiel:

open (in,"<test.txt");
@a=<in>;
close in;
chomp (@a);


Hier wird eine fiktive Datei test.txt geöffnet und alle Werte werden eingelesen. Da jedes Arrayelement eine Zeile darstellt, kann man per chomp(@a) auf einen Schlag alle Zeilen vom abschließenden \n bereinigen.

Übrigens
Ich hab mir mal den Spaß gemacht und die Performance der folgenden drei Varianten getestet, natürlich in Bezug auf die Verarbeitungsgeschwindigkeit.

1. chomp (@a);
2. foreach (@a){$_=~ s/\n//;}
3. foreach (@a){chomp($_);}

Ergebnis:
Die schnellste Variante ist die Erste. Anscheinend kann Perl intern ziemlich gut optimieren. (22 Sekunden bei 10000 * 10000 Zeilen)
Die zweitschnellste Variante ist die 3. (31 Sekunden bei 10000 * 10000 Zeilen)
Die langsamste Variante ist die mit dem regulären Ausdruck (47 Sekunden bei 10000 * 10000 Zeilen). Hier sieht man, daß Reguläre Ausdrücke sehr mächtig und universell sind, aber eben auch langsam.

Was will mir der Autor damit sagen?
Also, die erste Variante kann man benutzen, wenn man keine allzu großen Dateien einlesen und verarbeiten muß.
Variante drei ist für große Dateien oder natürlich eizelne Zeilen. Die zweite Variante kann man eigentlich in die Tonne werfen, zumindest für diese Problemstellung.





Kommentare zum Beitrag "chomp() in Perl"

Kommentar von SoKoBan
Ich finde die Zeitvergleiche sehr interessant. Ich habe bisher immer via ~s eventuelle Zeilenumbrüche entfernt, aber jetzt werde ich wohl auch auf chomp umsteigen, wenn das so viel schneller ist. Danke für den Hinweis!

Kommentar von mad
Ich hab auch immer eine Konstrukt wie Lösung 3 verwendet, aber wenn Perl intern so efektiv arbeitet lohnt sich der Umwege nicht.

Kommentar von Oliver Victor
Mich würde mal interessieren, wie schnell es wäre, wenn man dem regulären Ausdruck das "o"-flag hinzufügen würde (also regex nur 1x analysieren und nicht bei jedem Schleifendurchlauf).

Kommentar von perluser
Bei
foreach (@a){$_=~ s/\n//;}
muss jedes Zeichen überprüft werden. Für einen fairen Vergleich sollte der Ausdruck wie folgt heissen:
foreach (@a){$_=~ s/\n$//;}
In diesem Fall wird nur das letzte Zeichen überprüft, so wie bei chomp auch. Das sollte also schneller sein.



Thema: Perl Skalare Arrays Leistungsoptimiert

Der Beitrag "chomp() in Perl" wurde 89641 mal gelesen.

Es wurde 23 x über diesen Beitrag abgestimmt.
Die durchschnittliche Beurteilung liegt bei
1.3 (1 = sehr gut - 6 = grottenschlecht).

Kommentar schreiben  Druckansicht  Seitenanfang 
Beurteilen 






 Zufällige Beiträge im /blog/perl

Parameter-Übergabe an ein Perl-Script mit CGI

Die Perl-Blog-Software

Doppelte Elemente aus Array entfernen - Und die Reihenfolge beibehalten!

Zugriff auf bestimmte Webseiten sperren unter Windows XP

The until-command in Perl

Feiertage eines beliebigen Jahres errechnen mit Perl

length() in Perl

Google Sitemaps - Script zur Erstellung einer Sitemap-Datei für Google

die - Perl-Script wegen eines Fehlers abbrechen

Elemente eines Arrays in einem Hash löschen - Die schnelle Methode



0.0305228233337402 sec. to build



...Blogsoftware in pure Perl - Powered by a lot of Coffee...


SSD-Festplatte - Wassn das???
Die Transliteration - Nur ein Zeichen in einem Skalar ersetzen
Select - Case in Perl
Windows 7 XP Mode – Wo finde ich den XP-Modus unter Windows 7?
Mac-Adresse beim Apple Macintosh herausfinden
SGN-Funktion für Perl
truncate - Dateigröße verändern in Perl
Eigene IP herausfinden mit Perl
Epoche live in Datum umwandeln
Firefox 3 - Exe-Files downloaden


Von: Hummel
Kommentar:
@ Peter

Zum Beitrag


Von: Fabian
Kommentar:
Hallo zusammen,
ich suche schon etwas im Internet und bin bisher nicht fündig geworden.
Zum Beitrag


Von: Schorschel eastcoast
Kommentar:
Danke. Das hat mir weitergeholfen.
Zum Beitrag


Von: Jessica
Kommentar:
Kann man auch zwei Datein parallel einlesen?

Zum Beitrag


Von: Xtravaganz
Kommentar:
Für

Zum Beitrag



Gesamtverzeichnis
Februar 2010
Dezember 2009
Oktober 2009
Januar 2009
Dezember 2008
November 2008
September 2008
August 2008
Juli 2008
Juni 2008
Mai 2008
April 2008
Januar 2008
Dezember 2007
November 2007
Oktober 2007
September 2007
August 2007
Juni 2007
Mai 2007
April 2007
März 2007
Februar 2007
Januar 2007
Dezember 2006


Mister Wong

RSS-Feed

Heute ist der
7.7.2020

Es ist
7:17:20 Uhr

Ihre IP:
3.236.108.61

Blog-Einträge: 186

Die letzten 24 Stunden im Überblick


Gelesene Beiträge insgesamt:
3984682


Webseiten vergleichen
Kalender mit Feiertagen - 2028
Links finden und testen
Menschliche Datumsangaben
IP zu Domain herausfinden
Time live in Datum umwandeln
Perl für Windows



Mo Di Mi Do Fr Sa So
12345
6789101112
13141516171819
20212223242526
2728293031

Impressum