Notice: This page requires JavaScript to function properly.
Please enable JavaScript in your browser settings or update your browser.
Lernen TXT-Dateien | Dateien in Pandas Einlesen
Einführung in Pandas

TXT-Dateien

Um Textdateien in pandas zu lesen, kann dieselbe Funktion pd.read_csv() verwendet werden. Damit die Textdatei korrekt eingelesen wird, ist es jedoch wichtig, einen zusätzlichen Parameter namens sep zu verwenden, der für Separator oder Trennzeichen im Text steht.

# Importing pandas library
import pandas as pd

# Reading a text file into a DataFrame
text_data = pd.read_csv('file.txt', sep='\r', header=None)

Falls die Textdatei keine Kopfzeile mit Spaltennamen enthält, sollte der Parameter header auf None gesetzt werden. Dadurch wird pandas mitgeteilt, die erste Zeile nicht als Spaltennamen zu behandeln.

Note
Hinweis

Um einen Zeilenumbruch als Trennzeichen in einer Datei zu verwenden, was bei Textdateien üblich ist, wird sep='\r' gesetzt. Hierbei steht '\r' für einen Wagenrücklauf, ein Sonderzeichen, das einen Zeilenumbruch kennzeichnet.

Einzelne Zeile extrahieren

Nachdem die Textdatei in ein DataFrame geladen wurde, können einzelne Zeilen mit .iloc[] und der gewünschten Positionsangabe abgerufen werden:

# Extracting the first row
first_row = text_data.iloc[0]
Note
Hinweis

Wenn Sie eine einzelne Zeile (oder eine einzelne Spalte) aus einem DataFrame auswählen, gibt pandas kein weiteres DataFrame zurück – sondern eine Series. Eine Series ist ein eindimensionales, beschriftetes Array. Das bedeutet, sie enthält eine einzelne Sequenz von Werten zusammen mit einem Index, aber keine separate Spaltenstruktur. Deshalb sieht first_row etwas anders aus und verhält sich auch anders als text_data: Es gibt keine .columns, und beim Ausgeben wird der Index neben jedem Wert angezeigt, anstatt einer tabellarischen Darstellung.

War alles klar?

Wie können wir es verbessern?

Danke für Ihr Feedback!

Abschnitt 2. Kapitel 2
single

single

TXT-Dateien

Swipe um das Menü anzuzeigen

Um Textdateien in pandas zu lesen, kann dieselbe Funktion pd.read_csv() verwendet werden. Damit die Textdatei korrekt eingelesen wird, ist es jedoch wichtig, einen zusätzlichen Parameter namens sep zu verwenden, der für Separator oder Trennzeichen im Text steht.

# Importing pandas library
import pandas as pd

# Reading a text file into a DataFrame
text_data = pd.read_csv('file.txt', sep='\r', header=None)

Falls die Textdatei keine Kopfzeile mit Spaltennamen enthält, sollte der Parameter header auf None gesetzt werden. Dadurch wird pandas mitgeteilt, die erste Zeile nicht als Spaltennamen zu behandeln.

Note
Hinweis

Um einen Zeilenumbruch als Trennzeichen in einer Datei zu verwenden, was bei Textdateien üblich ist, wird sep='\r' gesetzt. Hierbei steht '\r' für einen Wagenrücklauf, ein Sonderzeichen, das einen Zeilenumbruch kennzeichnet.

Einzelne Zeile extrahieren

Nachdem die Textdatei in ein DataFrame geladen wurde, können einzelne Zeilen mit .iloc[] und der gewünschten Positionsangabe abgerufen werden:

# Extracting the first row
first_row = text_data.iloc[0]
Note
Hinweis

Wenn Sie eine einzelne Zeile (oder eine einzelne Spalte) aus einem DataFrame auswählen, gibt pandas kein weiteres DataFrame zurück – sondern eine Series. Eine Series ist ein eindimensionales, beschriftetes Array. Das bedeutet, sie enthält eine einzelne Sequenz von Werten zusammen mit einem Index, aber keine separate Spaltenstruktur. Deshalb sieht first_row etwas anders aus und verhält sich auch anders als text_data: Es gibt keine .columns, und beim Ausgeben wird der Index neben jedem Wert angezeigt, anstatt einer tabellarischen Darstellung.

Aufgabe

Wischen, um mit dem Codieren zu beginnen

Sie erhalten eine URL zu einer TXT-Datei, die als Zeichenkette in der Variablen file_url gespeichert ist.

  1. Lesen Sie die TXT-Datei in ein DataFrame mit dem Namen text_data ein. Jede Zeile in der Datei ist durch einen Wagenrücklauf ('\r') getrennt. Die Datei enthält keine Spaltennamen, daher den Parameter header entsprechend setzen.
  2. Extrahieren Sie anschließend die erste Zeile des DataFrame und speichern Sie diese in einer Variablen namens first_row.

Lösung

Switch to desktopWechseln Sie zum Desktop, um in der realen Welt zu übenFahren Sie dort fort, wo Sie sind, indem Sie eine der folgenden Optionen verwenden
War alles klar?

Wie können wir es verbessern?

Danke für Ihr Feedback!

Abschnitt 2. Kapitel 2
single

single

Fragen Sie AI

expand

Fragen Sie AI

ChatGPT

Fragen Sie alles oder probieren Sie eine der vorgeschlagenen Fragen, um unser Gespräch zu beginnen

some-alt