TXT-Filer
För att läsa textfiler i pandas kan du använda samma funktion, pd.read_csv(). För att säkerställa att textfilen läses in korrekt är det dock viktigt att använda en extra parameter som heter sep, vilket står för separator eller avgränsare i texten.
# Importing pandas library
import pandas as pd
# Reading a text file into a DataFrame
text_data = pd.read_csv('file.txt', sep='\r', header=None)
Om din textfil inte har en rubrikrad med kolumnnamn, ange parametern header till None. Detta informerar pandas om att inte behandla den första raden som kolumnnamn.
För att använda en ny rad som separator i en fil, vilket är vanligt i textfiler, ange sep='\r'. Här står '\r' för vagnretur, vilket är ett specialtecken som används för att markera en ny rad.
Extrahera en enskild rad
När din textfil har lästs in i en DataFrame kan du komma åt enskilda rader med hjälp av .iloc[] och ange positionen för den rad du vill ha:
# Extracting the first row
first_row = text_data.iloc[0]
När du väljer en enskild rad (eller en enskild kolumn) från en DataFrame, returnerar inte pandas en ny DataFrame — det returnerar en Series. En Series är en endimensionell märkt array, vilket innebär att den innehåller en enda sekvens av värden tillsammans med ett index, men ingen separat kolumnstruktur. Det är därför first_row kommer att se ut och fungera lite annorlunda än text_data: den har inte .columns, och när du skriver ut den visas indexet tillsammans med varje värde istället för en tabellayout.
Tack för dina kommentarer!
single
TXT-Filer
Svep för att visa menyn
För att läsa textfiler i pandas kan du använda samma funktion, pd.read_csv(). För att säkerställa att textfilen läses in korrekt är det dock viktigt att använda en extra parameter som heter sep, vilket står för separator eller avgränsare i texten.
# Importing pandas library
import pandas as pd
# Reading a text file into a DataFrame
text_data = pd.read_csv('file.txt', sep='\r', header=None)
Om din textfil inte har en rubrikrad med kolumnnamn, ange parametern header till None. Detta informerar pandas om att inte behandla den första raden som kolumnnamn.
För att använda en ny rad som separator i en fil, vilket är vanligt i textfiler, ange sep='\r'. Här står '\r' för vagnretur, vilket är ett specialtecken som används för att markera en ny rad.
Extrahera en enskild rad
När din textfil har lästs in i en DataFrame kan du komma åt enskilda rader med hjälp av .iloc[] och ange positionen för den rad du vill ha:
# Extracting the first row
first_row = text_data.iloc[0]
När du väljer en enskild rad (eller en enskild kolumn) från en DataFrame, returnerar inte pandas en ny DataFrame — det returnerar en Series. En Series är en endimensionell märkt array, vilket innebär att den innehåller en enda sekvens av värden tillsammans med ett index, men ingen separat kolumnstruktur. Det är därför first_row kommer att se ut och fungera lite annorlunda än text_data: den har inte .columns, och när du skriver ut den visas indexet tillsammans med varje värde istället för en tabellayout.
Svep för att börja koda
Du får en URL till en TXT-fil som är lagrad som en sträng i variabeln file_url.
- Läs in TXT-filen i en
DataFramemed namnettext_data. Varje rad i filen är separerad med en vagnretur ('\r'). Filen har inga kolumnnamn, så använd parameternheaderkorrekt. - Extrahera sedan första raden i
DataFrameoch spara den i en variabel som heterfirst_row.
Lösning
Tack för dina kommentarer!
single
Fråga AI
Fråga AI
Fråga vad du vill eller prova någon av de föreslagna frågorna för att starta vårt samtal