TXT-Filer
For at læse tekstfiler i pandas, kan du bruge den samme funktion, pd.read_csv(). For at sikre, at tekstfilen læses korrekt, er det dog vigtigt at bruge en ekstra parameter kaldet sep, som står for separator eller afgrænser i teksten.
# Importing pandas library
import pandas as pd
# Reading a text file into a DataFrame
text_data = pd.read_csv('file.txt', sep='\r', header=None)
Hvis din tekstfil ikke har en header-række med kolonnenavne, skal du sætte parameteren header til None. Dette informerer pandas om ikke at behandle den første række som kolonnenavne.
For at bruge en ny linje som separator i en fil, hvilket er almindeligt i tekstfiler, skal du sætte sep='\r'. Her står '\r' for carriage return, som er et specialtegn, der bruges til at angive en ny linje.
Udtræk af en enkelt række
Når din tekstfil er indlæst i et DataFrame, kan du få adgang til individuelle rækker ved at bruge .iloc[] og angive positionen for den ønskede række:
# Extracting the first row
first_row = text_data.iloc[0]
Når du vælger en enkelt række (eller en enkelt kolonne) fra en DataFrame, returnerer pandas ikke en ny DataFrame — den returnerer en Series. En Series er et endimensionelt mærket array, hvilket betyder, at den indeholder en enkelt sekvens af værdier sammen med et indeks, men uden en separat kolonstruktur. Derfor vil first_row se ud og opføre sig lidt anderledes end text_data: den har ikke .columns, og når du udskriver den, vises indekset sammen med hver værdi i stedet for et tabel-layout.
Tak for dine kommentarer!
single
TXT-Filer
Stryg for at vise menuen
For at læse tekstfiler i pandas, kan du bruge den samme funktion, pd.read_csv(). For at sikre, at tekstfilen læses korrekt, er det dog vigtigt at bruge en ekstra parameter kaldet sep, som står for separator eller afgrænser i teksten.
# Importing pandas library
import pandas as pd
# Reading a text file into a DataFrame
text_data = pd.read_csv('file.txt', sep='\r', header=None)
Hvis din tekstfil ikke har en header-række med kolonnenavne, skal du sætte parameteren header til None. Dette informerer pandas om ikke at behandle den første række som kolonnenavne.
For at bruge en ny linje som separator i en fil, hvilket er almindeligt i tekstfiler, skal du sætte sep='\r'. Her står '\r' for carriage return, som er et specialtegn, der bruges til at angive en ny linje.
Udtræk af en enkelt række
Når din tekstfil er indlæst i et DataFrame, kan du få adgang til individuelle rækker ved at bruge .iloc[] og angive positionen for den ønskede række:
# Extracting the first row
first_row = text_data.iloc[0]
Når du vælger en enkelt række (eller en enkelt kolonne) fra en DataFrame, returnerer pandas ikke en ny DataFrame — den returnerer en Series. En Series er et endimensionelt mærket array, hvilket betyder, at den indeholder en enkelt sekvens af værdier sammen med et indeks, men uden en separat kolonstruktur. Derfor vil first_row se ud og opføre sig lidt anderledes end text_data: den har ikke .columns, og når du udskriver den, vises indekset sammen med hver værdi i stedet for et tabel-layout.
Swipe to start coding
Du får en URL til en TXT-fil, som er gemt som en streng i variablen file_url.
- Læs TXT-filen ind i en
DataFramekaldettext_data. Hver linje i filen er adskilt af et carriage return ('\r'). Filen har ikke kolonnenavne, så brugheader-parameteren korrekt. - Udtræk derefter første række fra
DataFrameog gem den i en variabel kaldetfirst_row.
Løsning
Tak for dine kommentarer!
single
Spørg AI
Spørg AI
Spørg om hvad som helst eller prøv et af de foreslåede spørgsmål for at starte vores chat