Hoppa till innehållet
AI-grafen
C· Byggareprogrammering· ca 30 min· grundläggande — ändras sällan· verifierad 2026-09-20

Python — strängar och textbehandling

Kunna bearbeta text med strängmetoder, formatering och enkel tolkning.

Förkunskaper

Intuition

Nästan all data en språkmodell möter är text. Att kunna bearbeta text i Python är därför grundläggande.

En sträng är en följd av tecken. Du kan:

  • indexera och skiva: s[0], s[-1], s[2:5]
  • normalisera: s.lower(), s.strip()
  • dela och sätta ihop: s.split(), " ".join(lista)
  • byta ut: s.replace("a", "b")
  • fråga: "ai" in s, s.startswith("Hej")

Strängar är oföränderliga: metoderna ger en ny sträng, originalet ändras inte.

Kod

rad = "  Anna, 14, Göteborg  "
delar = [d.strip() for d in rad.strip().split(",")]
print(delar)                     # ['Anna', '14', 'Göteborg']
namn, alder, stad = delar
print(f"{namn} är {int(alder) + 1} nästa år")   # Anna är 15 nästa år

text = "AI är kul. AI är svårt."
print(text.lower().count("ai"))          # 2
ord = text.lower().replace(".", "").split()
print(len(ord), ord[:3])                 # 6 ['ai', 'är', 'kul']

Tokenisering i en språkmodell börjar precis så här: normalisera, dela upp, räkna.

Behärskning innebär

  • Använder strängmetoder (lower, split, strip, replace) korrekt
  • Bygger strängar med f-strängar
  • Tolkar enkel text till struktur

Logga in för att göra övningarna och bygga upp din behärskning.

Källor

Alla källor och licenser