import os import uuid from datetime import datetime, timezone from pathlib import Path from sqlalchemy import select from sqlalchemy.ext.asyncio import AsyncSession from app.core.app_settings import settings from app.models.dokument import Dokument # Erlaubte MIME-Types (Nutzer-Vorgabe Modul 10: PDF/Bilder/Prüfprotokolle/ # Wartungsberichte/Bedienungsanleitungen/Rechnungen/Zulassungsdokumente) - # Whitelist statt Blacklist (owasp-Grundsatz: Datei-Upload ist klassischer # Angriffsvektor, z.B. .html/.svg mit eingebettetem Skript). ERLAUBTE_MIME_TYPES = { "application/pdf", "image/jpeg", "image/png", "image/webp", } class DateityperlaubtError(Exception): pass class DateizugrossError(Exception): pass def _upload_pfad() -> Path: pfad = Path(settings.upload_dir) pfad.mkdir(parents=True, exist_ok=True) return pfad async def speichere_dokument( db: AsyncSession, *, entitaet_typ: str, entitaet_id: str, dateiname: str, mime_type: str, inhalt: bytes, beschreibung: str | None, hochgeladen_von: int, ) -> Dokument: if mime_type not in ERLAUBTE_MIME_TYPES: raise DateityperlaubtError(mime_type) if len(inhalt) > settings.max_upload_size_mb * 1024 * 1024: raise DateizugrossError(len(inhalt)) # Speichername ist server-generiert (UUID), NIEMALS der Original-Dateiname - # verhindert Path-Traversal (../../etc/passwd) und Namenskollisionen. endung = Path(dateiname).suffix[:10] speichername = f"{uuid.uuid4()}{endung}" ziel = _upload_pfad() / speichername ziel.write_bytes(inhalt) dokument = Dokument( entitaet_typ=entitaet_typ, entitaet_id=entitaet_id, dateiname=dateiname, speicherpfad=speichername, mime_type=mime_type, groesse_bytes=len(inhalt), beschreibung=beschreibung, hochgeladen_von=hochgeladen_von, hochgeladen_am=datetime.now(timezone.utc), ) db.add(dokument) await db.flush() return dokument async def liste_fuer_entitaet(db: AsyncSession, *, entitaet_typ: str, entitaet_id: str) -> list[Dokument]: result = await db.execute( select(Dokument) .where(Dokument.entitaet_typ == entitaet_typ, Dokument.entitaet_id == entitaet_id) .order_by(Dokument.hochgeladen_am.desc()) ) return list(result.scalars().all()) def dateipfad(dokument: Dokument) -> Path: return _upload_pfad() / dokument.speicherpfad async def loesche_dokument(db: AsyncSession, *, dokument: Dokument) -> None: pfad = dateipfad(dokument) await db.delete(dokument) await db.flush() # Datei erst nach erfolgreichem DB-Commit-Vorbereiten löschen (flush wirft # bei FK-Problemen, bevor die Datei weg ist) - hier gibt es keine # eingehenden FKs auf dokument, daher unkritisch, aber Reihenfolge bewusst # gewählt für den Fall künftiger Referenzen. if pfad.exists(): os.remove(pfad)