amiguel/ai_systems
0
1import pandas as pd2import pdfplumber3 4def load_file(uploaded_file):5 ext = uploaded_file.name.split(".")[-1].lower()6 if ext == "pdf":7 with pdfplumber.open(uploaded_file) as pdf:8 return [page.extract_text() for page in pdf.pages if page.extract_text()]9 elif ext == "csv":10 df = pd.read_csv(uploaded_file)11 return df.astype(str).apply(" ".join, axis=1).tolist()12 elif ext == "xlsx":13 df = pd.read_excel(uploaded_file)14 return df.astype(str).apply(" ".join, axis=1).tolist()15 else:16 raise ValueError("Unsupported file type")17 