tregu0458/pdf_2_dify_workflow
1
1{2 "nbformat": 4,3 "nbformat_minor": 0,4 "metadata": {5 "colab": {6 "provenance": []7 },8 "kernelspec": {9 "name": "python3",10 "display_name": "Python 3"11 },12 "language_info": {13 "name": "python"14 }15 },16 "cells": [17 {18 "cell_type": "code",19 "execution_count": null,20 "metadata": {21 "id": "2RCxpRzpqPrB"22 },23 "outputs": [],24 "source": [25 "!pip install gradio unstructured[pdf] langchain-community"26 ]27 },28 {29 "cell_type": "code",30 "source": [31 "import getpass\n",32 "\n",33 "DIFY_BASE_URL = getpass.getpass(\"DIFY_BASE_URL:\")\n",34 "DIFY_API_KEY_MYWORKFLOW = getpass.getpass(\"DIFY_API_KEY_MYWORKFLOW: \")\n",35 "\n"36 ],37 "metadata": {38 "id": "iDbRDVzHqZh8"39 },40 "execution_count": null,41 "outputs": []42 },43 {44 "cell_type": "code",45 "source": [46 "import requests\n",47 "import json\n",48 "url = DIFY_BASE_URL + \"/workflows/run\"\n",49 "\n",50 "headers = {\n",51 " \"Content-Type\": \"application/json\",\n",52 " \"Authorization\": f\"Bearer {DIFY_API_KEY_MYWORKFLOW}\"\n",53 "}\n",54 "\n",55 "data = {\n",56 " \"inputs\": {\n",57 " \"knowledge\":\"\"\"\n",58 " 本作の悪役。千年以上前に生まれた最初の鬼。鬼達の絶対的支配者で、自身の血を人間に与え大量の鬼を作り出した。炭治郎の家族を殺し、禰󠄀豆子を鬼に変えた仇である。\n",59 "鬼達を血に仕込んだ呪いで支配し、「あの方」と呼ばれ恐れられている。外見や攻撃は自由自在で、不死身の鬼を殺すことができる。性格は冷酷非情かつ支配的で、自らの意志に沿わない者は決して許さず、忠実に従っていた下弦の鬼達を些細なことで何ら躊躇なく惨殺したり、報告に来た猗窩座に理不尽な叱責を与えるなどしている。珠世からはその人物像を「いつも何かに怯えている臆病者」と皮肉られている。癇癪で暴力を振るったり、自分を棚に上げた言動をすることも多い。\n",60 "\n",61 " \"\"\",\n",62 " },\n",63 " \"query\": \"\", # クエリ(オプション)\n",64 " \"response_mode\": \"streaming\", # ストリーミング応答\n",65 " \"user\": \"abc_123\", # ユーザーID\n",66 "}\n",67 "\n",68 "response = requests.post(url, headers=headers, json=data, stream=True)\n",69 "\n",70 "response.raise_for_status() # エラーチェック\n",71 "\n",72 "response = requests.post(url, headers=headers, json=data, stream=True)\n",73 "response.raise_for_status()\n",74 "\n",75 "assistant_message = \"\"\n",76 "outputs = {}\n",77 "\n",78 "# APIレスポンスのチャンク処理\n",79 "for chunk in response.iter_lines(delimiter=b\"\\n\\n\"):\n",80 " if chunk:\n",81 " chunk_data = chunk.decode(\"utf-8\").strip()\n",82 " if chunk_data.startswith(\"data:\"):\n",83 " json_data = chunk_data[6:] # \"data: \"を取り除く\n",84 " if json_data:\n",85 " result = json.loads(json_data)\n",86 " if result.get(\"event\") == \"text_chunk\":\n",87 " answer = result.get(\"data\", \"\").get(\"text\", \"\")\n",88 " assistant_message += str(answer)\n",89 " print(str(answer), end=\"\", flush=True)\n",90 " elif result.get(\"event\") == \"workflow_finished\":\n",91 " outputs = result.get('data', \"\")\n",92 " print(assistant_message, outputs)"93 ],94 "metadata": {95 "id": "_1LzsFX7rve1"96 },97 "execution_count": null,98 "outputs": []99 },100 {101 "cell_type": "code",102 "source": [103 "import gradio as gr\n",104 "import requests\n",105 "from langchain_community.document_loaders import UnstructuredPDFLoader\n",106 "import json\n",107 "\n",108 "def run_workflow(message):\n",109 " try:\n",110 " file = message['files'][0]\n",111 " text_message = message['text']\n",112 "\n",113 " # PDFファイルが選択されているかチェック\n",114 " if not file:\n",115 " return \"PDFファイルを選択してください。\", \"\"\n",116 "\n",117 " # PDFファイルをロードしてテキストを抽出\n",118 " loader = UnstructuredPDFLoader(file)\n",119 " data = loader.load()\n",120 " raw_text = data[0].page_content\n",121 "\n",122 " # APIリクエストのための入力データを準備\n",123 " inputs = {\n",124 " \"knowledge\": raw_text\n",125 " }\n",126 "\n",127 " yield raw_text, \"loading...\", {}\n",128 "\n",129 " # APIエンドポイントURL\n",130 " url = DIFY_BASE_URL + \"/workflows/run\"\n",131 "\n",132 " # APIリクエストのヘッダー\n",133 " headers = {\n",134 " \"Content-Type\": \"application/json\",\n",135 " \"Authorization\": f\"Bearer {DIFY_API_KEY_MYWORKFLOW}\"\n",136 " }\n",137 "\n",138 " # APIリクエストのデータ\n",139 " data = {\n",140 " \"inputs\": inputs,\n",141 " \"query\": \"\",\n",142 " \"response_mode\": \"streaming\",\n",143 " \"user\": \"abc_123\",\n",144 " }\n",145 "\n",146 " # APIにリクエストを送信\n",147 " response = requests.post(url, headers=headers, json=data, stream=True)\n",148 " response.raise_for_status()\n",149 "\n",150 " assistant_message = \"\"\n",151 " outputs = {}\n",152 "\n",153 " # APIレスポンスのチャンク処理\n",154 " for chunk in response.iter_lines(delimiter=b\"\\n\\n\"):\n",155 " if chunk:\n",156 " chunk_data = chunk.decode(\"utf-8\").strip()\n",157 " if chunk_data.startswith(\"data:\"):\n",158 " json_data = chunk_data[6:] # \"data: \"を取り除く\n",159 " if json_data:\n",160 " result = json.loads(json_data)\n",161 " if result.get(\"event\") == \"text_chunk\":\n",162 " answer = result.get(\"data\", \"\").get(\"text\", \"\")\n",163 " assistant_message += str(answer)\n",164 " yield raw_text, assistant_message, result.get(\"data\", \"\")\n",165 " elif result.get(\"event\") == \"workflow_finished\":\n",166 " outputs = result.get('data', \"\")\n",167 " yield raw_text, assistant_message, outputs\n",168 "\n",169 " except Exception as e:\n",170 " error_message = str(e)\n",171 " print(f\"Error: {error_message}\")\n",172 " return \"error\", error_message, {}\n",173 "\n",174 "# Gradioインターフェイスの設定\n",175 "iface = gr.Interface(\n",176 " fn=run_workflow,\n",177 " inputs=[gr.MultimodalTextbox(label=\"PDFファイルをアップロード\", file_types=[\".pdf\"], interactive=True)],\n",178 " outputs=[\n",179 " gr.Textbox(label=\"生テキスト\", show_copy_button=True, max_lines=5),\n",180 " gr.Markdown(),\n",181 " gr.JSON()\n",182 " ],\n",183 " title=\"PDF to Dify Workflow\",\n",184 " description=\"PDFファイルを入力すると、Dify APIのワークフローによって処理された結果が表示されます。\",\n",185 " article=\"\"\"\n",186 "\n",187 " © 2024 @tregu0458. All rights reserved.\n",188 "\n",189 " ## 使用コンポーネント\n",190 " - dify\n",191 " - gradio\n",192 " - langchain_community.document_loaders\n",193 "\n",194 " ## 今回のworkflowの仕様\n",195 " ### 入力\n",196 " - knowledge\n",197 " ### 出力\n",198 " - result\n",199 " - row_content\n",200 " ### LLM\n",201 " - gemini-1.5-flash\n",202 " ```\n",203 " PDFファイルを入力として受け取り、Dify APIのワークフローを使用してファイルを処理し、結果を返す関数。\n",204 " Args:\n",205 " message (dict): 入力メッセージ。以下のキーを含む辞書。\n",206 " - 'files' (list): アップロードされたPDFファイルのリスト。\n",207 " - 'text' (str): テキストメッセージ。\n",208 " Yields:\n",209 " tuple: 以下の要素を含むタプル。\n",210 " - raw_text (str): PDFファイルから抽出された生テキスト。\n",211 " - assistant_message (str): アシスタントからのメッセージ。\n",212 " - outputs (dict): APIレスポンスのデータ。\n",213 " Returns:\n",214 " tuple: 以下の要素を含むタプル。\n",215 " - status (str): 処理の状態。\"error\" または \"\" (空文字列)。\n",216 " - error_message (str): エラーメッセージ (エラーが発生した場合)。\n",217 " - data (dict): APIレスポンスのデータ。\n",218 " Raises:\n",219 " Exception: 処理中にエラーが発生した場合。\n",220 " Notes:\n",221 " - 関数は非同期的に実行され、処理の進行状況に応じて段階的に結果を返す。\n",222 " - `yield` を使用して、処理の途中経過を表示しながら、最終的な結果を返す。\n",223 " ```\n",224 " \"\"\"\n",225 ")\n",226 "\n",227 "if __name__ == \"__main__\":\n",228 " iface.queue().launch()"229 ],230 "metadata": {231 "id": "yx9f1RwJtFi9"232 },233 "execution_count": null,234 "outputs": []235 }236 ]237}