База знаний из файлов в облаке — с ответами на вопросы

Сценарий разбирает каждый новый файл в облаке и складывает его в поисковую базу, по которой чат отвечает на вопросы.

  • Файлы становятся базой знаний
  • Разбирает PDF, таблицы, документы
  • Ответы на вопросы из чата
  • Обновляется само при новом файле
Google DriveSupabasePostgresChat

Как это работает

Интеграция Google Drive и Supabase собирается из готового сценария — вот как он устроен по шагам.

  1. Запуск: Создание файла в Drive
  2. Проверка: Цикл по файлам Drive
  3. Затем: Установить поля метаданных файла
  4. Затем: Удалить старые строки документа в Supabase
  5. Затем: Удалить старые строки данных в Supabase
  6. Затем: Вставить метаданные документа в БД
  7. Затем: Скачать файл из Drive
  8. Проверка: Маршрутизация по типу файла
  9. Если да — Извлечь текст из PDF
  10. Затем: Вставить эмбеддинги в векторное хранилище
  11. Если нет — Извлечь данные из Excel
  12. Затем: Агрегировать табличные данные
  13. Затем: Суммировать табличные данные
  14. Затем: Построить схему и данные
  15. Затем: Обновить схему документа в БД
  16. Затем: Вставить строки таблицы в БД
  17. Если нет — Извлечь данные из CSV
  18. Если нет — Извлечь текст из документа
  19. Затем: Загрузить данные документа
  20. Затем: OpenAI Embeddings
  21. Запуск: Обновление файла в Drive
  22. Затем: Разбить текст на части
  23. Затем: Создать таблицу метаданных документов
  24. Затем: Создать таблицу строк документа
  25. Затем: Создать таблицу документов и функцию сопоставления
  26. Запуск: Когда получено сообщение в чате

Такой сценарий можно запустить в Scriptera: задача описывается обычными словами, сборка и запуск — на стороне сервиса.