← Роботи

Вибрані роботи

RAG по телеком-документації

Відповіді з доповненням із пошуку по тисячах сервісних і топологічних документів, на локальних моделях.

Задача

Операційні знання — сервісні записи, топологія, тикети — розкидані по системах і вивантаженнях. Інженери витрачають час на пошук контексту, який уже десь є.

Підхід

Документи інжестяться й нарізаються у векторне сховище з локальною моделлю ембедингів. LLM на GPU відповідає на запитання з посиланнями на джерела, а курований шар знань тримає корпус у порядку. LLM ніколи не на критичному шляху інжесту — пошук доступний, навіть коли генерація недоступна.

Стек

OnyxOllamapgvectorGPU servingPostgreSQLRAG

Результати

  • Відповіді природною мовою, що спираються на реальний корпус документів
  • Цитовані джерела — кожна відповідь перевірна, а не галюцинація
  • Пошук по великому внутрішньому корпусу без ручної індексації
  • Повністю self-hosted — внутрішні дані не покидають мережу