Вибрані роботи
RAG по телеком-документації
Відповіді з доповненням із пошуку по тисячах сервісних і топологічних документів, на локальних моделях.
Задача
Операційні знання — сервісні записи, топологія, тикети — розкидані по системах і вивантаженнях. Інженери витрачають час на пошук контексту, який уже десь є.
Підхід
Документи інжестяться й нарізаються у векторне сховище з локальною моделлю ембедингів. LLM на GPU відповідає на запитання з посиланнями на джерела, а курований шар знань тримає корпус у порядку. LLM ніколи не на критичному шляху інжесту — пошук доступний, навіть коли генерація недоступна.
Стек
Результати
- Відповіді природною мовою, що спираються на реальний корпус документів
- Цитовані джерела — кожна відповідь перевірна, а не галюцинація
- Пошук по великому внутрішньому корпусу без ручної індексації
- Повністю self-hosted — внутрішні дані не покидають мережу