Приложения с ИИ и знание

Разработка на извличане и генериране

Езиковият модел струва толкова, колкото онова, което поставяте пред него. Повечето разочароващи отговори на ИИ са провали на извличането, преоблечени като провали на модела: правилният откъс е съществувал и никога не е бил намерен. Изграждаме и настройваме слоя за извличане и после го измерваме, за да разсъждава моделът върху правилните доказателства.

Бизнес предизвикателството

Демонстрацията работеше, защото сборникът беше малък

Наивното векторно търсене се справя добре с няколкостотин документа и се влошава силно отвъд няколкостотин хиляди. Разделянето на части откъсва таблицата от заглавието ѝ. Смислово близки откъси изтласкват онзи, който наистина е меродавен. Актуалността губи от близостта, така че отменена политика излиза пред действащата. Нищо от това не се вижда без измерване, затова екипите пускат в работа, получават правдоподобни отговори и откриват дела на грешките едва когато някой постъпи по грешен отговор.

С какво се занимаваме

Да се изгради извличането и после да се докаже

Започваме с изграждане на набор за оценяване от реални въпроси и известни верни източници, защото не можете да настройвате онова, което не можете да оцените. После работим по веригата: разделяне, което зачита структурата на документа, хибридно търсене, съчетаващо ключови думи и вектори, филтри по метаданни за актуалност и меродавност, и преподреждане на краткия списък. Там, където връзките между обектите значат повече от близостта на откъсите, ползваме граф, вместо да се преструваме, че векторите стигат. Всяка промяна се оценява спрямо същия набор, така че подобрението се доказва, а не се твърди.

Разработка на извличане и генериране

Компетенции

  • Корпоративно извличане и генериране

  • Разширено извличане и генериране

  • Извличане върху граф

  • Хибридно търсене

  • Векторно търсене

  • Оптимизиране на извличането

  • Оценяване на извличането

Често срещани приложения

Често срещани приложения

  • Да се обоснове насочен към клиенти асистент, така че всяко негово твърдение да води до публикуван документ.
  • Да се извлича из договори, където отговорът зависи от това кое споразумение е приложимо, а не от сходството на формулировките.
  • Да се търси в техническа документация, където правилният откъс е таблица или надпис под схема.
  • Да се преизгради съществуващ асистент, който отговаря правдоподобно, но греши достатъчно често, за да е загубил доверие.

Как работим

Как работим

  1. Оформяне

    Превръщане на искането в спецификация: кой го ползва, кое е правилният отговор, кой решава.

  2. Обвързване с източниците

    Свързване със съдържанието и системите, които съхраняват отговорите, при спазване на съществуващите права.

  3. Оценяване

    Оценяване върху означено множество, изградено от вашите собствени случаи, преди да го види някой отвън.

  4. Пускане и експлоатация

    Поетапно пускане с наблюдение, контрол на разходите и набор тестове, който пази качеството.

Технологии

Технологии

  • OpenAI
  • Anthropic
  • Azure OpenAI
  • pgvector
  • Elasticsearch
  • Microsoft 365
  • SharePoint
  • Confluence
  • Salesforce

Сигурност и управление

Сигурност и управление

Отговорите са обвързани с вашето собствено съдържание и носят посочени източници, така че читателят може да ги провери. Търсенето спазва правата, вече зададени върху източника, което значи, че потребителят никога не вижда през приложението нещо, което не би могъл да види пряко. Запитванията, извлеченият контекст и отговорите се записват за одит, а оценяването тече непрекъснато, а не еднократно при пускането.

Модели на сътрудничество

Модели на сътрудничество

Проект с ИИ

Поемаме отговорността за проектирането и доставката на определено решение с ИИ.

Специализиран екип за ИИ

Дългосрочен специализиран инженерен капацитет, изграден около вашите технологии и модел на доставка.

Управляван ИИ

Управляваме, наблюдаваме и непрекъснато подобряваме продукционни системи с ИИ.

Защо TeamExtension.ai

Измерваме, преди да настройваме

Повечето работа по извличането се води по усет: сменяш размера на частите, прочиташ няколко отговора и решаваш, че е по-добре. Ние първо изграждаме означения набор, което е неефектно и е цялата разлика между настройване и гадаене. Освен това ви остава набор за регресия, така че обновяване на модела след шест месеца да не може тихомълком да влоши качеството, без някой да забележи.

Избрани клиенти

Често задавани въпроси

Често задавани въпроси

Как измервате дали извличането е добро?
Спрямо означен набор от реални въпроси, съчетани с откъсите, които наистина им отговарят. Отчитаме дали правилният откъс изобщо е бил извлечен и на кое място се е класирал. Качеството на отговора се оценява отделно, защото добър отговор от грешен източник пак е провал.
Нужна ли ни е векторна база от данни?
Често не. pgvector в съществуващ екземпляр на PostgreSQL обслужва твърде много корпоративни натоварвания, без да добавя инфраструктура за поддържане. Препоръчваме специализирано векторно хранилище, когато мащабът или изискванията към функциите го оправдават, а не по подразбиране.
Какво е GraphRAG и нужен ли ни е?
Той извлича върху граф от обекти и връзки, а не върху отделни откъси. Оправдава допълнителната си сложност, когато отговорите зависят от връзки между документи, например вериги на собственост или структури на зависимости. За повечето отговори върху свързан текст хибридното търсене с преподреждане се справя по-добре при по-малко усилие.
Можете ли да подобрите система, която вече сме изградили?
Да, и това е обичайно. Започваме с изграждане на набора за оценяване и измерване на онова, което имате. Обикновено това открива провала точно, а поправката често е по-тясна от преизграждане.
Как това остава точно, докато съдържанието се променя?
Индексирането следва източника по график или по известие за промяна, а наборът за оценяване се изпълнява непрекъснато, а не еднократно. Качеството на извличането се следи като всеки друг продукционен показател.

Обсъдете вашата инициатива за ИИ

Системи за извличане, които обосновават отговорите с вашето собствено съдържание, с цитати и измерима точност.