Ragbits#

Ragbit - пакет для языка программирования Python, который предоставляет основные «элементы» для создания мощных приложений с расширенной генерацией по результатам поиска (RAG). Он ориентирован на удобство разработчиков за счет предоставления простого и интуитивно понятного API. Кроме того, он включает полный набор инструментов для эффективного построения, тестирования и развертывания приложений RAG.

Vector DB доступен в качестве векторного хранилища в Ragbits для загрузки и поиска документов из коллекции.

Установка#

Установите пакет Python, поставляемый совместно с интеграцией Vector DB.

pip install ragbits

Использование#

Пример использования Ragbits и Vector DB может выглядеть так:

В следующем примере используются вложения OpenAI посредством LiteLLM.

import asyncio

from qdrant_client import AsyncQdrantClient

from ragbits.core.embeddings.litellm import LiteLLMEmbeddings
from ragbits.core.vector_stores.qdrant import QdrantVectorStore
from ragbits.document_search import DocumentSearch, SearchConfig
from ragbits.document_search.documents.document import DocumentMeta

documents = [
    DocumentMeta.create_text_document_from_literal(
        "RIP boiled water. You will be mist."
    ),
    DocumentMeta.create_text_document_from_literal(
        "Why programmers don't like to swim? Because they're scared of the floating points."
    ),
    DocumentMeta.create_text_document_from_literal("This one is completely unrelated."),
]


async def main() -> None:
    embedder = LiteLLMEmbeddings(
        model="text-embedding-3-small",
    )
    vector_store = QdrantVectorStore(
        client=AsyncQdrantClient(url="http://localhost:6333"),
        collection_name="{collection_name}",
    )
    document_search = DocumentSearch(
        embedder=embedder,
        vector_store=vector_store,
    )

    await document_search.ingest(documents)

    all_documents = await vector_store.list()
    print([doc.metadata["content"] for doc in all_documents])

    query = "I write computer software. Tell me something."
    vector_store_kwargs = {
        "k": 1,
        "max_distance": None,
    }
    results = await document_search.search(
        query,
        config=SearchConfig(vector_store_kwargs=vector_store_kwargs),
    )

    print(f"Documents similar to: {query}")
    print([element.get_key() for element in results])

Дополнительная документация#