Czym jest generowanie embeddingów?

Generowanie embeddingów przekształca tekst w wektor liczbowy, który maszyny mogą porównywać. Jest to przydatne w wyszukiwaniu semantycznym, klasteryzacji, systemach rekomendacji i sprawdzaniu podobieństwa.

Opis narzędzia

To narzędzie wysyła tekst do wybranego modelu embeddingów i wyświetla wynikowy wektor oraz jego wymiary. Obsługuje modele OpenAI, Google i Voyage AI, dzięki czemu możesz porównywać dostawców lub testować konfigurację embeddingów bez opuszczania aplikacji.

Przykład

Dane wejściowe:

Zresetuj hasło na stronie ustawień konta.

Dane wyjściowe:

{
  "model": "openai/text-embedding-3-small",
  "dimensions": 1536,
  "embedding": [0.0123, -0.0441, 0.0087]
}

Funkcje

  • Umożliwia wybór obsługiwanych modeli embeddingów od OpenAI, Google i Voyage AI
  • Wyświetla wymiar embeddingu oraz surowy wektor w formacie JSON
  • Pobiera wynik jako embedding.json

Jak to działa

Narzędzie usuwa zbędne białe znaki z tekstu wejściowego, wysyła go wraz z wybranym modelem do embedding API, a następnie wyświetla zwrócony wektor w obszarze wyników. Jeśli model się zmieni, kształt wektora również może się zmienić, dlatego pole wymiarów pomaga potwierdzić, jakie dane zostały zwrócone.

Wskazówki

  • Podczas porównywania modeli używaj krótkiego, reprezentatywnego tekstu.
  • Różni dostawcy i modele często zwracają wektory o różnych wymiarach.
  • To dobry sposób na wstępną weryfikację potoku wyszukiwania semantycznego przed zintegrowaniem go z kodem.