Wat is embeddinggeneratie?

Embeddinggeneratie zet tekst om in een numerieke vector die machines kunnen vergelijken. Dat is nuttig voor semantisch zoeken, clustering, aanbevelingen en gelijkenheidscontroles.

Beschrijving van de tool

Deze tool stuurt je tekst naar een geselecteerd embeddingmodel en toont de resulterende vector en de dimensies ervan. De tool ondersteunt modellen van OpenAI, Google en Voyage AI, zodat je providers kunt vergelijken of een embeddingconfiguratie kunt testen zonder de app te verlaten.

Voorbeeld

Invoer:

Stel je wachtwoord opnieuw in via de pagina met accountinstellingen.

Uitvoer:

{
  "model": "openai/text-embedding-3-small",
  "dimensies": 1536,
  "embedding": [0.0123, -0.0441, 0.0087]
}

Functies

  • Hiermee kun je kiezen uit ondersteunde embeddingmodellen van OpenAI, Google en Voyage AI
  • Toont de embeddingdimensie en de onbewerkte vector als JSON
  • Downloadt het resultaat als embedding.json

Hoe het werkt

De tool verwijdert overbodige witruimte uit de invoertekst, stuurt de tekst samen met het geselecteerde model naar de embedding-API en geeft de geretourneerde vector weer in het uitvoergedeelte. Als het model verandert, kan ook de vorm van de vector veranderen. Met het veld voor de dimensies kun je controleren wat je hebt teruggekregen.

Tips

  • Gebruik korte, representatieve tekst wanneer je modellen vergelijkt.
  • Verschillende providers en modellen leveren vaak vectoren met verschillende dimensies.
  • Dit is een goede manier om een semantische zoekpipeline op plausibiliteit te controleren voordat je deze in code integreert.