Что такое генерация embedding?

Генерация embedding преобразует текст в числовой вектор, который машины могут сравнивать. Это полезно для семантического поиска, кластеризации, рекомендаций и проверки сходства.

Описание инструмента

Этот инструмент отправляет ваш текст выбранной модели embedding и отображает полученный вектор и его размерность. Он поддерживает модели OpenAI, Google и Voyage AI, поэтому вы можете сравнивать провайдеров или тестировать конфигурацию embedding, не покидая приложение.

Пример

Входные данные:

Сбросьте пароль на странице настроек аккаунта.

Результат:

{
  "model": "openai/text-embedding-3-small",
  "dimensions": 1536,
  "embedding": [0.0123, -0.0441, 0.0087]
}

Возможности

  • Позволяет выбирать поддерживаемые модели embedding от OpenAI, Google и Voyage AI
  • Отображает размерность embedding и необработанный вектор в формате JSON
  • Скачивает результат как embedding.json

Как это работает

Инструмент удаляет лишние пробелы во входном тексте, отправляет его вместе с выбранной моделью в embedding API и отображает возвращённый вектор в области вывода. При смене модели форма вектора также может измениться, поэтому поле размерности помогает проверить, какие данные были получены.

Советы

  • Используйте короткий, репрезентативный текст при сравнении моделей.
  • Разные провайдеры и модели часто возвращают векторы с разными размерностями.
  • Это удобный способ выполнить базовую проверку конвейера семантического поиска, прежде чем интегрировать его в код.