Mikä on OpenAI-yhteensopiva API?

Monet LLM-palveluntarjoajat ja itse ylläpidetyt päättelypalvelimet – OpenAI itse, Azure OpenAI, Groq, OpenRouter, Together AI, Mistral, DeepSeek, vLLM, llama.cpp:n palvelin, LM Studio ja Ollaman OpenAI-yhteensopiva tila – tarjoavat kaikki saman OpenAIn suosituksi tekemän REST-rajapinnan: JSON-pyynnöt esimerkiksi /v1/chat/completions-päätepisteisiin, jotka todennetaan Bearer-tokenilla Authorization-otsakkeessa. Näin voit vaihtaa palveluntarjoajaa kirjoittamatta integraatiokoodiasi uudelleen.

Oikean cURL-komennon kirjoittaminen näille päätepisteille käsin edellyttää, että URL-osoite, otsakkeet ja JSON-runko ovat täsmälleen oikein – erityisesti silloin, kun säädät näytteenoton parametreja, kuten lämpötilaa ja rangaistuksia, tai vaihdat keskustelu-, legacy completions- ja embeddings-pyyntöjen välillä.

Työkalun kuvaus

Tämä työkalu luo käyttövalmiita cURL-komentoja mille tahansa OpenAI-yhteensopivalle API:lle. Määritä perus-URL-osoite, päätepiste, malli ja parametrit, niin saat asianmukaisesti muotoillun cURL-komennon välittömästi valmiina liitettäväksi päätelaitteeseen tai skripteihin.

Esimerkit

Keskustelun täydennys:

curl -X POST "https://api.openai.com/v1/chat/completions" \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer OMA_API_AVAIN" \
  -d '{
  "model": "gpt-4o-mini",
  "messages": [
    { "role": "system", "content": "Olet avulias koodausavustaja." },
    { "role": "user", "content": "Kirjoita Python-funktio, joka kääntää stringin ympäri" }
  ],
  "temperature": 0.3,
  "stream": false
}'

Itse ylläpidetty palvelin (vLLM, llama.cpp, LM Studio, ...):

curl -X POST "http://localhost:8000/v1/chat/completions" \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer OMA_API_AVAIN" \
  -d '{
  "model": "llama-3-8b-instruct",
  "messages": [
    { "role": "user", "content": "Tiivistä Hamletin juoni kahteen virkkeeseen" }
  ],
  "stream": true
}'

Embeddings:

curl -X POST "https://api.openai.com/v1/embeddings" \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer OMA_API_AVAIN" \
  -d '{
  "model": "text-embedding-3-small",
  "input": "Nopea ruskea kettu hyppää laiskan koiran yli"
}'

Ominaisuudet

  • Tukee kolmea yleisintä OpenAI-yhteensopivaa päätepistettä: /chat/completions, /completions ja /embeddings
  • Toimii minkä tahansa yhteensopivan perus-URL-osoitteen kanssa, joten se sopii yhtä lailla OpenAI:lle, Azure OpenAI:lle, Groqille, OpenRouterille, Together AI:lle ja itse ylläpidetyille palvelimille
  • Määritettävät näytteenoton parametrit: lämpötila, top-p, frekvenssirangaistus, läsnäolorangaistus, tokenien enimmäismäärä, täydennysten määrä, lopetussekvenssit ja siemen
  • Valinnainen JSON-objektin vastausmuoto keskustelun täydennyksille
  • Mitään ei lähetetä minnekään – cURL-komento muodostetaan kokonaan selaimessasi, eikä API-avain koskaan poistu laitteeltasi

Asetusten selitykset

Asetus Kuvaus Oletus Arvoalue
Perus-URL-osoite API:n juuri ilman päätepisteen polkua. https://api.openai.com/v1 Mikä tahansa URL-osoite
Päätepiste Mihin API:n päätepisteeseen kohdistetaan pyyntö. /chat/completions chat, completions, embeddings
Lämpötila Säätää tulosteen satunnaisuutta. Pienemmät arvot tuottavat kohdennetumpaa tekstiä, suuremmat arvot lisäävät luovuutta. 1 0–2
Top P Nucleus-näytteenoton kynnysarvo. Malli huomioi tokenit, joiden kumulatiivinen todennäköisyys saavuttaa tämän arvon. 1 0–1
Frekvenssirangaistus Rankaisee tokeneita sen perusteella, kuinka usein ne ovat jo esiintyneet, mikä vähentää sanatarkkaa toistoa. 0 -2–2
Läsnäolorangaistus Rankaisee tokeneita, jotka ovat jo esiintyneet edes kerran, ja kannustaa mallia ottamaan käyttöön uusia aiheita. 0 -2–2
Tokenien enimmäismäärä Vastauksessa luotavien tokenien enimmäismäärä. Jätä tyhjäksi, jos haluat jättää asetuksen pois ja käyttää palveluntarjoajan oletusta. - Mikä tahansa kokonaisluku
Täydennykset (n) Kuinka monta keskustelu- tai täydennysvaihtoehtoa syötteelle luodaan. 1 Mikä tahansa kokonaisluku
Siemen Kiinteä siemen mahdollisimman toistettavissa olevan tulosteen luomiseen. Jätä tyhjäksi satunnaisia tuloksia varten. - Mikä tahansa kokonaisluku
Lopetussekvenssit Pilkuilla eroteltu luettelo sekvensseistä, joiden kohdalla API lopettaa uusien tokenien luomisen. - Mikä tahansa teksti
Vastausmuoto Aseta arvoksi JSON-objekti, jos haluat pakottaa mallin palauttamaan kelvollista JSON-tulostetta (vain keskustelupäätepisteessä). Ei mitään Ei mitään / JSON-objekti
Stream Kun käytössä, vastaus välitetään palvelimelta lähetettyinä tapahtumina. Poista käytöstä, jos haluat vastaanottaa koko vastauksen kerralla. Pois Käytössä / Pois käytöstä