Apunta tus desarrollos de Inteligencia Artificial al Gateway de TokenFlow para monitorear el consumo en tiempo real.
Peticiones a OpenAI / Ollama Local
Modifica el baseURL en el SDK de tu lenguaje favorito para pasar por nuestro proxy local:
# En Python usando openai-python
from openai import OpenAI
client = OpenAI(
base_url="http://localhost:4000/v1",
api_key="TU_OPENAI_API_KEY"
)
response = client.chat.completions.create(
model="gpt-4o",
messages=[{"role": "user", "content": "Hola!"}]
)
Peticiones a Anthropic Claude
Redirige el cliente de Claude al puerto del proxy:
# En Python usando anthropic-python
from anthropic import Anthropic
client = Anthropic(
base_url="http://localhost:4000/v1",
api_key="TU_CLAUDE_API_KEY"
)
message = client.messages.create(
model="claude-3-5-sonnet",
max_tokens=500,
messages=[{"role": "user", "content": "Hola Claude!"}]
)
Peticiones a Google Gemini
Apunta tu endpoint HTTP al puerto local utilizando el API Key como query parameter:
# Consulta HTTP POST en tiempo real
POST http://localhost:4000/v1beta/models/gemini-1.5-flash:generateContent?key=TU_GEMINI_API_KEY
Content-Type: application/json
{
"contents": [{
"parts": [{"text": "Hola Gemini!"}]
}]
}