РеранкингNVIDIA
NVIDIA: Llama Nemotron Rerank VL 1B V2 (free)
Пересортировывает результаты поиска по смысловой релевантности и повышает качество RAG-систем.
РеранкингТекст и диалогиАнализ изображенийБесплатные запросы
OpenRouter × 90 ₽/$ · коэффициент 1 · цены обновляются автоматически
Input / 1M0 ₽
Output / 1M0 ₽
Context10K tokens
Вход и результат
Принимает
text, image
Возвращает
rerank
Параметры: max_tokens, seed, temperature, top_p
Готовый запрос
Подключение за 3 минуты
- 1. Получите API key
Бот выдаст ключ формата
sk-…. - 2. Сохраните ключ
FREETOKENS_API_KEY=sk-… - 3. Запустите пример
Model ID уже подставлен.
import os
import requests
response = requests.post(
"https://api.llmru.ru/v1/rerank",
headers={
"Authorization": f"Bearer {os.environ['FREETOKENS_API_KEY']}",
"Content-Type": "application/json",
},
json={
"model": "nvidia/llama-nemotron-rerank-vl-1b-v2:free",
"query": "Какую модель выбрать?",
"documents": [
"Вариант A",
"Вариант B"
]
},
)
response.raise_for_status()
print(response.json())Endpoint: /v1/rerank · Model ID: nvidia/llama-nemotron-rerank-vl-1b-v2:free