LRLLMRU
← Все модели
РеранкингNVIDIA

NVIDIA: Llama Nemotron Rerank VL 1B V2 (free)

Пересортировывает результаты поиска по смысловой релевантности и повышает качество RAG-систем.

РеранкингТекст и диалогиАнализ изображенийБесплатные запросы

OpenRouter × 90 ₽/$ · коэффициент 1 · цены обновляются автоматически

Input / 1M0
Output / 1M0
Context10K tokens

Вход и результат

Принимает

text, image

Возвращает

rerank

Параметры: max_tokens, seed, temperature, top_p

Готовый запрос

Подключение за 3 минуты

  1. 1. Получите API key

    Бот выдаст ключ формата sk-….

  2. 2. Сохраните ключ

    FREETOKENS_API_KEY=sk-…

  3. 3. Запустите пример

    Model ID уже подставлен.

import os
import requests

response = requests.post(
    "https://api.llmru.ru/v1/rerank",
    headers={
        "Authorization": f"Bearer {os.environ['FREETOKENS_API_KEY']}",
        "Content-Type": "application/json",
    },
    json={
      "model": "nvidia/llama-nemotron-rerank-vl-1b-v2:free",
      "query": "Какую модель выбрать?",
      "documents": [
        "Вариант A",
        "Вариант B"
      ]
    },
)
response.raise_for_status()
print(response.json())

Endpoint: /v1/rerank · Model ID: nvidia/llama-nemotron-rerank-vl-1b-v2:free