Будьте первым, кто оставит комментарий
Ответов на этот пост пока нет. Скажите, что вы думаете по этому поводу, чтобы поддержать обсуждение.
ИИ Агенты
Обсуждаем вопросы касающиеся ИИ агентов, делимся новостями и личным опытом. ИИ Агенты - это LLM большие языковые модели (LLM), способные "использовать инструменты" или "выполнять функции" в автономном или полуавтономном режиме (также известном как режим с участием человека — human-in-the-loop).
Создано
Публичное
5
посетителей в неделю
2
опубликованных материалов в неделю
ПРАВИЛА ИИ Агенты
Бесплатные модели
Пост скопирован из ТГК, источник ниже
NVIDIA раздаёт бесплатно модели, включая довольно дорогой фронтир Kimi K3. Моделей довольно много, но по тестам у меня заработал Kimi K3 и Nemotron-3.5. Не завелся DeepSeek V4.1. Однако это может быть связано с IP. Естественно, российские IP забанены, но забанены и многие IP хостингов VPS. Поэтому, возможно, придётся поиграться со сменой IP. Kimi K3 отвечает неспешно, около 30 токенов/сек, но если у вас автономный агент для чего-то вроде ревью кода или логов — это неважно. Пусть там работает хоть часами.
Официально NVIDIA не вводит ограничения на объём для Free Endpoints, но экспериментально многие нашли, что сделано ограничение примерно 40 запросов в минуту. Для тяжёлых моделей типа Kimi K3 это выбрать сложно.
Чтобы получить доступ, вам нужно создать глобальный ключ:
https://build.nvidia.com/settings/api-keys
Base URL — https://integrate.api.nvidia.com/v1
Сами модели можно смотреть тут:
https://build.nvidia.com/
Рабочий идентификатор модели для Kimi K3 — moonshotai/kimi-k3
---
Автор поста - Владимир Иванов, тгк - t.me/turboproject
Пост скопирован из ТГК, источник ниже
NVIDIA раздаёт бесплатно модели, включая довольно дорогой фронтир Kimi K3. Моделей довольно много, но по тестам у меня заработал Kimi K3 и Nemotron-3.5. Не завелся DeepSeek V4.1. Однако это может быть связано с IP. Естественно, российские IP забанены, но забанены и многие IP хостингов VPS. Поэтому, возможно, придётся поиграться со сменой IP. Kimi K3 отвечает неспешно, около 30 токенов/сек, но если у вас автономный агент для чего-то вроде ревью кода или логов — это неважно. Пусть там работает хоть часами.
Официально NVIDIA не вводит ограничения на объём для Free Endpoints, но экспериментально многие нашли, что сделано ограничение примерно 40 запросов в минуту. Для тяжёлых моделей типа Kimi K3 это выбрать сложно.
Чтобы получить доступ, вам нужно создать глобальный ключ:
https://build.nvidia.com/settings/api-keys
Base URL — https://integrate.api.nvidia.com/v1
Сами модели можно смотреть тут:
https://build.nvidia.com/
Рабочий идентификатор модели для Kimi K3 — moonshotai/kimi-k3
---
Автор поста - Владимир Иванов, тгк - t.me/turboproject