В этом видео я показываю процесс файнтюнинга Llama 3 70B и квантизации модели с конвертацией в формат GGUF.
💻 immers.cloud – широкий выбор карт для обучения и инференса нейронных сетей: https://immers.cloud/signup/r/2024042...
Один из ведущих поставщиков услуг IaaS (Infrastructure as a Service) в России, специализирующийся на использовании графических процессоров (GPU).
Сервис предлагает конкурентоспособные цены и интуитивно понятный интерфейс, который даже начинающие пользователи могут легко освоить и начать работу с необходимым программным обеспечением.
💻 gptchain – фреймворк для быстрого развертывания AI-ассистентов: https://github.com/RuslanPeresy/gptchain
Поддерживает интеграцию с Telegram-ботом, Retrieval Augmented Generation (RAG), деплой моделей на LLM сервер и файнтюнинг LLM на собственных данных.
Телеграм-канал: https://t.me/ruslandevlive
Дискорд: / discord
🤗 Веса моей модели: https://huggingface.co/ruslandev/llam...
📉 Метрики обучения: https://api.wandb.ai/links/ruslandev/...
Это описание содержит реферальные ссылки.