Участники вебинара разберут, что из себя представляют открытые LLM и понятие их квантизациии, а также как выбрать модель под определенную задачу с учетом имеющихся вычислительных мощностей. Докладчик расскажет, как загрузить и запустить нейросеть Qwen в сервисе Google Colab через Hugging Face Transformers. Также будут представлены техники управления поведением модели: промпты, температура, длина ответа.
Спикер:
ICT.Moscow — открытая площадка о цифровых технологиях в Москве. Мы создаем наиболее полную картину развития рынка технологий в городе и за его пределами, помогаем бизнесу следить за главными трендами, не упускать возможности и находить новых партнеров.