Ещё недавно Алиса отвечала на текст и на картинку будто двумя разными голосами. Под капотом и правда жили две генеративные модели: текстовая LLM и визуальная VLM, а между ними — стена из непрозрачного роутинга, разных форматов ответов и разной вёрстки. Почти год мы сводили их в одну омнимодель…
Омнимодель для Алисы AI: как нам удалось подружить VLM и LLM
Это краткое изложение. Полный текст материала доступен на сайте источника.