Приниматоры решений: бенчмарк на русском для Jev-style моделей

Последние пару лет мы довольно странно используем большие языковые модели.Из-за их умения делать всё мы пытаемся решить с их помощью всё — роутинг запросов, модерацию, оценку и многое другое. При этом такой сетап инженерно некрасивый: у нас есть модели, которые умеют вести диалог, хорошо программиро…
Мы публикуем лишь краткий анонс. Все права на материал принадлежат Хабр — ИИ.
Ещё по теме
🤖FalangFlow: новый конструктор бизнес процессов с открытым кодом
Я здесь уже рассказывал про Falang (friendly algorithmic language) - универсальное решение для построения блок схем. Тогда у меня было неско…
FRIDA Decisions: быстро думать на русском
FRIDA Decisions — открытая модель быстрого мышления для русского языка. Она выбирает вариант из списка, ставит оценку по шкале, отвечает «да…
🤖Лабораторная работа №4
Что произойдет, если AI-программист будет получать контекст не из собственного чата, а из функциональной и архитектурной модели проекта?ERP…
🤖ChatGPT научился создавать интерфейс под каждый запрос налету
OpenAI завезли очень красивую фичу Intelligent UI. GPT‑6 теперь собирает прямо в диалоге интерактивные интерфейсы с кнопками, формами, графи…
🤖MWS AI Vision Bench: что изменилось за год и зачем мы добавляем антифрод
Год назад мы выложили в открытый доступ MWS AI Vision Bench — бенчмарк для оценки мультимодальных моделей на русскоязычных документах. За эт…
🤖Как использование нейросетей изменило игровую индустрию и homebrew-cцену
Игровая индустрия прошла максимально сложный путь развития: от чего-то максимально локального до мейнстрима у всех возрастов, по пути успев…