Прогнали GigaChat 3.5 по реальным кейсам: Результаты большого тест‑драйва

GigaChat 3.5 вышел в июле этого года, а в начале сентября были выложены открытые веса этой модели. И многие сейчас задаются вопросом: насколько эта модель подходит для решения бизнес‑задач? Мы провели тесты(забеги ИИ‑агента) на нашем бенчмарке, где мы сравнили работу на модели GigaChat 3.5 по сравне…
Мы публикуем лишь краткий анонс. Все права на материал принадлежат Хабр — ИИ.
Ещё по теме
🤖FalangFlow: новый конструктор бизнес процессов с открытым кодом
Я здесь уже рассказывал про Falang (friendly algorithmic language) - универсальное решение для построения блок схем. Тогда у меня было неско…
FRIDA Decisions: быстро думать на русском
FRIDA Decisions — открытая модель быстрого мышления для русского языка. Она выбирает вариант из списка, ставит оценку по шкале, отвечает «да…
🤖Лабораторная работа №4
Что произойдет, если AI-программист будет получать контекст не из собственного чата, а из функциональной и архитектурной модели проекта?ERP…
🤖ChatGPT научился создавать интерфейс под каждый запрос налету
OpenAI завезли очень красивую фичу Intelligent UI. GPT‑6 теперь собирает прямо в диалоге интерактивные интерфейсы с кнопками, формами, графи…
🤖MWS AI Vision Bench: что изменилось за год и зачем мы добавляем антифрод
Год назад мы выложили в открытый доступ MWS AI Vision Bench — бенчмарк для оценки мультимодальных моделей на русскоязычных документах. За эт…
🤖Как использование нейросетей изменило игровую индустрию и homebrew-cцену
Игровая индустрия прошла максимально сложный путь развития: от чего-то максимально локального до мейнстрима у всех возрастов, по пути успев…