Дал девяти популярным скиллам для Claude Code плацебо: два лучше пустышки, один хуже

Я сравнил девять самых популярных скиллов для Claude Code с пустышкой: нейтральным текстом той же длины, без единого совета, как работать. Агент 450 раз решал задачи из SWE-bench и Terminal-Bench со скиллом, с пустышкой и вообще без ничего.superpowers, у которого почти 300 тысяч звёзд, от пустышки н…
Мы публикуем лишь краткий анонс. Все права на материал принадлежат Хабр — ИИ.
Ещё по теме
🤖FalangFlow: новый конструктор бизнес процессов с открытым кодом
Я здесь уже рассказывал про Falang (friendly algorithmic language) - универсальное решение для построения блок схем. Тогда у меня было неско…
FRIDA Decisions: быстро думать на русском
FRIDA Decisions — открытая модель быстрого мышления для русского языка. Она выбирает вариант из списка, ставит оценку по шкале, отвечает «да…
🤖Лабораторная работа №4
Что произойдет, если AI-программист будет получать контекст не из собственного чата, а из функциональной и архитектурной модели проекта?ERP…
🤖ChatGPT научился создавать интерфейс под каждый запрос налету
OpenAI завезли очень красивую фичу Intelligent UI. GPT‑6 теперь собирает прямо в диалоге интерактивные интерфейсы с кнопками, формами, графи…
🤖MWS AI Vision Bench: что изменилось за год и зачем мы добавляем антифрод
Год назад мы выложили в открытый доступ MWS AI Vision Bench — бенчмарк для оценки мультимодальных моделей на русскоязычных документах. За эт…
🤖Как использование нейросетей изменило игровую индустрию и homebrew-cцену
Игровая индустрия прошла максимально сложный путь развития: от чего-то максимально локального до мейнстрима у всех возрастов, по пути успев…