coolice
Owner
Caveman
98.4K (github) започна като умение/плъгин за Claude Code, Codex, Gemini, Cursor, Windsurf, Cline, Copilot и над 30 други агента. Инсталирайте го веднъж; агентът ще запълни данните и ще отговори на стегнат пещерен език, като същевременно ще запази кода, командите и грешките байт по байт точност.
github.com
Прави агента да отговаря много по-кратко (без излишни думи, статии, хеджиране и т.н.), като запазва техническата точност и кода byte-for-byte.

Бенчмарк (средно 65% по-малко output токени):
Диапазонът е от ~22% до 87%, в зависимост от задачата (по-дългите обяснения и debugging пестят най-много).
Обобщение:
Има и /caveman-stats, което показва реалните числа от сесията (включително нетния ефект след overhead-а).
=========
Лесна само един агент (пълната и повече на репото)
Интересното е че и официалния Claude акаунт със 156к последователи е контрибутнал към това репо през последената седмица

GitHub - JuliusBrussee/caveman: 🪨 why use many token when few token do trick — Claude Code skill that cuts 65% of tokens by talking like caveman
🪨 why use many token when few token do trick — Claude Code skill that cuts 65% of tokens by talking like caveman - JuliusBrussee/caveman
Основният skill (говорене като пещерен човек) —
Прави агента да отговаря много по-кратко (без излишни думи, статии, хеджиране и т.н.), като запазва техническата точност и кода byte-for-byte.

Бенчмарк (средно 65% по-малко output токени):
| Задача | Нормално | Caveman | Спестени |
|---|---|---|---|
| React re-render обяснение | 1180 | 159 | 87% |
| Auth middleware token expiry | 704 | 121 | 83% |
| PostgreSQL connection pool | 2347 | 380 | 84% |
| Git rebase vs merge | 702 | 292 | 58% |
| Refactor към async/await | 387 | 301 | 22% |
| Microservices vs monolith | 446 | 310 | 30% |
| Security PR review | 678 | 398 | 41% |
| Docker multi-stage build | 1042 | 290 | 72% |
| PostgreSQL race condition | 1200 | 232 | 81% |
| React error boundary | 3454 | 456 | 87% |
| Средно | 1214 | 294 | 65% |
Диапазонът е от ~22% до 87%, в зависимост от задачата (по-дългите обяснения и debugging пестят най-много).
Важни нюанси
- Пести само output токени. Input и reasoning токените остават същите.
- Самият skill добавя ~1–1.5k input токена на всеки ход (заради инструкциите).
- При кратки отговори или вече лаконични агенти може да излезе нет отрицателно (струва повече, отколкото пести).
- При дълги, разговорни сесии (обяснения, code review, архитектура) печалбата се натрупва добре.
2. Пълната система (Proxy + Engine) —
Компресира това, което моделът чете (tool outputs, логове, JSON, код, резултати от browse и т.н.):- JSON: 70–90%
- Логове: 85–95%
- Код: 40–70%
- Diffs / search results: 60–95%
- Pixel mode (текст → изображения за vision модели): около 79%
- Browse (уеб съдържание): понякога десетки пъти по-малко (пример: 200-редов table → 121 токена)
Обобщение:
- Само skill-ът → средно ~65% по-малко output токени (22–87% в примерите).
- С Proxy/Engine → допълнително силно намаляване на input токените (особено при големи tool outputs и логове).
Има и /caveman-stats, което показва реалните числа от сесията (включително нетния ефект след overhead-а).
=========
Лесна само един агент (пълната и повече на репото)
Код:
# Claude Code
claude plugin marketplace add JuliusBrussee/caveman && claude plugin install caveman@caveman
# Gemini CLI
gemini extensions install https://github.com/JuliusBrussee/caveman
# Codex, Cursor, Windsurf, Cline, and other skills-compatible agents
npx skills add JuliusBrussee/caveman --skill '*' -a codex --yes # replace codex with your agent profile
Интересното е че и официалния Claude акаунт със 156к последователи е контрибутнал към това репо през последената седмица

Последно редактирано: