Кратко Ръководство в Три Стъпки как дa си пуснете Local AI Agent + Model

Губиш паметта от предния път освен ако не си сия екстрактнал модела се запознава с всичко отначало или с промените който е правил другия ще гори токените бързо...

ПП като съвет към всички

Излезе новия OpenClaw в тубата, казват бил като усещане като кодекс което не мога да потвърдя или отрека (нали автора му сега работи за OpenAI) защото не съм работил с нито едно от двете -

Слагате един openclaw и това което виждам изгодно в момента като е z.ai офертат малкия план стига да ви пансат моделите и да нямате проблем с китайците
Това колко е бъгаво, напред -> напред и като запъна и господ не може ти помогна :D
 
Това колко е бъгаво, напред -> напред и като запъна и господ не може ти помогна :D
Ако за openclaw имаш на предвид - Казаха да кажеш на кодинг агента ти да го оправи - сериозно :) Аз съм в другия отбор с Hermes ама сега вървят видя за това :)
 
1788502366640.png
Зарязах го това от по горе и мъча това, ама е пълна трагедия - даваш му ясна задача то ти обяснява как да я направиш, казваш му да е свърши той и спира.
Версиите ли не съм уцелил не знам? Върти и мисли, питам го какъв е прогреса с таска то тръгва да пуска в терминала task update
Явно няма да стане толкова лесно - инстал и хоп да работи.
 
Все пак е bleeding edge на софтуера създаден от човешката цивилизация (която е известна това че прахосмукачките и роботи докато чистят и насичат - понеже са зомбирани да участва ддос атаки ) - а сега сериознп

За open claw 2 ли става на въпрос или Оллама ли си инсталирал ? Оламата е чат и локани сървър и има клауд опция с акаунт аз им ползвам акаунта да взема апи да го сложа в deepseek харнес за кодърите (не кодя аз праащам автномния агент да им казва какво да кодят там) и това го тества вчера :)

Може да го ползваш и с Хермес който е автономен агент,но и може да коди, ако ти трябва но не е специфичен за целта



Инаталация за Мак - сваляш апа само не помня за сетъпа дали можеше директно от него аз минах през hermes setup (няколко екрана и се тъпнах локалното - infrerence машинката) и беше преди два даже три месеца около

Ако имаш олама апи ключ може да сложиш олама за провайдър

А това за безплатните който ми излязоха трябва можеби само да го инсталираш и да ще излязат аз нищо не съм слагал
 
Все пак е bleeding edge на софтуера създаден от човешката цивилизация (която е известна това че прахосмукачките и роботи докато чистят и насичат - понеже са зомбирани да участва ддос атаки ) - а сега сериознп

За open claw 2 ли става на въпрос или Оллама ли си инсталирал ? Оламата е чат и локани сървър и има клауд опция с акаунт аз им ползвам акаунта да взема апи да го сложа в deepseek харнес за кодърите (не кодя аз праащам автномния агент да им казва какво да кодят там) и това го тества вчера :)

Може да го ползваш и с Хермес който е автономен агент,но и може да коди, ако ти трябва но не е специфичен за целта



Инаталация за Мак - сваляш апа само не помня за сетъпа дали можеше директно от него аз минах през hermes setup (няколко екрана и се тъпнах локалното - infrerence машинката) и беше преди два даже три месеца около

Ако имаш олама апи ключ може да сложиш олама за провайдър

А това за безплатните който ми излязоха трябва можеби само да го инсталираш и да ще излязат аз нищо не съм слагал
open claw въобще не тръгна, ollama е това което цитирах.
Това, че е бавно майната му ама никакъв резултат нямаше.
 
Олламата е сървър за локални модели има прост чат клиент и cloud модели, не е харнес / агент може да я ползваш да пуснеш нещо локално тези qwopos серии в би трябвало да дръгнат и 16 ГБ мини и да видиш пасва ли ти като го разпиташ...

точно 2.5 кодера на Qwen само че 7.5b го ползвах през април да си пренапиша bash-a :) спомени...

- В момента ползвам клауд моделите с плана от $20 pro за кодене добавка към супер грок плана ми


в момента от плана от 20 долара дава 60 долара кредити и може да си предцениш колко може да получиш за парите си

от по евтините модели ми харесва този
https://ollama.com/library/glm-5.3-flash въврвеше с 196 токена на секуда - качестовото беше ок ама това е субективен критерии :)

а този е най тежкия за момента от китайците - с него правя финален одит
=====================================


Ако искаш локално mожеби свали https://lmstudio.ai/ то е с най лесен сетъп и Bionic продукта им е и агент ... и лесно се свалят модели от gui и тестваш лесно различни неща

Qwen от 3.5 (Qwopus е дестилиран с Opus 4.6 мисля моде и давал 100 процента съвпадение при tool uses сериите можеби нещо като gemma 4 на Mak

На минито скороста 120 GB/s memory bandwidth... по простата формула за делиш паметта на размера на модела или ако е MoE model (на активните) и ще получиш приблизително теоритичната скорост в токени (без да я достига)

4b model ще ти даде 25 токена на секунда - другото ще е още по бавно...

9b модел 10-15 което е около скоростта с която четящ човек ...


Силата на малките макове с малко повече памет при MoE - архитектура Mixture of Experts активира само малка бройка параметри за дадена задача (expert) прави модела много по-бърз ...

Ако имаше 32 ГБ памет Qwen 3.6 35b A3b активира за 3 миларда параметъра на Q4 квантизация щеше да заеме 21ГБ памет има достатъчно за кеш с голям контекст прозореце и щеше да върви на около 40 токена за секунда теоритичен максимум, кажи ги 30-35

С MTP глава (малък модел който пише преди големия a големия само удобрява още до около 50% токетни отгоре)

с 16 GB си вързан с малките dense (плътни модели) и ограничението за скорост спрямо размера на целия модел

Ако искаш бързо локално тези с видеокартите са шампиони но и разхода на ток и шума скачат ...
 
Последно редактирано:

Горе