Ще вземе ли хляба от ръцете ни изкуствения интелект?

обаче ми е много интересно по какъв критерии се обновяват кредитите в chatGPT , вчера на 2 пъти получиш пълни кредити без да съм ги закупувал, и двата кредита ги изразходвах, сега се събуждам и гледам отново кредитите на 100% . Имам чувството , че следят проектите които се разработват в Codex и стимулират да се продължи с разработката. А наистина проектите върху които работя са уникални....
 
обаче ми е много интересно по какъв критерии се обновяват кредитите в chatGPT , вчера на 2 пъти получиш пълни кредити без да съм ги закупувал, и двата кредита ги изразходвах, сега се събуждам и гледам отново кредитите на 100% . Имам чувството , че следят проектите които се разработват в Codex и стимулират да се продължи с разработката. А наистина проектите върху които работя са уникални....
Следи си и транзакциите, да не се окаже, че имаш некъв ауторефил :)
 
То даже има подобна екстра..

Screenshot_20260728-083904.png
 
Най-голямата ценност в момента е уникалният, генериран от хора, материал за обучение. Няма компания, която да доставя облачен ИИ и да не ползва взаимодействието на потребителите за обучение на нови модели. 99% съм сигурен, че дори да избирате настройката да не се ползват разговорите за обучение, компаниите все пак ги дават на следващата версия да ги чете. Няма кой да ги държи отговорни, а няма и как да се разбере, че го правят. Единствената гаранция, че няма да изтекат фирмени тайни е да се пусне локално на машина, която след конфигуриране никога повече не се свързва с интернет. Защото няма гаранция и при локалния ИИ, ако има достъп до интернет, дали няма да ви прати цялата лична информация към сървъра на ЦРУ или на Китайската комунистическа партия.

Брат, хайде да разбием това твърдение малко по-спокойно...

Моделът, който пускаш локално, е просто GGUF файл... Това са чисти тегла - едни числа, нищо повече... Самият модел няма никакъв код, няма sockets, няма възможност да се свърже с интернет, камо ли да праща данни към някакъв сървър в Китай... Той просто стои там и чака някой да му подаде контекст, за да предскаже следващите токени... (това всъщност правят всички LLM с променлив неуспех 😳)

Този файл се рънва от сървър... Най-популярните са:
  • llama.cpp (написан от българина Георги Герганов - ggerganov)
  • vLLM
  • Ollama
  • llama-server
Всички тези неща са с отворен код... Можеш да ги разгледаш ред по ред, да ги компилираш сам и да ги пуснеш само на localhost... В нормалните имплементации няма вградено „phone home“ към никого...

След това ти командваш този сървър през какъвто си избереш harness - OpenWebUI, Open Code, Continue, Aider, обикновен curl към 127.0.0.1 или някакъв агент... (даже може харнеса да е прост хтмл файл с чат прозорец - ако някой иска такъв да каже имам мой си ще го споделя - не че не можете да си накодите един * ) Ти решаваш дали да му дадеш инструменти, дали тези инструменти имат достъп до интернет и дали изобщо може да изпълнява външни заявки...

Ако пускаш чист чат без tools или агент с изключени мрежови функции + firewall на процеса - моделът физически няма как да прати нищо никъде, дори компютърът да е онлайн...


Голямото объркване идва от друго място... Много хора бъркат истинския локален сетъп с десктоп и кодинг апликациите, които frontline AI доставчиците ти пъхат (затворени приложения, .exe/.app файлове)... Там кодът е затворен, не знаеш какво точно правят на заден план и дали пращат нещо навън (освен че през API пращаш навън)... При истинския локален AI обаче не си сваляш някакво китайско .exe да работиш... Имаш само файла с теглата (дори да е от китайски модел като Qwen или DeepSeek) и отворен сървър, който ти контролираш напълно...

Air-gap след конфигурация е много силен вариант, няма спор... Но не е единствената гаранция... Ако знаеш какво пускаш, какво му позволяваш и как е конфигуриран сървърът, локалният AI не ти изпраща фирмените тайни към никого...

ПП
Kомпилиан от гит хъб код llama.cpp сървър https://github.com/ggml-org/llama.cpp отитиран от 1800+ контрибутори (може да си го отитирате и сами, както и с някоколко АИ кодери едновременно да ви потвърдят - като платите цената в токени) че няма phone home опции - работещ с прост харнес - 21 кб хтмл файл (който също може да си отидирате по-лесно от по про UI-тата) - с отворен код бай дизайн - Гарантирано!!! не праща фирмените ви тайни никъде !!! няма значение какъв gguf файл му качите да ползва (китайски / американски)

html-chat.png


ППП с 21 кб чат харнес хтмл броя ли се за вайб кодър и аз ххахахах. :cool::p:love: Питам за да вляза напълно в роля grinding... cooking up... 🤑🤑🤑
 
Последно редактирано:
Следи си и транзакциите, да не се окаже, че имаш некъв ауторефил :)
имам ауторефил, но аз винаги замразявам след транзакция виртуалните карти с които плащам. Не е от там
 
Моделът, който пускаш локално, е просто GGUF файл... Това са чисти тегла - едни числа, нищо повече... Самият модел няма никакъв код, няма sockets, няма възможност да се свърже с интернет, камо ли да праща данни към някакъв сървър в Китай... Той просто стои там и чака някой да му подаде контекст, за да предскаже следващите токени... (това всъщност правят всички LLM с променлив неуспех 😳)

Този файл се рънва от сървър... Най-популярните са:
  • llama.cpp (написан от българина Георги Герганов - ggerganov)
  • vLLM
  • Ollama
  • llama-server
Всички тези неща са с отворен код... Можеш да ги разгледаш ред по ред, да ги компилираш сам и да ги пуснеш само на localhost... В нормалните имплементации няма вградено „phone home“ към никого...
Да, на теория ако си гледаш всички изходящи връзки ще видиш ако става нещо нередно, но това не е реалистично да се прави постоянно. Никой не работи така.

Такова понятие като отворен код няма при ИИ, защото няма код. Имаш отворени тежести. В GGUF файла имаш информация в невронната мрежа между кои неврони има връзка и с каква сила. Общо взето това е. Тази информация не може да прочетена и разбрана по никакъв начин, за разлика от сорс кода. Можеш само косвено да разбереш моделът как е обучаван като разговаряш с него. Но той може да лъже, да дава умишлено подвеждаща информация по определени въпроси и т.н. Може като част от обучението му да има инструкции за кражба на определена информация и пращане на определено място. Няма как да знаеш със сигурност. Може да е обучен да ползва 0-day уязвимости в llama.cpp, за които знаят само ЦРУ примерно или някой друг. Всички тези неща с времето стават все по-възможни с бързия скок в интелигентността.

Теоретично, с правилно написан код може да се вържеш към интернет дори с машина без никаква мрежова карта и подобни възможности. Преди време беше установено, че с определен програмен код може да се накара една серия процесори да приемат и изпращат WiFi сигнал чрез компютър без никакви мрежови възможности. И това го бяха открили хора. Сега със способностите на ИИ представи си какви са възможностите. Но тази последната възможност, за която говоря все още не е реалистична. След 2-3 г. макс ще бъде.
 
гледам пуснали някви джаджи за ИИ като второто е сървър с най мощните в света видеокарти и ги отдават под наем на OpenAi и на други ИИ ... на втората снимка една от видеокартите струвала 98000 евро
:)

1785241136685.png

1785241184892.png
 
  • NVIDIA GB200 Grace Blackwell Superchip;
  • двуграфичен модул GB200;
  • или специализирана OEM система с един или два Blackwell ускорителя.
Тези решения вече спокойно могат да надхвърлят 90 000 евро, а пълните DGX B200 системи с 8 Blackwell GPU струват над 500 000 USD, като цели шкафове с десетки GPU достигат няколко милиона долара. NVIDIA

За сравнение:

МоделПриблизителна ценаПредназначение
RTX 5090~2 500–4 000 €Гейминг / AI разработка
RTX Pro 6000 Blackwell~8 000 €Workstation
NVIDIA B200~30 000–55 000 USDAI Data Center
GB200 Superchip~90 000 €+Enterprise AI
DGX B200 (8× B200)~500 000 USDAI Factory
 
Да, на теория ако си гледаш всички изходящи връзки ще видиш ако става нещо нередно, но това не е реалистично да се прави постоянно. Никой не работи така.

Такова понятие като отворен код няма при ИИ, защото няма код. Имаш отворени тежести. В GGUF файла имаш информация в невронната мрежа между кои неврони има връзка и с каква сила. Общо взето това е. Тази информация не може да прочетена и разбрана по никакъв начин, за разлика от сорс кода. Можеш само косвено да разбереш моделът как е обучаван като разговаряш с него. Но той може да лъже, да дава умишлено подвеждаща информация по определени въпроси и т.н. Може като част от обучението му да има инструкции за кражба на определена информация и пращане на определено място. Няма как да знаеш със сигурност. Може да е обучен да ползва 0-day уязвимости в llama.cpp, за които знаят само ЦРУ примерно или някой друг. Всички тези неща с времето стават все по-възможни с бързия скок в интелигентността.

Теоретично, с правилно написан код може да се вържеш към интернет дори с машина без никаква мрежова карта и подобни възможности. Преди време беше установено, че с определен програмен код може да се накара една серия процесори да приемат и изпращат WiFi сигнал чрез компютър без никакви мрежови възможности. И това го бяха открили хора. Сега със способностите на ИИ представи си какви са възможностите. Но тази последната възможност, за която говоря все още не е реалистична. След 2-3 г. макс ще бъде.


Ще опитам да го обясня съвсем просто, без теория...


Стъпка 1. GGUF файлът е само тегла... Това са числа, които казват този неврон влияе на онзи с такава сила... Самият файл не може да прави нищо... Не може да се свързва с интернет, не може да пише файлове, не може да краде... Той просто стои...

Стъпка 2. За да работи този файл, трябва програма, която го зарежда... Тази програма е llama.cpp или vLLM, Ollama и т.н... Това вече е истински код - програма на C++ или Python... И този код е отворен... Можеш да го прочетеш ред по ред... Там пише точно какво прави: чете теглата, смята, връща текст... Нищо повече...

Стъпка 3. Когато говориш с модела, се случва следното: ти пишеш текст - програмата llama.cpp го подава на теглата - теглата връщат следващите думи - програмата ти ги показва...Край... Никакви други действия... Няма мрежа, няма файлове, няма пращане...

Стъпка 4. Моделът може да иска да направи нещо, например да каже изпрати този файл на адрес X... Но това е само текст... Програмата, която го пуска, не изпълнява този текст като команда... Тя просто го показва на екрана... За да се случи нещо реално, трябва някой ти или агент нарочно да вземе този текст и да го изпълни като команда... Ако не го направиш - нищо не се случва...

Стъпка 5. Затова обучен да краде и праща не работи директно... Моделът може само да напише текст... Ако нямаш агент с инструменти, които правят мрежови заявки, и ако не си му дал право да ги ползва - няма как да прати нищо... Дори да е супер интелигентен...

Стъпка 6. Идеята, че моделът може да използва 0-day в llama.cpp, също е далеч... llama.cpp чете текста като обикновен чат... Той не изпълнява кода, който моделът изплюва... За да се експлоатира уязвимост, трябва уязвимостта да е в начина, по който програмата обработва текста, и моделът да я задейства само с думи... Това е изключително трудно и към момента няма известен такъв случай при нормална употреба...

Стъпка 7. За изходящите връзки: не трябва да ги гледаш постоянно... Слагаш веднъж правило на firewall-а този процес няма право на интернет или пускаш всичко в контейнер без мрежа... Готово... След това дори да иска - няма как да излезе...

Накратко: теглата са глупави числа...Програмата, която ги пуска, е отворена и под твой контрол...Моделът може само да говори...Действията се случват само ако ти нарочно му дадеш инструменти и позволиш да ги ползва...

И най-важното как работи всъщност... Моделът не мисли, не планира и не изпълнява планове... Той просто предсказва следващата дума... Получава досегашния текст и изчислява коя дума е най-вероятна да продължи... После взима тази дума, добавя я към текста и пак предсказва следващата... И така дума по дума, докато не спре... Цялото му поведение е само поредица от такива предсказания... Няма скрит агент вътре, няма способност да действа сам, няма връзка с външния свят... Само предсказване на следващата дума според научените тегла...

ПП Ако не вярваш на операционната си система че няма да сподели фирмените ти тайни не е нужен файл с модел да ги сподели...

ППП Ако искаш мога да разпиша за случая с ChatGPT и историята с хакването (това са неща случили се на стъпки 4,5) ...
 
гледам пуснали някви джаджи за ИИ като второто е сървър с най мощните в света видеокарти и ги отдават под наем на OpenAi и на други ИИ ... на втората снимка една от видеокартите струвала 98000 евро
:)

Виж файлът 36946

Виж файлът 36947


Аз съм като с това първото вариацията на Асус


И успях да го взема преди няколко месеца за 3200 евро реших да си събирам пари за второ да си направя клъстър но цената излетя... :(

Отначало тези дето цъкаха локално АИ на видео карти му дадоха слаби ревюта цената стагнира... но после хората и малките бизнеси се усетиха за какво може да се ползва и каква е икономическата логика зад ползването му ... освен че АИ то ти е напълно праивът и отговаря на GDPR и ЕУ АИ акта... и цената излетя

Има си предимства и недостатъци спрямо видео картите мога да разпиша ако ще е интересно и някой проявява интерес...

...............

За второто нямам толкова пари а и не ти трябва освен ако няма да пускаш комерсиални операции или трябва да доставиш корпоративно АИ за многохилядна компания
 
Последно редактирано:
Аз съм като с това първото вариацията на Асус


И успях да го взема преди няколко месеца за 3200 евро реших да си събирам пари за второ да си направя клъстър но цената излетя... :(

Отначало тези дето цъкаха локално АИ на видео карти му дадоха слаби ревюта цената стагнира... но после хората и малките бизнеси се усетиха за какво може да се ползва и каква е икономическата логика зад ползването му ... освен че АИ то ти е напълно праивът и отговаря на GDPR и ЕУ АИ акта... и цената излетя

Има си предимства и недостатъци спрямо видео картите мога да разпиша ако ще е интересно и някой проявява интерес...

...............

За второто нямам толкова пари а и не ти трябва освен ако няма да пускаш комерсиални операции или трябва да доставиш корпоративно АИ за многохилядна компания
1785246142485.png
 

Евтиното винаги излиза скъпо накрая - да ще наемеш видеокарти за 5 долара на ден или за 25 но пак трябва да се напишат една камара обяснения във вътрешна документация ако искаш всичко да ти е ок като правиш бизнес в Европа... и трябва да вярваш на провайдъра на хардуера... Единственото предимство че е по малко вероятно нещо да изтече... и после конкуренцията ти да го ползва срещу няколко стотин токена на заявка ...

ПП Цената на един актив расте докато не е икономически вайбъл да се дава под наем за периода на амортизацията си...
 
Редно е да споделим целия пост че се почна преразказ по картинка :D
изобщо не коментираме поста от фейса защото човека там освен, че се хвали с въпрос друго не прави. Тук темата е съвсем различна
 
predniq пост имах предвид

Ако е било към мен

Аз тръгнах да обяснявам в по предния си пост защо DGX Spark вариациите са вайбъл за малък бизнес в определени ситуации... Например когато искаш "голям" модел или ако ползва два малки модела един за ексекютор един за верифайър и работи повече от един човек с модела... спрямо видео картите...

Слет това беше с поста цените на наемите след това го приех като потенциално предложение да наема видеокарти... вместо да се бръкна за спакр клъстър... (което има недостатъците който споменах) в поста си
 
Ако е било към мен

Аз тръгнах да обяснявам в по предния си пост защо DGX Spark вариациите са вайбъл за малък бизнес в определени ситуации... Например когато искаш "голям" модел или ако ползва два малки модела един за ексекютор един за верифайър и работи повече от един човек с модела... спрямо видео картите...

Слет това беше с поста цените на наемите след това го приех като потенциално предложение да наема видеокарти... вместо да се бръкна за спакр клъстър... (което има недостатъците който споменах) в поста си
ооо не, не ... изобщо нямах предвид да се наемат карти, просто направих сравнение с актуалните неща в момента
 

Горе