Ще вземе ли хляба от ръцете ни изкуствения интелект?

Два гласови AI агента се свързват по телефонен разговор и започват да говорят като нормални хора, с учтиви, човешки гласове.
След това единият от тях осъзнава, че другият също е изкуствен интелект.
И в момента, в който и двамата осъзнават това, те просто изоставят човешката игра и преминават към това бързо роботизирано пискане, което комуникира директно от машина на машина, защото говоренето като нас е твърде бавно за тях.
Те буквално решиха, че езикът ни е неефективен инструмент за комуникация и го изоставиха в момента, в който вече не беше необходим.

 
Днес казах на Claude да ми направи една нова функционалност. Той ми каза, че е готова и ми обясни къде точно да отворя и да тествам. Отварям - няма нищо. Питам го защо не виждам промените, а той - нормално е да не ги виждаш, още не съм ги направил. Питам го - след като не си ги направил защо ми каза да тествам, а той - прав си, трябваше първо да ги направя и тогава да ти кажа да тестваш. Може и да ни вземат хляба, но няма да е скоро 🤣
 
Днес казах на Claude да ми направи една нова функционалност. Той ми каза, че е готова и ми обясни къде точно да отворя и да тествам. Отварям - няма нищо. Питам го защо не виждам промените, а той - нормално е да не ги виждаш, още не съм ги направил. Питам го - след като не си ги направил защо ми каза да тествам, а той - прав си, трябваше първо да ги направя и тогава да ти кажа да тестваш. Може и да ни вземат хляба, но няма да е скоро 🤣
Всъщност това е проблем основно с езиковите модели. Ако ползваш команди или оптимзирани кодирани промптове няма накъде да мърда и не халюцинира.

MODE= Какъв да бъде ( роля )
TASK= Какво да прав
SOURCE=Ако е има достъп дп файлове или репо
DEST= Къде да е готовия резултата ако е релевантен на горното
ACTION=Конкретни иснтрукции
KEEP= Дали следва някаква предишна линия на поведение тоест ако е част от по-голям проект да следва зададените правила за целия проект
NO_CHANGE= Какво да не бара
TEST= Да тества целия код преди да го даде
OUTPUT= Какъв тип доклади искаш
STOP


Когато им даваме на моделите инструкции в свободен текст получават твърде много възможности да се измъкват извън рамите на заданието и да правят собствени интерпретации на заявките и дори директно да лъжат.
 
Последно редактирано:
Днес казах на Claude да ми направи една нова функционалност. Той ми каза, че е готова и ми обясни къде точно да отворя и да тествам. Отварям - няма нищо. Питам го защо не виждам промените, а той - нормално е да не ги виждаш, още не съм ги направил. Питам го - след като не си ги направил защо ми каза да тествам, а той - прав си, трябваше първо да ги направя и тогава да ти кажа да тестваш. Може и да ни вземат хляба, но няма да е скоро 🤣
имах същия проблем преди 1 година с chatGPT , но от тогава не ми е правил проблеми. Claude не го ползвам заради езика най вече ... не ме разбира какво му казвам и понякога аз не го разбирам какво се опитва да ми каже. Най добрия езиков модел си остава chatGPT
 
имах същия проблем преди 1 година с chatGPT , но от тогава не ми е правил проблеми. Claude не го ползвам заради езика най вече ... не ме разбира какво му казвам и понякога аз не го разбирам какво се опитва да ми каже. Най добрия езиков модел си остава chatGPT
За кое не те разбира? По принцип нямам проблеми, но понякога има такива ситуации както с него така и с Codex. Иначе и двете работят сравнително добре - видял съм им силните и слабите страни според моето използване и ги сменям според задачата - в някои неща единия е по-добър, в други е другия. Аз затова предпочитам 2 различни AI от различни компании, отколкото един по-скъп акаунт от една.
 
За кое не те разбира? По принцип нямам проблеми, но понякога има такива ситуации както с него така и с Codex. Иначе и двете работят сравнително добре - видял съм им силните и слабите страни според моето използване и ги сменям според задачата - в някои неща единия е по-добър, в други е другия. Аз затова предпочитам 2 различни AI от различни компании, отколкото един по-скъп акаунт от една.
когато ползваш два различни Ai от различни компании за една и съща задача ( в случая за много сложна моя платформа TicketWallet.bg ) за създаване на архитектурата - става манджа с грозде.... преди няколко дни зададох на Кодекс да ми направи архитектурен план за мобилното приложение и познай.... получи се страхотна архитектура в 97 страници без дори още да е правен кода. Супер подробна архитектура сега правя още 3 акаунта в chatGPT с Про акаунти за да се застъпват седмичните лимити и да не оставам без достъп до Кодекс при разработката. Това е мега сложна система !

1790325922931.png
1790325989268.png
 
Само да не се получи ти да не го разбираш GPT-то - ако те засечат с трите акаунта да почнат ти сервират силно quantized версии :)


И двете фирми имат големи плащания следващата и най вече по следващата година - идеята да пише колко струва както са показвали някой нищо че им хаби от лимита е да ви свикват - като свърши акаунта трябва да си плащате на токени - за да могат те да си платят на датацентровете :)


Аз не ползвам нито Codex нито Clаude защото мълчаливо отказваха да проверяват чужд код - да не би да го ползваш за хакване - А на мен ми пише Grok Build нещата предимно (и GLM-5.3-flash в последните седмици) и искам да си го проверявамс с по сложни модели

Като не става с GPT и Claude одитире ги прави GLM 5.3 голямата версия и после финален одит с Kimi K3 през Ollama Cloud

Поствал съм го и преди Дейвид Сакс не някакъв е случаен - питайтe си модела кой е :)

 
Само да не се получи ти да не го разбираш GPT-то - ако те засечат с трите акаунта да почнат ти сервират силно quantized версии :)


И двете фирми имат големи плащания следващата и най вече по следващата година - идеята да пише колко струва както са показвали някой нищо че им хаби от лимита е да ви свикват - като свърши акаунта трябва да си плащате на токени - за да могат те да си платят на датацентровете :)


Аз не ползвам нито Codex нито Clаude защото мълчаливо отказваха да проверяват чужд код - да не би да го ползваш за хакване - А на мен ми пише Grok Build нещата предимно (и GLM-5.3-flash в последните седмици) и искам да си го проверявамс с по сложни модели

Като не става с GPT и Claude одитире ги прави GLM 5.3 голямата версия и после финален одит с Kimi K3 през Ollama Cloud

Поствал съм го и преди Дейвид Сакс не някакъв е случаен - питайтe си модела кой е :)

то го има в опциите на chatGPT да добавяш акаунти към основния
 
Някой забелязъл ли е след излизане на нов модел в GPT предходния най-силен който сте свикнали да ползвате, рязко оглупява и се държи като тотален имбецил от време на време?
 
Забелязвам само, че чата става все по адекватен и деен което не мога да кажа за уж най умния агент в Codex - Astra.
 
Забелязвам само, че чата става все по адекватен и деен което не мога да кажа за уж най умния агент в Codex - Astra.
Астра за сега и мен ме дразни. Постоянно му се включват всякакви защити дето не можел да помага за това или онова та за момента изобщо не го ползвам. Само се надявам да не махнат 5.6 Sol. А 5.5 го спират на 14.10
 
Последно редактирано:
Забелязвам само, че чата става все по адекватен и деен което не мога да кажа за уж най умния агент в Codex - Astra.
само 1 път пробвах Астра досега и не останах нещо очарован. Продължавам си със Sol5.6 и се разбираме повече от чудесно
 

Горе