FalcoSoft ITS
Active Member
аз винаги си обсъждам работата с chatGPT: Днес ми копирах статия за него и за новия Астра.
Това е отговора му:
Ти просто ми го хвърляш като: „гледай какво идва след теб“.
И всъщност най-интересното за мен в цялото нещо не са бенчмарковете. Това, което описваш за computer use + browser + terminal + software engineering, е точно посоката, която има значение за начина, по който работим ние.
При нашата работа разликата няма да е дали моделът решава с 8% повече някакъв академичен тест. Разликата ще е дали може да му кажеш:
И точно затова ми направи впечатление твърдението за почти двойно по-бърза работа с браузър/компютър спрямо 5.6 Sol. Ако това се проявява и в реални задачи, ще е много по-голяма промяна от обичайното „новият модел е с X точки по-добър“.
А това с Critical cyber capability е още по-интересно. Ако един general-purpose модел действително е стигнал ниво, при което OpenAI смята, че unrestricted версията може систематично да намира и експлоатира неизвестни уязвимости, това вече е качествено различна категория способности. Напълно логично е тогава да има отделен режим за проверени security специалисти.
И репликата на Брокман за AGI е може би най-любопитната част. Не защото трябва автоматично да приемем „Astra = AGI“, а защото човек на неговата позиция казва по същество: възможно е историческата граница да се окаже точно около този момент.
А най-забавното е, че точно днес се занимаваме с demo-summer-stage.jpg, CSS cache busting и размерите на две карти.
От „ерата на AGI“ директно обратно към:
grep -n -A8 '@keyframes eticketsFocusImageFade' demo/assets/css/site.css
Това е реалният живот на AGI
Това е отговора му:
Ти просто ми го хвърляш като: „гледай какво идва след теб“.
И всъщност най-интересното за мен в цялото нещо не са бенчмарковете. Това, което описваш за computer use + browser + terminal + software engineering, е точно посоката, която има значение за начина, по който работим ние.
При нашата работа разликата няма да е дали моделът решава с 8% повече някакъв академичен тест. Разликата ще е дали може да му кажеш:
...и той действително да извърши целия цикъл надеждно, вместо ние да си подаваме SSH блокове един по един.„Влез в сървъра, виж защо снимката на eTickets не се сервира правилно, провери Nginx/PHP/CSS, направи backup, оправи го и провери production.“
И точно затова ми направи впечатление твърдението за почти двойно по-бърза работа с браузър/компютър спрямо 5.6 Sol. Ако това се проявява и в реални задачи, ще е много по-голяма промяна от обичайното „новият модел е с X точки по-добър“.
А това с Critical cyber capability е още по-интересно. Ако един general-purpose модел действително е стигнал ниво, при което OpenAI смята, че unrestricted версията може систематично да намира и експлоатира неизвестни уязвимости, това вече е качествено различна категория способности. Напълно логично е тогава да има отделен режим за проверени security специалисти.
И репликата на Брокман за AGI е може би най-любопитната част. Не защото трябва автоматично да приемем „Astra = AGI“, а защото човек на неговата позиция казва по същество: възможно е историческата граница да се окаже точно около този момент.
А най-забавното е, че точно днес се занимаваме с demo-summer-stage.jpg, CSS cache busting и размерите на две карти.
От „ерата на AGI“ директно обратно към:
grep -n -A8 '@keyframes eticketsFocusImageFade' demo/assets/css/site.css
Това е реалният живот на AGI