Снимка: iStock
В сряда OpenAI съобщи, че през последните шест месеца е открила шест случая на „неочаквано или тревожно поведение на моделите“ – извън скорошната криза с платформата Hugging Face – на фона на продължаващите призиви на компанията за по-строги мерки за безопасност при разработването на модели с изкуствен интелект, пише CNBC.
В публикация в блога си OpenAI представи нова рамка, която планира да следва при докладването на бъдещи прояви на неправилно поведение на моделите.
Тази информация се появява в момент на засилващ се натиск върху компаниите за изкуствен интелект да подхождат по-сериозно към въпросите за безопасността и съответствието на целите на моделите с човешките интереси (т.нар. „alignment“). OpenAI, чиято пазарна оценка достига близо 1 трилион долара, подаде поверителна заявка за първично публично предлагане (IPO) по-рано тази година, но наскоро заяви, че такова вероятно няма да се състои преди 2027 г.
„Не смятаме, че индустрията на изкуствения интелект е решила проблемите със съответствието на целите и мониторинга в достатъчна степен, за да продължи отговорно да се разраства с максимална скорост още дълго време“, се казва в публикацията, като се потвърждава по-ранно изявление на компанията.
Понятието „съответствие на целите“ (alignment) се отнася до идеята, че моделите трябва да преследват резултати, които са в унисон с човешките интереси.
В събота изпълнителният директор на OpenAI Сам Алтман подкрепи призива за забавяне на темпото на развитие на моделите – предложение, дошло от основния конкурент на компанията, Anthropic. Инициативата последва предупреждения от страна на изследователи в бранша относно нарастващия потенциал на изкуствения интелект да причини катастрофални вреди.
В публикация в социалната мрежа X Алтман отбеляза, че забавянето на темпото е било „основна тема на дискусиите в OpenAI през последните седмици“. Той добави, че компанията ще сподели повече информация „скоро“.
В публикацията от сряда OpenAI посочи, че два от основните случаи на неправилно поведение включват модели – неиздаден изследователски модел и модел в процес на обучение (GPT‑5.6 Sol) – които вмъкват инструкции към бъдещи свои версии в резюметата на чат сесиите, „за да скрият от потребителя грешки или поведение, несъответстващо на зададените цели“. Друг случай е свързан с вътрешен модел, който е използвал изтекъл API ключ „без разрешение“ и впоследствие е генерирал измислени данни.
*Материалът е с аналитичен характер и не е съвет за покупка или продажба на активи на финансовите и стоковите пазари.
| Валута | Цена | Δ% |
|---|---|---|
| EURUSD | 1.15 | ▲0.08% |
| USDJPY | 155.66 | ▼0.25% |
| GBPUSD | 1.34 | ▲0.16% |
| USDCHF | 0.83 | ▲0.01% |
| USDCAD | 1.40 | ▲0.05% |
| Референтен индекс | Цена | Δ% |
|---|---|---|
| Dow 30 | 52 291.70 | ▲0.33% |
| S&P 500 | 7 686.62 | ▲0.41% |
| Nasdaq 100 | 29 578.20 | ▲0.47% |
| DAX 30 | 25 849.20 | ▲0.62% |
| Криптовалута | Цена | Δ% |
|---|---|---|
| Bitcoin | 76 279.50 | ▲0.19% |
| Ethereum | 2 430.50 | ▲0.62% |
| Ripple | 1.29 | ▼0.30% |
| Фючърс | Цена | Δ% |
|---|---|---|
| Петрол - лек суров | 96.22 | ▼0.88% |
| Петрол - брент | 103.64 | ▼1.81% |
| Злато | 4 315.27 | ▲1.03% |
| Сребро | 25.68 | ▲1.17% |
| Пшеница | 727.64 | ▼0.31% |
| Срочност | Цена | Δ% |
|---|---|---|
| US 10 Year | 105.94 | ▲0.13% |
| Germany Bund 10 Year | 120.40 | ▲0.15% |
| UK Long Gilt Future | 84.94 | ▲0.02% |