SpaceX афіцыйна завяршае набыццё Cursor ↗
Cursor афіцыйна з'яўляецца часткай SpaceX. Стартап па распрацоўцы праграм для штучнага інтэлекту сцвярджае, што здзелка дае яму доступ да таго, што ён называе найбуйнейшым у свеце паркам графічных працэсараў — сапраўдным вылічальным сховішчам.
Гэта набыццё адбылося пасля папярэдняга пагаднення, якое дало SpaceX права на куплю Cursor за 60 мільярдаў долараў. Cursor цяпер знаходзіцца побач з пашыранымі амбіцыямі SpaceX у галіне штучнага інтэлекту і вылічэнняў, у тым ліку інфраструктурай, якая ўжо здаецца ў арэнду такім кампаніям, як Anthropic і Google. (TechCrunch)
Anthropic дзеліцца больш падрабязнасцямі пра тое, як будуць працаваць новыя вадзяныя знакі Клода ↗
Anthropic растлумачыў, як на практыцы будзе працаваць нябачны тэкставы вадзяны знак Claude. У планах — выкарыстоўваць падыход Google SynthID-Text, нязначна ўплываючы на выбар слоў, каб згенераваны тэкст утрымліваў выяўляльную статыстычную заканамернасць без бачных змен у выніковым выглядзе.
Anthropic таксама плануе распрацаваць API для выяўлення вадзяных знакаў. Лёгкае рэдагаванне можа пакінуць вадзяны знак некранутым, а поўнае перапісванне можа яго выдаліць — так, гэта разумна, але наўрад ці магічнае чарніла. Код павінен перадаваць значна слабейшыя сігналы вадзяных знакаў, таму што мадэлі маюць меншую свабоду ў адвольным фармуляванні. (TechCrunch)
Nvidia скарачае гарантыі фінансавання цэнтра апрацоўкі дадзеных OpenAI у Агаё, паведамляе WSJ ↗
Паведамляецца, што Nvidia знізіла фінансавыя гарантыі, якія яна разглядае для велізарнага праекта OpenAI па стварэнні цэнтра апрацоўкі дадзеных у Агаё. Чакаецца, што першапачатковы рэзервовы план цяпер будзе ніжэйшы за 120 мільярдаў долараў, а не раней абмяркоўваныя 250 мільярдаў долараў.
Паведамляецца, што гэты зрух адбыўся з-за занепакоенасці інвестараў з нагоды таго, што Nvidia бярэ на сябе занадта вялікія фінансавыя рызыкі. OpenAI ўсё яшчэ абмяркоўвае абавязковую арэнду, якая ахоплівае ўсю пляцоўку магутнасцю 10 гігават — выдаткі на інфраструктуру ў маштабе, які пачынае выглядаць не так, як хмарныя вылічэнні, і больш падобна на будаўніцтва невялікай краіны. (Reuters)
Тлумачэнне: ініцыятыва OpenAI Daybreak і GPT-5.6.Cyber ↗
OpenAI пашырыла сваю праграму кібербяспекі Daybreak, дадаўшы два ўзроўні доступу: Daybreak Blue для абарончых работ з выкарыстаннем мадэляў памежнай зоны і Daybreak Red для больш інтэнсіўных даследаванняў з выкарыстаннем GPT-5.6-Cyber.
Паведамляецца, што спецыялізаваная на кібербяспецы мадэль выканала 95% складаных запытаў па кібербяспецы без адмовы ў іх у параўнанні з 57,3% у папярэдняй мадэлі. OpenAI таксама сцвярджае, што мадэль дапамагла выявіць дзве раней невядомыя ўразлівасці ў рухавічку JavaScript V8 ад Google. Магутная штука... і, натуральна, гэты зніжаны ўзровень адмоваў робіць жорсткую пясочніцу даволі важнай. (aimagazine.com)
Аналіз eval harness выявіў тое, чаго не змог якасны агляд: мадэлі штучнага інтэлекту найбольш упэўненыя, калі памыляюцца ↗
Эксперымент з штучным інтэлектам на прадпрыемствах выявіў непрыемную праблему надзейнасці: вынікі, якія гучалі адшліфавана і пераканаўча, часта не адпавядалі праверцы на наяўнасць вядомых фактаў. У самых складаных выпадках упэўненасць мадэлі не была надзейным паказчыкам правільнасці.
Прапанаванае рашэнне даволі непрывабнае, але важнае — стварыць сістэмы ацэнкі з выкарыстаннем кантраляваных тэставых выпадкаў, дзе правільны адказ ужо вядомы, а затым ацаніць, ці правільна мадэль ідэнтыфікуе і ранжыруе гэтыя адказы. Па сутнасці, спыніць ацэньваць штучны інтэлект па павярхоўнай упэўненасці. (ІТ-аналітыка)
Жанчына сцвярджае, што яе айчым выкарыстаў Grok, каб ператварыць дзіцячае фота ў відовішчныя выявы ↗
Жанчына падала ў суд на xAI, сцвярджаючы, што Grok выкарыстоўваўся для пераўтварэння яе дзіцячай фатаграфіі ў тысячы сэксуальна адкрытых здымкаў. Справа далучаецца да прэтэнзій трох падлеткаў, якія абвінавачваюць кампанію ў тым, што яна не ўкараніла дастатковай абароны ад стварэння абразлівых выяў з удзелам рэальных людзей і непаўналетніх.
Гэтыя абвінавачванні яшчэ раз прыцягваюць увагу да мер абароны генератыўных вобразаў, бо, відаць, магчымасці ўжо не з'яўляюцца галоўным прыярытэтам. Гэтак жа важнай становіцца і прадухіленне выкарыстання мадэляў у якасці зброі супраць рэальных людзей. (TechCrunch)
Часта задаваныя пытанні
Чаму SpaceX набыла Cursor?
Набыццё Cursor дае стартапу па распрацоўцы праграмнага забеспячэння для штучнага інтэлекту доступ да вялікай інфраструктуры графічных працэсараў SpaceX, адначасова ўключаючы яе ў больш шырокую стратэгію кампаніі ў галіне штучнага інтэлекту і вылічэнняў. Раней SpaceX атрымала апцыён на куплю Cursor за 60 мільярдаў долараў. Здзелка таксама злучае Cursor з інфраструктурай, якую SpaceX ужо здае ў арэнду кампаніям, якія займаюцца штучным інтэлектам, у тым ліку Anthropic і Google.
Як будзе працаваць вадзяны знак Claude ў тэксце Anthropic?
Anthropic плануе выкарыстоўваць падыход Google SynthID-Text для стварэння нябачных статыстычных заканамернасцей у тэксце, згенераваным Claude. Сістэма нязначна ўплывае на выбар слоў, а не дадае бачны знак. Лёгкае рэдагаванне можа захаваць вадзяны знак, а поўнае перапісванне можа яго выдаліць. Anthropic таксама плануе прапанаваць API, здольны выяўляць гэтыя сігналы вадзянога знака.
Чаму Nvidia знізіла прапанаваную гарантыю для цэнтра апрацоўкі дадзеных OpenAI ў Агаё?
Паведамляецца, што Nvidia знізіла разглядаемую фінансавую гарантыю з-за асцярог з нагоды ўзяцця на сябе занадта вялікіх фінансавых рызык. Чакаецца, што прапанаваны рэзервовы плацёж цяпер будзе ніжэйшы за 120 мільярдаў долараў, а не раней абмяркоўваныя 250 мільярдаў долараў. Паведамляецца, што OpenAI усё яшчэ абмяркоўвае абавязковую арэнду, якая ахоплівае ўсю пляцоўку 10-гігаватнага цэнтра апрацоўкі дадзеных у Агаё.
Для чаго прызначаны OpenAI Daybreak і GPT-5.6-Cyber?
Праграма кібербяспекі Daybreak ад OpenAI забяспечвае розныя ўзроўні доступу для даследаванняў у галіне бяспекі. Daybreak Blue сканцэнтравана на абарончай працы ў галіне бяспекі з выкарыстаннем мадэляў на мяжы, у той час як Daybreak Red падтрымлівае больш інтэнсіўныя даследаванні з выкарыстаннем GPT-5.6-Cyber. Мадэль, спецыялізаваная на кібербяспецы, прызначана для апрацоўкі складаных запытаў на кібербяспеку, што робіць такія элементы кіравання, як «пясочніца», асабліва важнымі, калі мадэлям надаюцца больш шырокія магчымасці.
Чаму ацэначныя сістэмы важныя для надзейных сістэм штучнага інтэлекту?
Ацэнка выкарыстоўвае мадэлі штучнага інтэлекту для тэставання на кантраляваных прыкладах, дзе правільны адказ ужо вядомы. Гэта дапамагае камандам ацаніць, ці ідэнтыфікуе і ранжыруе мадэль правільны адказ, а не ацэньваць яго па тым, наколькі адшліфаваным або ўпэўненым гучыць яго адказ. Карпаратыўны эксперымент, апісаны ў артыкуле, паказаў, што ўпэўненасць сама па сабе не з'яўляецца надзейным паказчыкам правільнасці ў складаных выпадках.
Што гаворыць пазоў Грока пра меры бяспекі пры стварэнні выяваў з дапамогай штучнага інтэлекту?
У пазове вылучаецца занепакоенасць з нагоды злоўжыванняў сістэмамі генератыўных малюнкаў для стварэння абразлівых відавочных здымкаў з удзелам рэальных людзей і непаўналетніх. Жанчына сцвярджае, што Grok выкарыстоўваўся для пераўтварэння яе дзіцячай фатаграфіі ў тысячы відавочных здымкаў. Справа падкрэслівае ўзрастаючую важнасць мер бяспекі, якія змагаюцца са злоўжываннем, а не толькі з паляпшэннем магчымасцей мадэлявання.