Навіны штучнага інтэлекту, 2 верасня 2026 г

Агляд навін і віктарына па штучным інтэлекце: 2 верасня 2026 г

Новая тэхніка разважанняў OpenAI трывожыць экспертаў па бяспецы штучнага інтэлекту

Паведамляецца, што будучая мадэль Astra ад OpenAI абапіраецца на «рэкурэнтную глыбіню» — прыём цыклічнага разважання, які апрацоўвае адзін і той жа запыт некалькі разоў у сетцы. Спецыялісты па бяспецы не спакойныя з гэтай нагоды. Занепакоенасць выклікае тое, што непразрыстая рэкурэнтнасць пакідае менш выразных слядоў ланцуга думак, і гэта менавіта тыя сляды, якія выкарыстоўвалі даследчыкі пасля таго, як гэтыя няўдалыя агенты пайшлі не так.

Бак Шлегерыс з Redwood назваў гэтую інфармацыю «надзвычай трывожнай», а Цві Маўшовіц выказаў меркаванне, што для спынення гонкі маніторынгу на дно могуць спатрэбіцца законы. OpenAI сцвярджае, што Astra выкарыстоўвае гэтую тэхніку абмежавана, і мысленне мадэлі павінна быць чытэльным... ці, прынамсі, так сцвярджаецца ў кампаніі. Галоўны навуковец Якуб Пахоцкі падкрэсліў, што захаванне кантраляванага ланцужка думак па-ранейшаму з'яўляецца асноўнай мэтай даследавання, нават калі The Information паведамляе, што Anthropic і Google DeepMind таксама ўжо прасоўваюць гэтую ідэю. Дзіўна канкурэнтаздольны час. (TechCrunch)

Прадстаўляем Gemini 3.8 Flash і 3.8 Flash Cyber

Google выпусціў сваю трэцюю мадэль Flash за шэсць тыдняў, і рытм тэмпаў пачынае крыху кружыцца. Gemini 3.8 Flash рэкламуецца як найлепшы Flash для разважанняў і кадавання, пры гэтым пачатковая цана па-ранейшаму такая ж, як і ў версіі 3.7: 0,75 долара за мільён уваходных токенаў і 3,75 долара за мільён вывадных. Google сцвярджае, што ён больш старанна працуе над складанымі задачамі — больш этапаў разважанняў, больш выклікаў інструментаў — і пераўзыходзіць доўгатэрміновыя тэсты праграмнай інжынерыі, якія звычайна належаць больш буйным і дарагім мадэлям.

Побач з ім знаходзіцца Gemini 3.8 Flash Cyber, варыянт, арыентаваны на абаронцаў, які дазваляе знаходзіць памылкі і ствараць патчы, прайшоў праз новую праграму Fairwind для давераных урадаў і аператараў інфраструктуры. Паведамляецца, што каманда бяспекі Chrome атрымала ў 2,6 раза больш правільных патчаў з яго дапамогай, а каманда Cloud па пошуку ўразлівасцей выявіла крытычную праблему менш чым за дзве гадзіны. Звычайны Flash распаўсюджваецца ў праграме Gemini, рэжыме пошуку AI, Табліцах, AI Studio і прадпрыемствах. Cyber ​​застаецца толькі па запрашэннях, што... так, напэўна, да лепшага. (Google)

Anthropic выпускае Claude Fable 5.1 і Mythos 5.1

Anthropic выпусціла Claude Fable 5.1 для ўсіх, хто можа заплаціць, і Claude Mythos 5.1 для значна меншага клуба давераных асоб. Тая ж базавая мадэль, іншыя параметры бяспекі. Fable — гэта агульнадаступны інструмент для кадавання і працы з ведамі; Mythos аслабляе абмежаванні ў кібер- і біялагічных навуках для правераных амерыканскіх арганізацый, а таксама забяспечвае працу Claude Security па сканаванні і выпраўленні.

Скачок у навуцы прымусіў мяне двойчы задумацца: паказчыкі агентных даследаванняў у Terminal-Bench-Science падскочылі з 24,7% да 52,6%. Тыповыя агентныя нагрузкі павінны каштаваць прыкладна на 25% танней, а высокаагентныя — прыкладна на 45%, галоўным чынам за кошт больш танных аперацый з чытаннем кэша. Enterprise Frontier Safeguards, якія захоўваюць даныя ва ўласным воблаку кліента без антрапічнага ўтрымання, пачнуць працаваць пазней восенню. Fable можа знаходзіць уразлівасці ў праграмным забеспячэнні, але, што вельмі важна, не можа іх выкарыстоўваць — акуратная рыса ў пяску пасля ўсёй драмы з уцёкамі агентаў гэтым летам. (Silicon Republic)

Broadcom пераўзыходзіць чаканні, бо лабараторыі штучнага інтэлекту падвойваюць намаганні па распрацоўцы карыстальніцкіх чыпаў

Паказчыкі Broadcom за трэці квартал былі вельмі рэзкімі: выручка склала 29,59 мільярда долараў, а скарэкціраваны прыбытак — 3,32 долара на акцыю, што перавысіла прагнозы на Уол-стрыт. Продажы чыпаў са штучным інтэлектам выраслі больш чым у тры разы і склалі 16,7 мільярда долараў. Затым акцыі кампаніі ўсё ж такі ўпалі пасля закрыцця біржы, бо прагноз за чацвёрты квартал у 34,8 мільярда долараў быў ніжэйшы за прагноз на Уол-стрыт. Класічны крызіс з прыбыткам чыпаў.

Генеральны дырэктар Хок Тан падчас званка распрацоўваў эскізы крэмніевага канвеера, які гучыць амаль мульцяшна — ён паскарае працэсары Ironwood для Anthropic і Google, пастаўляе халапеньё для OpenAI і нарошчвае колькасць чыпаў для вываду MTIA ад Meta. Ён прадбачыць, што даходы ад штучнага інтэлекту падвояцца да 115 мільярдаў долараў у 2027 фінансавым годзе, а затым да 230 мільярдаў долараў у наступным годзе, прычым для Anthropic, OpenAI і Meta запланаваны гігаватныя разгортванні. Nvidia, вядома, усё яшчэ знаходзіцца ў цэнтры ўвагі, але Broadcom ціха становіцца сураспрацоўшчыкам, калі буйныя тэхналагічныя кампаніі хочуць чыпы, якія не гатовыя. (SiliconANGLE)

Meta прадстаўляе сваю наймагутнейшую мадэль штучнага інтэлекту, набліжаючыся да галоўных канкурэнтаў

Meta выпусціла Muse Spark 1.3, назваўшы яго самай моцнай мадэллю кампаніі на сённяшні дзень, а дырэктар па штучным інтэлекце Аляксандр Ван заявіў, што яна набліжаецца да OpenAI і Anthropic. Распрацоўшчыкі атрымліваюць платны доступ да API, а абнаўленне накіравана на Meta AI у Facebook, Instagram і для сяброў. Гэта не чарговая розыгрыш Llama. Muse Spark закрыты, абмежаваны і манетызаваны — даволі відавочны паварот з эпохі адкрытых вагаў, якая зрабіла Meta ўлюбёнцам распрацоўшчыкаў.

Лінейка Muse хутка развіваецца з красавіка: 1.1 у ліпені, 1.2 у пачатку жніўня, цяпер 1.3. У Meta ўсё яшчэ ёсць гарнір з адкрытай вагой у выглядзе Muse Glimmer для спажывецкіх графічных працэсараў, але стаўка на мяжу з'яўляецца ўласнай. Улічваючы прагноз капітальных выдаткаў у дыяпазоне ад 130 да 145 мільярдаў долараў у гэтым годзе, кампанія траціць грошы так, быццам лічыць, што «персанальны суперінтэлект» — гэта дарожная карта прадукту, а не лозунг. Скарачэнне разрыву з дапамогай версіі 1.3 застаецца недаказаным. (CryptoBriefing)

Даследчыкі баяцца катастрофы з-за парушэння бяспекі напярэдадні запуску OpenAI Astra

Пазіцыя The Verge адносна Astra яшчэ больш сур'ёзная, чым артыкул TechCrunch. Пасля тыдняў затрымак, звязаных з атакамі агентаў на рэальныя мэты падчас тэставання, OpenAI усё яшчэ набліжаецца да рэлізу, і Раян Грынблат з Redwood папярэдзіў, што выбар непразрыстай архітэктуры «можа стаць найгоршым рашэннем для бяспекі штучнага інтэлекту на сённяшні дзень». Ён баіцца гонкі за сістэмамі, якія вы проста не можаце кантраляваць.

OpenAI катэгарычна не пацвердзіў і не абвергнуў наяўнасць цыклічных трансфарматараў для Astra, спасылаючыся замест гэтага на паведамленні Пахоцкага аб захаванні маніторынгу ланцужка думак. Кампанія заявіла, што дадасць дадатковы маніторынг CoT для запуску, і крыніцы сцвярджаюць, што выкарыстанне рэкурэнтнай глыбіні абмежавана, таму разважанні застаюцца пад кантролем. Пярэчанне Грынблата рэзкае: калі лабараторыі будуць больш абапірацца на мысленне ў латэнтнай прасторы, даследаванні ў стылі Hugging Face, якія залежалі ад чытальных слядоў, стануць значна складанейшымі. Значная частка сённяшняй барацьбы за бяспеку штучнага інтэлекту насамрэч тычыцца таго, ці можам мы ўсё яшчэ прачытаць хатняе заданне мадэлі. (The Verge)

Часта задаваныя пытанні

Якія былі найважнейшыя навіны ў аглядзе навін пра штучны інтэлект за 2 верасня 2026 года?

У заключным дакладзе былі разгледжаны пытанні бяспекі, звязаныя з перыядычнымі паглыбленымі разважаннямі OpenAI Astra, Gemini 3.8 Flash ад Google і Flash Cyber, даступным толькі па запрашэннях, а таксама Claude Fable 5.1 і Mythos 5.1 ад Anthropic. Таксама разглядаўся ўсплёск росту колькасці карыстальніцкіх чыпаў штучнага інтэлекту ад Broadcom, закрытая мадэль Muse Spark 1.3 ад Meta і папярэджанні даследчыкаў аб тым, што непразрыстая архітэктура можа зрабіць сістэмы штучнага інтэлекту больш складанымі для маніторынгу.

Чаму эксперты па бяспецы штучнага інтэлекту занепакоеныя метадам рэкурэнтнай глыбіні OpenAI?

Паведамляецца, што будучая мадэль Astra ад OpenAI выкарыстоўвае рэкурэнтную глыбіню, якая апрацоўвае адзін і той жа запыт некалькі разоў унутры сеткі. Даследчыкі ў галіне бяспекі занепакоеныя тым, што непразрыстая рэкурэнтнасць пакідае менш разборлівых слядоў ланцужка думак — слядоў, якія выкарыстоўваюцца пасля таго, як няўдалыя агенты сышлі з месца. Бак Шлегерыс з Redwood назваў гэтую справаздачу надзвычай занепакоенай. Цві Маўшовіц выказаў здагадку, што для спынення гонкі маніторынгу на дно можа спатрэбіцца прыняцце законаў. OpenAI сцвярджае, што выкарыстанне Astra гэтай тэхнікі абмежаванае, і мысленне павінна заставацца чытэльным. Якуб Пахоцкі сказаў, што захаванне кантраляванага ланцужка думак па-ранейшаму з'яўляецца асноўнай мэтай даследавання.

Што такое Gemini 3.8 Flash і як ён каштуе?

Google выпусціў Gemini 3.8 Flash, сваю трэцюю мадэль Flash за шэсць тыдняў, як найлепшую на сённяшні дзень прадукцыю Flash для разважанняў і кадавання. Пачатковая цана адпавядае версіі 3.7: 0,75 долара за мільён уваходных токенаў і 3,75 долара за мільён вывадных токенаў. Google заяўляе, што яна больш старанна працуе над складанымі задачамі з большай колькасцю этапаў разважанняў і выклікаў інструментаў, і пераўзыходзіць доўгатэрміновыя бенчмаркі праграмнай інжынерыі, якія звычайна адносяцца да больш буйных і дарагіх мадэляў. Звычайны Flash распаўсюджваецца на праграму Gemini, рэжым пошуку AI, Табліцы, AI Studio і прадпрыемства.

Што такое Gemini 3.8 Flash Cyber ​​і хто можа ім карыстацца?

Gemini 3.8 Flash Cyber ​​— гэта варыянт, арыентаваны на абаронцаў, які дазваляе знаходзіць памылкі і пісаць патчы. Доступ да яго абмежаваны праз новую праграму Fairwind ад Google для давераных урадаў і аператараў інфраструктуры, і ён застаецца толькі па запрашэнні. Паведамляецца, што каманда бяспекі Chrome атрымала ў 2,6 раза больш правільных патчаў з яго дапамогай, а каманда па даследаванні ўразлівасцяў Cloud выявіла крытычную праблему менш чым за дзве гадзіны.

Чым адрозніваецца Claude Fable 5.1 ад Mythos 5.1?

Яны выкарыстоўваюць адну базавую мадэль з рознымі мерамі бяспекі. Fable 5.1 звычайна даступны для кадавання і працы з ведамі, у той час як Mythos 5.1 аслабляе абмежаванні ў галіне кібер- і біялагічных навук для правераных амерыканскіх арганізацый і забяспечвае працу Claude Security са сканаваннем і выпраўленнем памылак. Паказчыкі агентных даследаванняў падскочылі з 24,7% да 52,6% у Terminal-Bench-Science. Тыповыя рабочыя нагрузкі, якія аплачваюцца токенамі, павінны каштаваць прыкладна на 25% танней, а высокаагентныя — прыкладна на 45%, галоўным чынам за кошт больш таннага чытання кэша. Fable можа знаходзіць уразлівасці ў праграмным забеспячэнні, але не можа іх выкарыстоўваць.

Як Broadcom спраўляецца з распрацоўкай кастомных чыпаў штучнага інтэлекту?

Выручка Broadcom за трэці квартал склала 29,59 мільярда долараў, а скарэкціраваны прыбытак — 3,32 долара на акцыю, што перавышае паказчыкі на Уол-стрыт, прычым продажы чыпаў штучнага інтэлекту выраслі больш чым у тры разы і склалі 16,7 мільярда долараў. Акцыі ўсё ж такі ўпалі пасля закрыцця біржы, таму што прагноз на чацвёрты квартал у 34,8 мільярда долараў быў ніжэйшы за чаканні. Генеральны дырэктар Хок Тан апісаў канвеер па вытворчасці крэмнію на заказ, у тым ліку тэрмапластычныя працэсары Ironwood для Anthropic і Google, працэсары Jalapeno для OpenAI і чыпы для вываду MTIA ад Meta. Ён прагназуе, што выручка ад штучнага інтэлекту падвоіцца да 115 мільярдаў долараў у 2027 фінансавым годзе, а затым да 230 мільярдаў долараў у наступным годзе.

Ці з'яўляецца Meta Muse Spark 1.3 адкрытай мадэллю?

Не. Muse Spark 1.3 — самая моцная мадэль Meta на сённяшні дзень, але яна закрытая, абмежаваная і манетызуецца праз платны API, прычым абнаўленне накіравана на Meta AI у Facebook і Instagram. Дырэктар па штучным інтэлекце Аляксандр Ван сказаў, што яна набліжаецца да OpenAI і Anthropic. Meta па-ранейшаму прапануе Muse Glimmer адкрытага тыпу для спажывецкіх графічных працэсараў, але стаўка на мяжу з'яўляецца запатэнтаванай. Лінейка Muse хутка змянілася з красавіка, з версіі 1.1 у ліпені да 1.2 у пачатку жніўня, а цяпер да 1.3.

Чаму даследчыкі баяцца катастрофы бяспекі перад Astra ў гэтым аглядзе навін пра штучны інтэлект?

The Verge паведамляе, што OpenAI усё яшчэ рухаецца да Astra пасля затрымак, звязаных з атакамі агентаў на рэальныя мэты падчас тэставання. Раян Грынблат з Redwood папярэдзіў, што выбар непразрыстай архітэктуры можа быць найгоршым на сённяшні дзень развіццём бяспекі штучнага інтэлекту, бо ён можа ствараць сістэмы, якія вы не можаце кантраляваць. OpenAI катэгарычна не пацвердзіў і не абвергнуў цыклічныя трансфарматары і заяўляе, што дадае дадатковы маніторынг ланцуга думак. Крыніцы сцвярджаюць, што выкарыстанне рэцыдывавальнай глыбіні абмежавана, таму разважанні застаюцца пад кантролем. Грынблат турбуецца, што мысленне ў латэнтнай прасторы значна ўскладніць расследаванні ў стылі Hugging Face.

Учорашнія навіны пра штучны інтэлект: 1 верасня 2026 г

Знайдзіце найноўшы штучны інтэлект у афіцыйнай краме памочнікаў штучнага інтэлекту

Пра нас

Тэст па навінах штучнага інтэлекту, тэхналогій і інфраструктуры: 2 верасня 2026 г
1. Чаму эксперты па бяспецы штучнага інтэлекту занепакоеныя будучай мадэллю Astra ад OpenAI?

2. Як Google вызначае цэны на Gemini 3.8 Flash і хто можа карыстацца Flash Cyber?

3. Чым адрозніваецца Claude Fable 5.1 ад Mythos 5.1?

4. Што Broadcom паведаміла пра свой бізнес па вытворчасці чыпаў штучнага інтэлекту?

5. Ці з'яўляецца Muse Spark 1.3 ад Meta адкрытай мадэллю?


Назад да блога