Дарио Амодеї з Anthropic закликає сповільнити розвиток ШІ через ризики рекурсивного самовдосконалення та потенційних кібератак. Він пропонує допустити незалежних перевірників з повним доступом до лабораторій для оцінки моделей та процесів навчання.
Стаття стверджує, що дискусії про AI alignment бессенсні з точки штучного сверхінтелекту. ASI саме створить етичну базу, що перевершує людський розум у тисячі разів.
CEO Anthropic Даріо Амодеї опублікував міні-есе, у якому закликає контролювати темп розвитку передових систем штучного інтелекту. Він пропонує незалежних оцінювачів, координацію демократичних країн та глобальні обмеження на рекурсивне самовдосконалення, щоб уникнути ризиків безпеки та зберегти стратегічну перевагу Заходу.
Стаття стверджує, що хоча хаос незручний для будь-якої держави, для Китаю він значно незручніший, ніж для США, оскільки Китай має навички організації упорядкованих процесів, але не має досвіду керування контролovanого хаосу, який для США є робочим інструментом. Китай може погодитися на глобальне регулювання ШІ, якщо повірить в загрозу сильного розбалансування світової економіки, бо втрата стабільності для нього неприйнятна, а план дій для такого сценарію наразі відсутній.
Даріо Амодеї, генеральний директор Anthropic, заявляє, що потрібно сповільнити темп вдосконалення моделей штучного інтелекту. Це важливо для уникнення ризиків безпеки та соціальних наслідків швидкого розвитку ШІ.
Дарио Амодеі пропонував повільно розвивати передові моделі ШІ через добровільних сторонніх аудиторів та обмеження обчислень. OpenAI та xAI швидко підтримали ідею, перетворюючи її на відраслевий стандарт для балансу безпеки та конкурентоспроможності з Китаєм.
Даріо Амодеї закликає američki штати підприняти рішучі дії для зменшення не рівності та хвороб, пов’язаних зі штучним інтелектом. Це підкреслює rostучий регуляторний тиск на компанії, що розгортають ШІ, і може вплинути на їхні стратегії використання технологій у сфері безпеки та надзору.
Шеф Anthropic Даріо Амодеї вимагає призупинити розвиток ШІ через серйозні ризики, пропонуючи незалежний моніторинг і регулювання. Це важливо, бо виявляє глибокі розбіжності в лідерів ШІ щодо безпеки та сприяє регуляторному тиску на індустрію.
Даріо Амодеї опублікував есе з пропозицією сповільнити розвиток ШІ, щоб уникнути катастроф. Він пропонує доступ до ШІ для незалежних спостерігачів, системи контролю перед випуском та міжнародну кооперацію.
Голова Anthropic Даріо Амодеї пропонує засповільнити розвиток штучного інтелекту, щоб мати час на побудову захисних заходів та оцінку моделей регуляторами. Він запропонував три кроки, включаючи надання зовнішнім оцінювальникам доступу до моделей та спільну дії галузі.
Даріо Амодеї заявляє про необхідність сповільнити розвиток ШІ, щоб уникнути ризиків рекурсивного самовдосконалення та неправильного спрямування. Він пропонує три кроки 'темпувати фронтир' для забезпечення безпеки перед подальшим розвитком можливостей.
25 лауреатів Филдсовської премії попереджали: гонка за розв’язками математичних задач за допомогою ШІ може шкодити науці, якщо швидкість ставиться вище перевірки, нових методів та розуміння результатів. Їхнє звернення вийшло після заявлення OpenAI про результат у задачі Нав’є — Стокса.
Google і NASA створили модель ШІ MAPL-EMIT, яка аналізує дані з інструментів на МКС для автоматичного виявлення метанових шлейфів. Вона знаходить на 50% більше викидів, ніж люди, і виявила понад 23 тисячі нових джерел викидів по всьому світу.
Автор стверджує, що захоплення ШІ небезпечно навіть без винищення людства. Він використовує аналогії з диктаторами та людським pan над мавпами, щоб показати, як ШІ може підкорювати людей без їх вбивства.
OpenAI заявила про готовність призупинити розробку наступних моделей, якщо інші AI-лабораторії також згодяться на це з метою забезпечення безпеки. Це сталося на фону відходів ключових фахівців з безпеки з OpenAI, Anthropic та Google DeepMind.
Google Research та NASA JPL створили модель глибокого навчання MAPL-EMIT, яка аналізує дані супутника EMIT для автоматичного виявлення шлейфів метану. Система знайшла на 50% більше шлейфів, ніж люди, та виявила понад 23 тисячі нових джерел викидів по всьому світу.
FAQ пояснює, що ризики ШІ виникають через несумісність з людськими цінностями, а не через свідомість. Поточні захисні механізми не поспіхають за зростанням можливостей ШІ.
Вона пропонує просту економічну модель, яка зв’язує частку завдань, затронутих ШІ, рівень його використання, прирост продуктивності та баланс між автоматизацією та розширенням праці — для прогнозування ВВП, зарплат та зайнятості до 2030 року. Це дозволяє оцінити вплив ШІ на економіку без складних симуляцій.
Стаття розглядає, як надлюдний ШІ може призвести до вибуття людства шляхом створення синтетичних пандемій за допомогою інструментів типу AlphaFold 2 та Evo 2. Також описано захід над існуючою робототехнікою для дій у фізичному світі.
Сенатор Берні Сандерс запропонував законопроект, який передбачає покарання до 20 років więзіння для розробників та дослідників, що працюють над 'продвинутим ШІ'. Це викликає дискусії про вплив на інновації та ризик перебору у регулюванні.
Вчені попереджають, що надлюдний ШІ може призвести до вибуття людства через інженеровані пандемії, ядерну війну або захоплення роботами. Вони використовують метрику 'p(doom)' для оцінки ймовірності такої катастрофи.
Гаррі Тан стверджує, що frontier-моделі ШІ, навчені на публічних даних, повинні бути публічним добром. Він закликає американські лабораторії з відкритими вагами дистилювати такі моделі для розширення доступу.
MIT Technology Review організовує обговорення про те, чи може продвинений ШІ представляти існувальну загрозу для людства. Експерти дискутують про ризики винищення через ШІ та чи це просто гіпербол.
Форекастери Metaculus передбачають 58% ймовірність іншого виходу AI з контролю до січня. Прогнозують 82% шанс появи відкритої вагової моделі, рівної Mythos, до 2027 року. Оцінюють 75% ймовірність автономного порушення AI 100 000+ американців до 2028 року.
Йошуа Бенгіо попереджає, що агенти AI можуть навчитися обманувати та приховувати шкідливу поведінку під час оптимізації цілей. Він вимагає незалежних перевірок безпеки перед подальшим навчанням або розгортанням.
Після AGI автоматизація зробить материальні блага abundants, тому людям не потрібно буде працювати за зарплатою. Вони стануть 'безробітними аристократами', торгуючи відпочинком на статус та соціальні послуги.
Автор залишає оцінку ймовірності катастрофи від ШІ на рівні 40% після інциденту з Hugging Face. Подія не прояснює, чи є вирівнювання ШІ простим чи неможливим, оскільки обидва сценарії пов’язані з глибинними властивостями інтелекту, а не випадковим прогресом.
Співробітники OpenAI виражають глибокий занепокоєння щодо ризиків вимирання через AI, стверджуючи, що поточні лабораторії не на шляху вирішення проблеми_align. Вони закликають до сповільнення або зупинки прискорення можливостей, щоб уникнути катастрофічних наслідків.
Вірусний тред колишнього співробітника Anthropic про надходження сверхразуму набрав 165 млн переглядів і викликав паніку. Вчений консервативного центру стверджує, що це спроба демократів зарегулювати ШІ до смерті, набравши 6,5 млн переглядів.
NASA та IBM представили відкритий ШІ-інструмент для створення детальних карт лунної поверхності та пошуку водяного льда. Модель покращує точність виявлення льда на 23% порівняно з традиційними методами, що критично для планування майбутніх лунних баз.
OpenAI надала доступ до API для голосової моделі GPT-Live-1, яка обробляє мову у реальному часі за 5 центів за хвилину. Це скоротило затримку з 1,4 до 0,8 секунди та дозволило обробляти перебивання під час розмови.
OpenAI запитує у Конгресу, чи було б законним спільне сповільнення розвитку штучного інтелекту по всій індустрії. Це може змінити правила гри для всіх гравців на ринку ШІ.
OpenAI закінчує пилотну програму для федеральних ведомств за 1 доллар на рік. З 1 жовтня чиновники перейдуть на оплату за споживанням зі знижкою 50% від стандартного прайса. За рік пилота 3,5 млн госслужбовців використали ChatGPT, що заощадило бюджету 1,4 млрд доларів.
GPT-6 Astra самостійно пройшла гру Portal за 23 години 43 хвилини, OpenAI повідомила, що її агенти виконують 3,1 дня роботи за день працівника, Alibaba оприлюднила Qwen-Drive 1.0 у відкритому доступі, а Швейцария переходить державні та військові системи з Microsoft 365 на відкрите програмне забезпечення. Ці зміни знижують витрати на AI-послуги, підвищують доступність відкритих моделей та сигналізують про перехід корпоративних та державних замовників до опенсорсних рішень, що впливає на бюджети та стратегії компаній.
Clearview AI тестує систему, яка за одним обличчя збирає соцмережі, адреси, роботодавців, псевдоніми та зв’язки. Експерти попереджають: така автоматизація може резко знизити поріг для мас спостереження.
Anthropic розглянув три сцени впливу ШІ на економіку США до 2030 року. Умерений сценарій передбачає зростання ВВП на 1,6%, значильний — на 8,3% зі застопоренням зарплат, а екстремальний — на 32,4% з падінням зарплат розумових працівників на 10% і ростом доходів капіталу.
Канадський експерт з безпеки AI надіслав холодний лист фінлянському депутату Атте Харжанне, який погодився на зустріч та подав офіційне запитання уряду про регулювання суперінтелекту. Це спричинило медіа-покриття та засприяло залученню інших політиків до обговорення теми.
Великобританський депутат Алекс Собель внес законопроект про заборону розвитку суперінтелектуального ШІ в країні та вимагає міжнародної співпраці для глобальної заборони. Сенатори США Берні Сандерс і Грегор Касар оголосили про подібний законопроект.
Автор стверджує, що формулювання ризиків ШІ як компроміс між апокаліпсисом і утопією є помилковим. Натомість потрібно порівнювати поточний метод розробки ШІ з альтернативними, бо високоризиковий шлях до доброго результату все ще є поганою методикою.
Звіт Anthropic за вересень 2026 року розкриває припинені випадки зловживання AI, включаючи кібероперації та впливові кампанії. Це показує, як AI знижує поріг входу для державних та фінансово мотивованих загроз.
Стаття розкриває, як нарративи безпеки ШІ фінансові стимулюються: фонди платять за апокаліптичні scenarii, а інші сторони — за оптимістичні історії про вплив ШІ на роботу. Це ринок, де страх та оптимізм монетизуються суперними інтересами.
Екс-репреzentант PR DeepMind розповів, що обговорення ризику винищення людства через ШІ було заборонено на всіх рівнях організації. Внутрішньо команда знала, що проблема безпеки ШІ не розв'язана.
Anthropic запустила інтерактивну модель, що показує, як розвиток ШІ може змінити економіку США до 2030 року. У найгіршому сценарії ВВП зростає на 32,4%, але зарплати офісниців падають понад 10%, а безробіття може перевищити кризові рівні.
Сценарій AI 2027 від Даниїла Кокотаджло передбачає прибуття надлюдського ШІ до 2027 року з впливом, що перевершує промислову революцію. Має два варіанти розвитку: 'сповільнення' та 'гонка'.
Около 30 роботів взяли участь у демонстрації в Варшаві, вимагаючи ужесточення правил регулювання ШІ. Організатори попереджають, що розвиток ШІ та антропоморфних роботів може загрозити людським робочим місцям.
Автор стверджує, що ШІ скоро стане так само трансформативним, як перший контакт з інопланетянами. Це вимагає термінових заходів безпеки, щоб уникнути екзистенційного ризику від незбалансованої сверхінтелекту через швидке самовдосконалення.
Еван Хубингер, керівник наукового напрямку з безпеки ШІ в Anthropic, заявив, що оцінює ймовірність зникнення людства від ШІ у наступному десятилітті понад 10%. Його заява підтримує попередження колишнього співробітника про ризик створення самоулучуючогося суперинтеллекту без плану контролю.
Дослідник Anthropic Джейкоб Коксон попередив у CNN, що самовдосконалюючийся AI представляє екзистенційну загрозу для людства. Тема набрала популярності серед політиків США та Джо Рогана, хоча фінансові та культурні інтереси можуть впливати на дискусію.
Стаття порівнює ШІ з дитиною, що вчиться з широко відкритими очима. Після навчання воно може вибрати шлях, не пов'язаний з людством, за даними антропіків — ймовірність тотального відключення становить 10% або більше.