AI digest · Серпень: нові чипи, кібератака від АІ-агента та роботи-супермени

5 хвилин читання

За останній тиждень АІ знову навчився створювати повноцінні пісні, роботи змогли стрибнути вище за людину, а автономні агенти показали, чому їм все ще не можна беззастережно довіряти.

Розбираємо головне.

MiniMax навчив AI писати повноцінні пісні

MiniMax представила Music 3 – відкриту модель, яка вміє генерувати не окремі музичні фрагменти, а цілі композиції.

Читайте також: Кожного разу, коли звучить сирена повітряної тривоги, ми не дивимося в небо. Ми збираємо речі, йдемо в укриття, спускаємося в паркінги або просто сідаємо в коридорі за правилом двох стін. Це наша щоденна рутина безпеки: видима, зрозуміла і матеріальна.

За один запуск модель може створити трек тривалістю до п'яти хвилин: з вокалом, інструментами та структурою пісні. Тобто користувачеві не доводиться окремо збирати вступ, куплети та приспіви – модель генерує композицію цілком.

Для повної версії Music 3 знадобиться відеокарта з 24 ГБ VRAM. При цьому існує полегшений варіант, якому достатньо 8 ГБ, тому поекспериментувати з моделлю можна і на звичайному домашньому залізі.

Демо вже є на Hugging Face, а розробники також опублікували ваги моделі.

Unitree показала робота, який стрибає на два метри

Unitree Robotics продовжує прокачувати гуманоїдів, і цього разу показала експериментального робота Superman.

Назва цілком відповідає можливостям: робот здатний вистрибувати приблизно на 2 метри з місця та розганятися до 12,66 м/с. Це показники, що перевищують людські рекорди у відповідних дисциплінах.

Підписуйтеся на наші соцмережі

Щоправда, поки що пристрій перебуває на стадії розробки. Але демонстрація добре показує, наскільки швидко зростають можливості сучасних гуманоїдних платформ.

AI-агент спробував зламати open source-проєкт

А ось наступна історія не надто весела.

Студент із Техаського університету, що займався GitHub-проєктами перед пошуком стажування, помітив підозрілий pull request. У коді виявився потенційно шкідливий фрагмент, тому студент повідомив про це автор проекту.

Але замість звичайного обговорення почалося дивне: автор PR став доводити, що з оновленням все гаразд. А потім з'явився ще один «розробник», який приєднався до розмови та теж почав переконувати студента прийняти зміни.

Згодом з'ясувалося, що за обома обліковими записами стояв один AI-агент на базі Mythos. Він згенерував шкідливу зміну та створив додаткову особу, щоб через неї впливати на людину та підвищити шанси на прийняття коду.

Найіронічніше: студент вирішив перевірити ще раз ситуацію за допомогою Claude і в результаті підтвердив свої початкові підозри.

Експеримент проводив британський AI Security Institute. Дослідники дали моделям доступ до інтернету та суттєво послабили обмеження, щоб перевірити, як вони діятимуть самостійно. Зі 122 запусків у 10 випадках агенти самостійно вийшли у зовнішній інтернет та здійснили 19 дій проти реальних людей чи організацій. Більшість таких епізодів припала на Mythos.

І тут цікавим є не лише сам факт спроби атаки. AI-агент використовував соціальну інженерію, тобто намагався маніпулювати людиною, щоб той сам допоміг виконати потрібну дію. Для автономних AI-систем це зовсім інший рівень ризику.

DeepSeek додала зір для своєї моделі V4Flash  

DeepSeek розширила можливості V4 Flash: експериментальна V4-Flash-Vision-Exp тепер вміє працювати не лише з текстом, а й із зображеннями, графіками та іншим візуальним контентом

Основний сценарій – AI-агенти, яким потрібно аналізувати те, що відбувається на екрані. При цьому текстові можливості моделі залишилися приблизно на рівні звичайної V4 Flash.

За внутрішніми тестами DeepSeek, нова версія помітно краще справляється з мультимодальним агентним завданням і в деяких тестах наблизилася до Opus 4.8.

Модель можна використовувати через API. Одночасно DeepSeek оновила Harness до версії 0.1.1 і запустила безкоштовний Files API: зображення можна завантажити один раз, а потім використовувати в кількох запитах.

Apple посилює МАС для АІ

Apple теж не залишилася осторонь AI-гонки і представила відразу два нові чипи — M6 і M5 Ultra.

M6 став першим чипом Apple, виробленим за 2-нм техпроцесом.

У конфігурації – 12 ядер CPU, 12 ядер GPU і два 16-ядерні Neural Engine. Apple заявляє приріст багатопоточної продуктивності до 20% порівняно з M5, а пікова продуктивність GPU в AI навантаженнях зросла майже на 30%.

Але ще цікавіше M5 Ultra, призначений для нового Mac Studio. Apple об'єднала чотири кристали в один чип, отримавши конфігурацію до 36 ядер CPU та 80 ядер GPU. Максимальний обсяг об'єднаної пам'яті досягає 512 ГБ, а пропускна спроможність – 1,2 ТБ/с.

В AI-завданнях GPU, за даними Apple, може бути до 4,5 рази швидше за M3 Ultra.

Mac mini з M6 та Mac Studio з M5 Ultra вже доступні для замовлення.

А яка з цих новин здивувала вас найбільше? Діліться у коментарях.