DeepSeek прискорює запуск нової моделі штучного інтелекту

2 хвилин читання

Китайський ШІ-стартап DeepSeek, що в січні обвалив акції техгігантів, готується до прискореного запуску нової моделі штучного інтелекту R2, повідомляє Reuters. 

DeepSeek прискорює запуск нової моделі штучного інтелекту. Фото: Reuters

Чого і коли очікувати від нової моделі DeepSeek?

Підписуйтеся на наші соцмережі

Спочатку планувалося, що R2 вийде на початку травня, але DeepSeek намагається випередити графік, щоб закріпити конкурентну перевагу на тлі успіху попередньої моделі R1. Очікується, що нова модель забезпечить покращене кодування та здатність міркувати різними мовами, що стане важливим кроком у розвитку штучного інтелекту.

Читайте також: Світовий AI-ринок одночасно рухається у трьох напрямках: компанії нарощують обчислювальні потужності, китайські розробники виходять на біржу, а ризики автономних AI-агентів змушують індустрію знову говорити про безпеку.

Низька вартість ціною в конфіденційність

DeepSeek використовує економічно ефективні архітектури штучного інтелекту, такі як Mixture-of-Experts (MoE) та multihead latent attention (MLA). Це дозволяє компанії створювати високопродуктивні моделі за низькою вартістю.

Однак штучний інтелект, що походить з комуністичного Китаю викликає чимало запитань про безпеку даних. Китайський уряд підтримує DeepSeek, але також закликає до стриманості у взаємодії зі ЗМІ. Деякі країни, такі як Південна Корея та Італія, вилучають DeepSeek з магазинів застосунків через проблеми конфіденційності.