DeepSeek прискорює запуск нової моделі штучного інтелекту

2 хвилин читання

Китайський ШІ-стартап DeepSeek, що в січні обвалив акції техгігантів, готується до прискореного запуску нової моделі штучного інтелекту R2, повідомляє Reuters. 

DeepSeek прискорює запуск нової моделі штучного інтелекту. Фото: Reuters

Чого і коли очікувати від нової моделі DeepSeek?

Підписуйтеся на наші соцмережі

Спочатку планувалося, що R2 вийде на початку травня, але DeepSeek намагається випередити графік, щоб закріпити конкурентну перевагу на тлі успіху попередньої моделі R1. Очікується, що нова модель забезпечить покращене кодування та здатність міркувати різними мовами, що стане важливим кроком у розвитку штучного інтелекту.

Читайте також: Засновник DeepSeek Лян Веньфенг подвоїв статки за півроку і став найбагатшим творцем ШІ у світі. Він обігнав співзасновника Anthropic Даріо Амодея та Грега Брокмана з OpenAI, пише Bloomberg. 

Низька вартість ціною в конфіденційність

DeepSeek використовує економічно ефективні архітектури штучного інтелекту, такі як Mixture-of-Experts (MoE) та multihead latent attention (MLA). Це дозволяє компанії створювати високопродуктивні моделі за низькою вартістю.

Однак штучний інтелект, що походить з комуністичного Китаю викликає чимало запитань про безпеку даних. Китайський уряд підтримує DeepSeek, але також закликає до стриманості у взаємодії зі ЗМІ. Деякі країни, такі як Південна Корея та Італія, вилучають DeepSeek з магазинів застосунків через проблеми конфіденційності.