Достижения Китая в области искусственного интеллекта

Сегодня во многих странах мира приоритетное направление развития информационных технологий отводится разработкам в области искусственного интеллекта (ИИ). Среди главных конкурирующих за лидерство в этой сфере стран все больший вес набирает Китай, превосходя по некоторым показателям бесспорного фаворита рынка Соединенные Штаты Америки.

В 2017 году Госсовет Китайской Народной Республики (КНР) обнародовал «План развития искусственного интеллекта нового поколения» (Next Generation Artificial Intelligence Development Plan, State Council Document (2017) No.35). Руководство КНР поставило перед страной амбициозную стратегическую цель – к 2030 году стать мировым лидером в области искусственного интеллекта.

В Плане обозначены три периода:

  • Первый этап (до 2020 года) заключался в синхронизации всех технологий и выходе Китая на международный уровень применения ИИ. Он вобрал в себя проведение фундаментальных исследований, создание стандартов и внедрение технологий ИИ, системы обслуживания, производственной цепочки, а также оптимизацию среды разработки ИИ-проектов, норм этики и права в отношении искусственного интеллекта.
  • Второй этап (до 2025 года) подразумевал достижение крупного прорыва в применении ИИ в стране, а также продвижение некоторых китайских технологий на мировой уровень. К этому времени индустрия ИИ вошла в глобальную цепочку создания стоимости, в основном разработаны и приняты законодательные акты, нормы этики, политики и права в области ИИ, а также сформированы критерии оценки и контроля безопасности ИИ-технологий.
  • Третий этап (до 2030 года) предполагает выход Китая на позицию мирового лидера и инновационного центра ИИ-разработок. Предполагается, что в этом периоде будут значительно расширены масштабы и глубина применения ИИ в производстве, повседневной жизни, социальном управлении и национальной обороне, усовершенствованы разработанные ранее стандарты, а Китай станет местом притяжения высококлассных специалистов в данной области.

Государственный совет составил список «национальных команд по искусственному интеллекту», в который вошли 15 китайских компаний, в том числе Baidu, Tencent, Alibaba, SenseTime и iFlytek. Каждое предприятие должно возглавлять развитие специализированного сектора искусственного интеллекта в Китае. Например, распознавание речи и лиц, программное / аппаратное обеспечение. Быстрое развитие искусственного интеллекта в стране оказало значительное влияние на китайское общество во многих сферах, включая социально-экономическую, военную и политическую.

Достижения Китая в области искусственного интеллекта, image #1

Законодательная база

В ноябре 2022 года Управление по киберпространству Китая (Cyberspace Administration of China, CAC), Министерство промышленности и информационных технологий (Ministry of Industry and Information Technology, MIIT) и Министерство общественной безопасности (Ministry of Public Security, MPS) совместно выпустили правила, касающиеся дипфейков (Regulations Concerning Deepfakes), которые вступили в силу в январе 2023 года.

В июле 2023 года Китай опубликовал временные меры по управлению сервисами генеративного ИИ. В октябре того же года был опубликован проект основных требований к безопасности сервисов генеративного ИИ, включая спецификации для сбора данных и обучения моделей.

Кроме того, в октябре 2023 года правительство Китая запустило Глобальную инициативу управления ИИ (Global AI Governance Initiative), которая определяет политику в области искусственного интеллекта, как часть государственной концепции «Сообщества единой судьбы человечества» (Community of Common Destiny).

Она направлена на то, чтобы решать проблемы и использовать возможности искусственного интеллекта при одновременном продвижении международного сотрудничества и соблюдении общих принципов.

Основные положения инициативы:

  • Человекоцентрированный подход к развитию искусственного интеллекта. Подчёркивается важность развития технологий ИИ для улучшения качества жизни людей во всём мире.
  • Взаимное уважение и инклюзивность в развитии ИИ. Призывается к всеобщему признанию, равенству и выгоде среди стран, занимающихся развитием ИИ.
  • Повышение безопасности, надёжности и контроля ИИ. Предлагается создать комплексную систему тестирования и оценки на основе уровней риска ИИ.
  • Международное сотрудничество и помощь развивающимся странам. Это направлено на то, чтобы сократить разрыв в развитии и возможностях управления ИИ между государствами.

Инициатива структурирована вокруг трёх фундаментальных аспектов: развития, безопасности и управления ИИ.

В марте 2024 года правительство КНР приняло комплексную стратегию AI Plus для содействия инновационному развитию цифровой экономики.

Она направлена на углубление интеграции искусственного интеллекта и реальной экономики.

Для этого планируется:

  • стимулировать исследования и разработки в области практических приложений ИИ;
  • поощрять компании к внедрению решений ИИ посредством мотивации и инфраструктурной поддержки;
  • инвестировать в квалифицированных специалистов в области ИИ;
  • создавать надёжную инфраструктуру данных для содействия росту использования ИИ.

Особенности реализации ИИ в Китае

В 2018 году Государственный совет выделил 13,8 млрд юаней (около 2,1 млрд долларов США) на создание в районе Mentougou (Ментугу, западная окраина г. Пекин) промышленного парка искусственного интеллекта. Для достижения этой цели руководство страны заявило о необходимости привлечения большого количества специалистов, теоретических и практических разработок, а также государственных и частных инвестиций.

В 2019 году влияние искусственного интеллекта распространилось на такие области как квантовая физика, география и медицинские исследования. С появлением больших языковых моделей (Large Language Models, LLM) в начале 2020 года китайские исследователи начали разрабатывать собственные LLM. Например, разработанная китайской академией наук (Chinese Academy of Sciences) мультимодальная модель Zidongtaichu (может распознавать закономерности, делать прогнозы или предлагать решения) или выпущенная компанией Huawei версия 3.0 собственной LLM – Pangu (математическая система, обученная работать с естественным языком человека).

В настоящее время в КНР действует более 6,5 тыс. компаний в области ИИ (примерно 25% от общемирового показателя).

Китайские технологические гиганты, такие как Baidu, Tencent и Alibaba, уже выстроили свои схемы работы и сотрудничества с инвесторами. Талантливые программисты предпочитают работать с ведущими в области ИИ корпорациям поэтому молодым стартапам и небольшим компаниям сложно конкурировать с лидерами отрасли.

По ряду формальных показателей, таких как количество опубликованных научных работ и поданных заявок на патенты, Китай сумел не только сравняться с США, но даже вырваться в мировые лидеры.

В период с 2014 по 2024 год в КНР по теме ИИ было подано порядка 30 тыс. патентных заявок (что в 2,5 раза больше, чем в США), а объём научных статей по данной теме составил около 30% от мировых публикаций.

Недавно появившиеся в Китае компании-единороги – Zhipu AI, Moonshot AI, MiniMax и 01.AI – получили значительную поддержку от китайских инвесторов и борются за то, чтобы нанять лучших специалистов для разработки самых популярных продуктов на основе ИИ.

В 2024 году стоимость этих четырёх стартапов выросла с 1,2 до 2,5 млрд долларов США, что сделало их лидерами среди более чем 260 компаний, стремящихся повторить успех мировых лидеров, таких как Google, OpenAI и Meta (запрещена в РФ).

Следует отметить, что американские фирмы, работающие в сфере генеративного ИИ, опережают китайские по уровню технологического развития и общему объёму привлечённых средств. Однако, такие технологии, как ChatGPT, Character.ai и другие на основе ИИ недоступны в КНР. В связи с этим компании Китая конкурируют друг с другом за лидерство в области создания альтернативных ИИ-приложений. Так, по данным аналитической компании IT Juzi за первые четыре месяца 2022 года китайские стартапы в области генеративного ИИ привлекли в качестве инвестиций в общей сложности 14,3 млрд юаней (2 млрд долларов США).

В 2024 году правительством Китая одобрены более 40 программ развития LLM и связанных с ними ИИ-приложений для общественного использования, а также создана благоприятная нормативно-правовая среда, которая за счёт применения налоговых льгот и предоставления субсидий способствует развитию ИИ в стране.

Китайские компании, лидирующие в конкурентной борьбе за создание аналога ChatGPT:

Zhipu AI (Чжипу) создана на базе университета Цинхуа (Tsinghua University), который является одним из центров подготовки специалистов в области ИИ. По состоянию на март 2024 года оценивался в 18 млрд юаней (2,5 млрд долларов США).

Предприятие осуществляет разработку цифровых помощников с ИИ для корпоративных клиентов, включая банки, страховые группы и технологические компании. Например, ориентированный на копирайтеров (создатели текстов для решения маркетинговых и бизнес-задач) и программистов чат-бот Qingyan AI assistant создан на базе двуязычной китайско-английской диалоговой модели ChatGLM2-6B с открытым исходным кодом. Компьютерная система прошла предварительное обучение на триллионах символов текста и кода. В ней применяется технология контролируемой тонкой настройки для предоставления пользователям интеллектуальных услуг в виде универсального диалога.

Некоторые возможности Qingyan AI assistant:

  • Общение бота с человеком посредством преобразования текста и изображения в видеоформат (видеозвонок).
  • Помощь в повседневной жизни.
  • Использование в культурной и туристической индустрии.

Компания Moonshot AI в октябре 2023 года запустила ИИ-проект Kimi Chat, который работает на основе большой языковой модели, позволяющей обрабатывать и генерировать текстовые ответы, похожие на человеческие. Одной из его особенностей является способность обрабатывать довольно длинные тексты, поддерживая ввод до двух миллионов китайских символов, что значительно превосходит многих глобальных конкурентов.

В январе 2025 года стартап представил обновленный чат-бот Kimi AI (версия 1.5) одним из главных достоинств которого является его мультимодальность. Модель способна работать не только с текстом, а также с изображениями и программным кодом, открывая широкие возможности для аналитиков, разработчиков и исследователей. Нейросеть успешно справляется с обработкой юридических документов, научных статей, может анализировать код и предлагать оптимизированные решения для программирования.

Достижения Китая в области искусственного интеллекта, image #2

Отдельное внимание разработчики уделили контекстной обработке – выделению тематик и концепций в коллекции текстовых сообщений, что позволяет проводить анализ сообществ, из которых эти сообщения были взяты. Способность Kimi AI анализировать до 128 тыс. токенов позволяет ей без потери информации работать с книгами, длинными статьями и сложными математическими расчетами. В сочетании с интегрированным поиском модель предоставляет пользователям доступ к актуальной информации, формируя ответы с учётом данных из более чем 100 веб-источников.

Moonshot AI предоставляет бесплатный доступ к Kimi AI, что выделяет ее на фоне конкурентов, большинство из которых предлагают подобные возможности только в рамках подписки.

Чат-бот Moonshot Kimi является ближайшим конкурентом китайской поисковой системы Ernie Bot от Baidu.

В диалоговой системе Kimi AI пользовательский интерфейс и контекстуализация контента улучшены за счет применения метода генерации с расширенным поиском (Retrieval Augmented Generation, RAG), который позволяет модели получать данные из внешних источников и предоставлять актуальные ответы на запросы пользователей.

Однако Kimi стал жертвой своей популярности, не справившись с возросшим спросом, поскольку пользователи стали массово переходить на простой в использовании чат-бот, который в своем арсенале имеет инструмент для составления резюме, а также дает чёткие ответы, которые учитывают контекст.

Столкнувшись с аналогичными ограничениями вычислительных ресурсов, многие ИИ-стартапы предпочли работать над аватарами, которым не обязательно рассуждать так же аргументированно, как чат-ботам с генеративным ИИ. Эти системы обучаются на меньших объёмах данных, поэтому им требуется меньше вычислительных ресурсов.

MiniMax осуществляет разработку приложений на основе ИИ с аниме-тематикой, находящихся в игровом секторе. Аватары взаимодействуют с пользователями и генерируют различные ответы на основе существующих сценариев.

Первым продуктом MiniMax стало приложение Glow, выпущенное в октябре 2022 года. Продукт позволял клиентам создавать виртуальных персонажей, придумывать для них предысторию, а затем общаться с ними в чате на разные темы. Всего через четыре месяца после запуска у приложения было более 5 миллионов пользователей. Из-за проблем с регистрацией Glow было закрыто в марте 2023 года.

Другим инструментом MiniMax, разработанным на основе ИИ, стала нейросеть Hailuo AI. Используемая в ней функция перехода от изображения к видео (Image-to-Video) позволяет оживлять фото или создавать видеоконтент на основе изображения. Кроме того, Hailuo AI может генерировать короткие видеоклипы из текстовых подсказок (Text-to-Video).

Дополнительные возможности платформы:

  • интеллектуальная помощь в программировании;
  • финансовый анализ;
  • суммирование текста;
  • создание контента;
  • интерактивное управление сценой (визуальные эффекты, анимация);
  • возможности голосового взаимодействия.

В настоящее время Hailuo AI допускает создание видеоклипов максимальной длительностью шесть секунд с разрешением 1280×720 пикселей и частотой 25 кадров в секунду. Несмотря на то, что краткость клипов является текущим ограничением, MiniMax работает над улучшениями, которые позволят не только увеличить продолжительность видеороликов, но и внедрить новые возможности.

Hailuo AI наиболее полезна для маркетологов, педагогов, разработчиков, финансовых аналитиков и творческих профессионалов.

Стартап 01.AI – специализируется на разработке продуктов с искусственным интеллектом.

Компания выпустила серию моделей с открытым исходным кодом под названием Yi, разработанных специально для китайского рынка и основанных на архитектуре Llama от Meta (запрещена в РФ), которую можно свободно адаптировать к различным сценариям использования. Модели Yi отлично справляются с задачами логических рассуждений, математических вычислений, программирования и чтения текстов.

Так, экспериментальная ИИ-модель Yi-34B превосходит по основным показателям такие аналоги, как Llama 2. Она использует широкий спектр источников данных. В результате длительного обучения Yi-34B может генерировать качественный текст, изображения и код на китайском и английском языках.

Наряду с этим специалисты 01.AI разработали чат-бота Wanzhi (Ваньчжи), который помогает пользователям более эффективно создавать электронные таблицы, документы и слайдовые презентации, интерпретировать финансовые отчёты, вести протоколы заседаний, а также быстро конспектировать объёмные тексты. Диалоговая система основана на большой языковой модели Yi-Large, она обучалась на графических процессорах H800s от Nvidia и изначально создавалась для корпоративного использования. Приложение находится в свободном доступе на китайском и английском языках.

DeepSeek специализируется на разработке программных продуктов на основе искусственного интеллекта и больших языковых моделей.

Одноименная платформа DeepSeek – это модель ИИ нового поколения с открытым исходным кодом, созданная для глубокого анализа данных и предсказания событий с высокой точностью. Первая версия DeepSeek была выпущена при поддержке хедж-фонда High-Flyer в 2023 году как инструмент для анализа больших массивов данных в научных или бизнес-средах. В 2024 году разработчики представили вторую и третью версии – DeepSeek V2 / V3. Но настоящую сенсацию платформа произвела с выходом в январе 2025 года сразу двух итераций – DeepSeek-R1 и DeepSeek-R1-Zero, наделенных новыми функциями, превратившими ее в незаменимый инструмент для предсказания будущих событий, а также нахождения скрытых закономерностей.

DeepSeek V3 умеет:

  • Создавать и редактировать тексты практически на любую тему с заданной стилистикой и уровнем сложности.
  • Анализировать данные, помогает находить скрытые закономерности и обрабатывать большие объёмы информации. Например, можно обрабатывать комментарии и отзывы пользователей, выявлять основные тренды или находить точки роста.
  • Решать креативные задачи – генерировать идеи для рекламы, предлагать необычные концепции, участвовать в разработке стиля и оформления для бренда.
  • Обобщать информацию из интернета, например, если нужно выделить суть из большой новостной статьи или попросить пересказать её.

Особенности, применяемые в DeepSeek V3:

  • Архитектура «многозначного предсказания» (Multi-token Prediction, MTP) позволяет модели предсказывать следующие слова параллельно в каждой точке обучающего текста, используя общий компонент модели и множество независимых выходных заголовков. Чтобы снизить требования к памяти, вычисления выходных заголовков выполняются последовательно, а промежуточные результаты удаляются после каждого шага. Такой метод повышает точность работы модели и ее производительность;
  • Режим рассуждений (DeepThink) помогает модели решать сложные задачи, требующие логического мышления. Он строит цепочку рассуждений, как это делал бы человек, учитывая все факты, правила и возможные варианты. После анализа DeepThink дает ответ или рекомендации. Например, предлагает оптимальный способ решения задачи или стратегию для достижения цели.
  • Режим глубокого поиска (DeepSearch) позволяет осуществлять просмотр большого объема данных (документы, статьи, изображения и т.д.) и отбирает только самые релевантные результаты, которые наилучшим образом соответствует запросу и выдает список найденных материалов, отсортированных по важности.
  • Архитектура «Смесь экспертов» (Mixture of Experts, MoE) использует несколько специализированных, заранее обученных нейросетей-«экспертов» для анализа различных входных данных. Это позволяет ускорить обучение и повысить эффективность ИИ. DeepSeek V3 работает с 256 такими нейросетями, из которых восемь активируются для обработки каждого токена;
  • Технология «многоголового скрытого внимания» (Multi-head Latent Attention, MLA) – механизм обработки (применяется техника «low-rank joint compression» для сжатия матриц «ключей» (K) и «значений» (V) в динамическое латентное пространство), который обычно используется в больших языковых моделях и помогает им идентифицировать наиболее важные части предложения. MLA позволяет извлекать ключевые детали из фрагмента текста не один, а несколько раз. Это означает, что ИИ с меньшей вероятностью упустит важную информацию.

Благодаря этим особенностям модель потребовала для обучения всего 2,788 млн часов или два месяца работы графических процессоров Nvidia H800. Затраты на него составили 5,5 млн долларов США (OpenAI для ChatGPT – 78 млн долларов).

Китайская технологическая компания Alibaba 29 января текущего года представила свою усовершенствованную и самую мощную в серии Qwen – модель Qwen 2.5-Max, которая предназначена для выполнения сложных языковых заданий, решения многоэтапных задач и глубоких рассуждений. Несмотря на то, что она разработана с закрытым исходным кодом, приложением можно пользоваться бесплатно через Qwen Chat (веб-платформа от Alibaba Cloud).

Некоторые особенности Qwen 2.5-Max:

  • это крупномасштабная MoE модель, обученная на более чем 20 трлн параметров;
  • платформа доработана посредством обучения с подкреплением на основе обратной связи с человеком (Reinforcement Learning from Human Feedback, RLHF).

По словам разработчиков, данная модель может конкурировать с такими платформами, как DeepSeek V3, GPT-4o и Claude 3.5 Sonnet.

Qwen умеет:

  • отвечать на вопросы;
  • решать математические задачи;
  • писать код;
  • генерировать изображения и видео по одному текстовому запросу;
  • «понимать» файлы, изображения и многочасовые видео;
  • искать информацию в интернете.

Следует отметить, что китайский интернет-регулятор тестирует многие модели, разработанные в стране, чтобы убедиться, что их ответы «отражают основные социалистические ценности». Многие китайские системы ИИ выдают преднамеренную ошибку на вопросы, которые могут вызвать недовольство контролирующих органов, например, об автономии Тайваня.

Компания Alibaba активно продвигает Qwen2.5-Max, заявляя, что ее нейросеть превосходит конкурентов по бенчмаркам. Однако сравнение идет не с DeepSeek-R1, а с ее предшественницей – DeepSeek V3, которая была анонсирована еще в конце декабря 2024 года.

Согласно официальным заявлениям разработчиков, Qwen2.5-Max показывает исключительно высокие результаты в таких тестах, как Arena-Hard, MMLU-Pro и GPQA-Diamond, зачастую превосходя показатели DeepSeek V3 в следующем:

  • Arena-Hard – тест на основе предпочтений, измеряющий, насколько «человекоподобными» или полезными являются ответы. Компания Alibaba утверждает, что Qwen2.5-Max превосходит многие платформы на основе LLM, включая DeepSeek V3.
  • LiveBench – обширное испытание для оценки общих навыков ИИ (резюме, контроль качества, диалоги).
  • LiveCodeBench – тестирует понимание и генерацию кода. Хотя Claude 3.5 Sonnet также преуспевает в этом, утверждается, что Qwen2.5-Max не уступает ему.
  • GPQA Diamond – это «бриллиантовый набор», состоящий из 198 вопросов в тесте GPQA (Graduate-Level Google-Proof Q&A Benchmark) – проверяет умение отвечать на вопросы с глубокой логикой.
  • MMLU-Pro (Massive Multitask Language Understanding – Professional) – усовершенствованный бенчмарк, предназначенный для оценки возможностей моделей по более широким и сложным задачам.

Внешние воспроизводимые тесты от более широкого сообщества специалистов по ИИ пока не подтвердили все заявления Alibaba. Тем не менее, первые признаки указывают на то, что Qwen2.5-Max действительно работает достаточно хорошо.

Заявляя о превосходстве над топовыми моделями ИИ в основных тестах, Alibaba акцентирует внимание на том, что китайские компании, занимающиеся ИИ, соревнуются как на международном, так и на внутреннем рынке, расширяя границы производительности, стоимости и масштабируемости.

Следует напомнить, что 10 января текущего года выход нового чат-бота от компании DeepSeek модели R1 спровоцировал падение акций крупных технологических компаний, таких как Nvidia.

Кроме того, значимым для обычных пользователей стал январский релиз Qwen 2.5‑Max. Эта версия сопоставима по своим возможностям в математике, работе с кодом и рассуждениях с такими моделями как GPT-4, DeepSeek V3 и Llama‑3.1–405B, при этом она бесплатна и запускается через веб-интерфейс.

КНР стремится в полной мере воспользоваться преимуществами разворачивающейся революции в области ИИ для укрепления своей национальной мощи и конкурентоспособности. Признавая стратегическую важность этой новой технологии, китайское руководство намерено использовать искусственный интеллект в стремлении к инновационному развитию, чтобы сделать страну мировым лидером в области науки и технологий. В то же время Пекин будет пытаться формировать развитие ИИ в соответствии с национальными целями и интересами.

Ожидается, что значительные финансовые инвестиции, эффективное взаимодействие между разработчиками технологий ИИ и производителями продукции, а также привлечение высококвалифицированных специалистов в данную отрасль позволит Китаю в ближнесрочной перспективе успешно коммерциализировать большое количество инновационных проектов, укрепить свои позиции на мировой арене и составить достойную конкуренцию технологическим гигантам.

34 views·1 share