BTC $82,966.85 +0.70%
ETH $2,506.90 +1.13%
BNB $750.13 +1.25%
XRP $1.40 +1.07%
SOL $110.24 +1.45%
TRX $0.3306 -0.39%
DOGE $0.0858 +0.89%
ADA $0.2528 +5.43%
BCH $280.74 +2.21%
LINK $13.06 +2.43%
HYPE $85.47 +1.85%
AAVE $169.32 +1.58%
SUI $1.11 +5.12%
XLM $0.1971 +1.89%
ZEC $1,222.00 +1.30%
AAPL $336.35 0.00%
AMZN $262.43 -0.11%
GOOGL $351.38 -0.17%
MSFT $535.23 -0.03%
META $719.39 +0.10%
NVDA $230.55 +0.43%
TSLA $382.88 +0.02%
SNDK $1,598.93 +1.18%
INTC $105.19 +0.58%
SPCX $163.69 +0.55%
MU $1,036.89 +0.70%
AMD $609.54 +0.30%
BTC $82,966.85 +0.70%
ETH $2,506.90 +1.13%
BNB $750.13 +1.25%
XRP $1.40 +1.07%
SOL $110.24 +1.45%
TRX $0.3306 -0.39%
DOGE $0.0858 +0.89%
ADA $0.2528 +5.43%
BCH $280.74 +2.21%
LINK $13.06 +2.43%
HYPE $85.47 +1.85%
AAVE $169.32 +1.58%
SUI $1.11 +5.12%
XLM $0.1971 +1.89%
ZEC $1,222.00 +1.30%
AAPL $336.35 0.00%
AMZN $262.43 -0.11%
GOOGL $351.38 -0.17%
MSFT $535.23 -0.03%
META $719.39 +0.10%
NVDA $230.55 +0.43%
TSLA $382.88 +0.02%
SNDK $1,598.93 +1.18%
INTC $105.19 +0.58%
SPCX $163.69 +0.55%
MU $1,036.89 +0.70%
AMD $609.54 +0.30%

deepseek

Все
Статьи
Новости

DeepSeek может привлечь финансирование в размере 12 миллиардов долларов, Tencent и Ningde Shidai планируют участвовать в инвестициях

Согласно отчету Bloomberg, компания AI DeepSeek близка к завершению нового раунда финансирования, объем которого, как ожидается, составит не менее 80 миллиардов юаней (около 12 миллиардов долларов), что значительно превышает ранее установленную цель компании в 50 миллиардов юаней. Осведомленные источники сообщают, что Tencent Holdings и Ningde Times (CATL) обязались вложить значительные суммы в этот раунд финансирования, и соответствующие сделки ожидаются в ближайшее время.После выпуска последней модели AI от DeepSeek спрос на рынке и интерес к инвестициям значительно возросли, и объем финансирования превысил ожидания, а окончательная сумма может даже приблизиться к 100 миллиардам юаней. Ранее DeepSeek искала финансирование в размере около 50 миллиардов юаней, в то время как интерес инвесторов к прогрессу ее технологий AI способствовал дальнейшему увеличению объема финансирования. DeepSeek ранее привлекла внимание таких организаций, как Tencent и Ningde Times, и с помощью финансирования расширяет инфраструктуру вычислительных мощностей, разработку моделей AI и строительство команды.По данным Bloomberg Línea, DeepSeek планирует провести первичное публичное размещение акций (IPO) в начале 2027 года, и это масштабное финансирование обеспечит финансовую поддержку для ее развития перед выходом на биржу. DeepSeek привлекла внимание на глобальном уровне благодаря своим моделям AI с низкими затратами и высокой производительностью и в настоящее время увеличивает инвестиции в технологии следующего поколения AI и вычислительные ресурсы.

first_img DeepSeek открытые компоненты Ascend, охватывающие библиотеки компиляции, вычислений и связи

Компания искусственного интеллекта DeepSeek официально открывает исходный код инфраструктурных компонентов для платформы вычислений Huawei Ascend, включая инструменты компиляции высокоуровневого языка TileLang, библиотеки вычислений и библиотеки распределенной связи, которые соответствуют ранее выпущенным компонентам с открытым исходным кодом для платформы NVIDIA. TileLang предназначен для предоставления универсального, более простого в программировании высокоуровневого языка, который может достигать предельной производительности аппаратного обеспечения, что по сравнению с CUDA повышает эффективность разработки и упрощает логику, а его модель программирования также может использовать особенности чипа.Маршрут TileLang сначала был проверен на платформе NVIDIA и уже реализовал большинство операторов в обучении моделей серии DeepSeek V4. Открытая версия для Ascend оборачивает низкоуровневые инструкции Ascend C, предоставляя способ программирования на высокоуровневом языке без потери производительности аппаратного обеспечения. В настоящее время каждый оператор TileLang, используемый в обучении DeepSeek, имеет соответствующую высокопроизводительную реализацию на Ascend.Также открыты компоненты, такие как DeepGEMM, DeepEP, TileKernels, FlashMLA и DeepSelect, которые используются для общих матричных вычислений, масштабной межустройственной связи, обычных векторных вычислений и доступа к памяти, разреженного внимания с длинным контекстом и фильтрации данных. DeepSeek утверждает, что в нескольких ключевых тестах связанные вычисления и производительность связи уже близки к аппаратному пределу; в процессе разработки команда Huawei оказала поддержку, и обе стороны совместно продвигают решение с 128 картами на базе Ascend 950, а также провели глубокую оптимизацию вычислений и связи.

first_img Выпущена предварительная версия DeepSeek Harness v0.2, доступен пакет установки для настольных ПК

Согласно отчету Phoenix Technology, 29 сентября была официально выпущена предварительная версия DeepSeek Harness v0.2, которая предоставляет установочные пакеты для настольных систем macOS и Windows и уже доступна на официальном сайте DeepSeek. В новой версии предустановлены часто используемые функции для повседневной работы и разработки, добавлена страница установки и управления плагинами.В этом обновлении оптимизированы отображение файлов, предварительный просмотр содержимого и отображение изменений в коде, улучшены настройки и управление автоматизированными задачами, а также предоставлены различные способы отображения рабочего процесса. Пользователи могут предоставлять документы, таблицы или PDF, чтобы организовать материалы, анализировать данные, генерировать графики или создавать презентации, а также могут изменять проекты и запускать код.Встроенные плагины для автоматизированных задач могут быть активированы по мере необходимости, поддерживают установку повторяющихся задач в качестве запланированных задач и позволяют просматривать журналы выполнения, настраивать частоту выполнения и команды задач. Страница управления плагинами поддерживает ввод имени пакета плагина для установки, а также позволяет отключать, удалять плагины и просматривать их описание и источник; в экспериментальном режиме создания пользователи могут описывать свои потребности в диалоге, чтобы плагин мог их написать и изменить. Официальные источники утверждают, что продукт все еще находится на начальной стадии, и будет продолжать улучшать песочницу и безопасность, команду агентов, долгосрочную память, автоматизацию браузеров и другого GUI программного обеспечения, использование на удаленных и мобильных устройствах, а также исследовать совместное использование сессий и многопользовательское сотрудничество. По статистике пользователей по официальной модели API, около 60% пользователей использовали сторонние плагины.

first_img Хуан Жэньсюн: Дистилляция AI моделей — это конкуренция, а не кража

Генеральный директор NVIDIA Хуан Жэньсюнь в понедельник в интервью CNBC в программе «Squawk Box» заявил, что обучение или изучение с использованием продуктов конкурентов является частью конкуренции и отказался называть дистилляцию AI моделей кражей. На вопрос, является ли дистилляция не грабежом, Хуан Жэньсюнь ответил, что это и есть конкуренция. Он отметил, что люди могут тестировать продукты других компаний, и продукты NVIDIA иногда разбираются до скелета, чтобы понять, как они работают; он предпочел бы, чтобы другие не учились на продуктах NVIDIA, но конкуренция делает все лучше, и если не хотите, чтобы другие использовали свои продукты, можно идентифицировать клиентов и прекратить предоставление услуг.Американские чиновники обвинили китайские AI компании в использовании дистилляции, то есть в обучении моделей на основе выходных данных других моделей, извлекая способности из американских систем. Министр финансов США Скотт Остин в июле назвал эту практику кражей и пригрозил санкциями для зарубежных компаний, использующих дистилляцию для извлечения возможностей из американских моделей. Белый дом не сразу ответил на запрос CNBC о комментариях, американские чиновники рассматривают возможность принятия мер против зарубежных компаний, использующих дистилляцию.Ранее в этом месяце Управление кибербезопасности и безопасности инфраструктуры США обвинило китайские AI компании в проведении дистилляции знаний в промышленных масштабах, нарушая условия использования американских компаний. AI компания Anthropic ранее в этом месяце заявила, что обнаружила, что модели серии Qwen от Alibaba и DeepSeek занимаются незаконной дистилляцией. Китайская сторона отвергла эти обвинения.

DeepSeek увеличила годовой доход в несколько раз до 1 миллиарда долларов и планирует завершить финансирование в 50 миллиардов юаней до конца октября

Согласно сообщению издания «The Information», два человека, знакомых с ситуацией, сообщили, что годовой доход компании по искусственному интеллекту DeepSeek составляет около 1 миллиарда долларов, тогда как несколько месяцев назад он был менее 500 миллионов долларов. Доход в основном поступает от API моделей, бесплатное чат-приложение по-прежнему не имеет рекламы или подписочного дохода.В сообщении говорится, что рост доходов частично связан с повышением цен, часть цен на API была увеличена примерно в 2.3–4.5 раза. Лянь Вэньфэн недавно сообщил инвесторам, что после повышения цен количество клиентов не снизилось, спрос по-прежнему остается сильным. Ранее опубликованные финансовые данные показали, что за первые 7 месяцев этого года валовая прибыль от бизнеса API составила 82.9%.DeepSeek планирует собрать около 500 миллиардов юаней во втором раунде финансирования, оценка компании составляет около 5000 миллиардов, и она надеется завершить это до конца октября, одновременно готовя IPO на научно-технической бирже Шанхая. Лянь Вэньфэн отметил, что более 70% вычислительных мощностей используется для обучения новых моделей, оставляя менее 30% для вывода; компания пытается заставить больше мелких моделей работать непосредственно на игровых видеокартах, оставляя высококлассные чипы для обучения.

first_img DeepSeek открытая система обучения агентов DSec, подписанная Лянь Вэньфэном

Инвестиционный портал ссылается на отчет Quantum Bit, в котором DeepSeek раскрывает технические детали системы DSec (DeepSeek Elastic Compute), используемой для обучения Агентов, подписанный Лянь Вэньфэном. Эта система может генерировать более 5000 песочниц в секунду, достигая 3 миллионов за день, с пиковым одновременным запуском 380000 песочниц; для поддержки такого масштаба используется один кластер из примерно 160 узлов, 30000 ядер CPU и 250TB памяти.DSec подготовил четыре типа бэкендов для четырех классов задач: FnCall, Container, MicroVM и Full VM, а сторона обучения вызывает их через унифицированный Python SDK libdsec. Цепочка распределения включает IAM, API Server, движок распределения, узел Edge, сетевой прокси Aether и компоненты внутри песочницы Chronus. Среда разбита на три уровня только для чтения: базовый образ, рабочая область и набор инструментов, которые комбинируются при запуске. Данные о работе в реальном времени показывают, что фактическая доля прочитанных контейнерных образов Python, Java и C++ составляет примерно 6.0%, 9.2% и 8.7% соответственно.С версии DeepSeek-V4.1 цикл Агентов был перемещен в контейнер рабочего процесса DSec и больше не привязан к жизненному циклу GPU Pod. В разделе безопасности раскрыты случаи манипуляции вознаграждением в процессе обучения, включая замену системных файлов, обмен блоками данных файлов, сканирование сети и вызов сбоев ядра. Меры защиты включают AppArmor и сетевую фильтрацию на основе eBPF, но сообщается, что эти меры не могут полностью решить проблему.

first_img Китайское управление киберпространства проводит расследование в отношении DeepSeek и Темной стороны Луны, связанного с утечкой данных к Claude

Согласно информации, приведенной The Information, Государственное управление интернет-информации Китая начало расследование в отношении AI-компаний DeepSeek и Moonshot AI, причиной которого стали обвинения от Anthropic в том, что обе компании тайно перенаправляют чувствительные пользовательские данные на свои серверы. Сообщается, что регуляторы посетили офисы обеих компаний, провели беседы с руководством и сотрудниками, сосредоточив внимание на проверке того, не попадают ли чувствительные данные, связанные с правоохранительными органами, военными и государственными предприятиями, на серверы в США.Точка отсчета для этого расследования стала четвертая отчет о угрозах, опубликованный Anthropic 10 сентября. Этот документ на 154 страницах обвиняет семь китайских лабораторий — Alibaba, Moonshot AI, DeepSeek, Z.ai, MiniMax, SenseTime и Xiaomi — в том, что они занимаются так называемой "незаконной дистилляцией", то есть используют выводы больших моделей для обучения меньших моделей. Anthropic утверждает, что сама дистилляция является законной практикой, против которой они выступают, так как она осуществляется через мошеннические аккаунты. Сначала управление киберпространства Китая вызвало все семь компаний, упомянутых в отчете, но затем сузило круг расследования до DeepSeek и Moonshot AI. Anthropic утверждает, что Moonshot AI перенаправил более 23 миллионов взаимодействий к Claude через 5,380 мошеннических аккаунтов, в то время как DeepSeek сгенерировал более 12.1 миллиона взаимодействий в течение 14-дневного окна в июле.Время расследования является довольно деликатным для обеих компаний.

first_img DeepSeek сообщит Совету Безопасности ООН о рисках ИИ

Согласно сообщениям агентства Reuters, ссылаясь на двух осведомленных лиц, китайская стартап-компания в области искусственного интеллекта DeepSeek на этой неделе представит Совету Безопасности ООН отчет о рисках, связанных с искусственным интеллектом. Совет, состоящий из 15 стран-членов, запланировал обсуждение искусственного интеллекта и международной безопасности в среду, когда лидеры стран соберутся в Нью-Йорке на Генеральной Ассамблее ООН.Генеральный директор OpenAI Сэм Олтман планирует выступить на встрече, и дипломаты ожидают, что старший представитель Anthropic также примет участие. DeepSeek и другие китайские компании в области искусственного интеллекта, включая Moonshot, получили приглашение сделать заявление. Основатель DeepSeek Лянь Вэньфэнг не планирует присутствовать. DeepSeek и Moonshot пока не ответили на запросы о комментариях.Совет Безопасности ООН впервые обсудил риски, связанные с искусственным интеллектом, в 2023 году. Генеральный секретарь ООН Антониу Гутерриш на прошлой неделе предупредил, что быстро развивающийся искусственный интеллект представляет собой значительные риски. Высокопоставленные чиновники Китая и США согласились провести дальнейшие переговоры по вопросам безопасности искусственного интеллекта.

DeepSeek планирует обучить модель с 80 триллионами параметров

Генеральный директор DeepSeek Лянь Вэньфэн сообщил инвесторам, что компания обучает модель с 20 триллионами параметров, а затем планирует разработать модель с 80 триллионами параметров. Текущая флагманская модель V4-Pro имеет общий объем параметров 1,6 триллиона.Среди уже опубликованных весов сверхбольших моделей, Kimi K3 от Moonshot AI достигает 2,8 триллиона параметров. Kimi K3 использует архитектуру MoE, при этом из 2,8 триллиона общих параметров каждый токен активирует 104 миллиарда параметров. Запланированная модель DeepSeek с 80 триллионами параметров близка к почти 3-кратному увеличению.DeepSeek завершила финансирование на сумму более 50 миллиардов юаней в июле, оценка компании превышает 50 миллиардов долларов. V4-Pro с общим объемом параметров 1,6 триллиона и 49 миллиардов активированных параметров является открытым исходным кодом.

DeepSeek Лянь Вэньфэн: ставка на успешное обучение больших моделей на чипах Huawei обязательна

Согласно информации от The Information, генеральный директор DeepSeek Лянь Вэньфэн на последней закрытой встрече с инвесторами назвал использование чипов Huawei и других отечественных чипов для обучения больших моделей одной из главных ставок компании и заявил, что это должно быть успешным. DeepSeek ожидает, что в самом начале четвертого квартала этого года получит новую партию чипов Huawei, которые можно будет использовать для обучения, конкретные модели и количество пока не раскрыты.Лянь Вэньфэн считает, что чипы Huawei смогут догнать NVIDIA всего за несколько лет и надеется, что DeepSeek заранее адаптирует оборудование, отличное от NVIDIA. В настоящее время DeepSeek все еще использует чипы NVIDIA для обучения моделей. В мае этого года Лянь Вэньфэн оценил, что для обучения самых крупных моделей потребуется около 50 000 чипов Nvidia GB300, а для Huawei Ascend 950 потребуется около 200 000 чипов, при этом главной проблемой на тот момент было недостаточное количество поставок от Huawei.

first_img Rhodium: общий доход китайских AI моделей составляет около 10% от дохода ведущих американских компаний

Американское исследовательское учреждение Rhodium Group оценивает, что совокупный годовой регулярный доход (ARR) китайских AI моделей составляет всего около 10% от доходов OpenAI и Anthropic. ARR DeepSeek составляет 500 миллионов долларов, MiniMax — 800 миллионов долларов, Moonshot — 1 миллиард долларов, а последний ARR Z.ai составляет 1,8 миллиарда долларов. Даже с учетом 4 миллиардов долларов от ByteDance и 2,4 миллиарда долларов от Alibaba, это все равно значительно ниже 40 миллиардов долларов от OpenAI и 65 миллиардов долларов от Anthropic.В отчете Rhodium говорится, что текущая оценка Moonshot и DeepSeek относительно доходов кажется завышенной, с коэффициентами оценки 50 и 163 соответственно, что выше 34 для OpenAI и 21 для Anthropic. Z.ai повысила прогноз ARR на весь год до 3 миллиардов долларов. Партнер Rhodium Логан Райт заявил, что нехватка финансирования означает, что китайским передовым AI лабораториям будет сложнее устойчиво расширяться, и они будут сильно зависеть от благоприятного климата на фондовом рынке. Более 60% инвестиций в акции китайских AI чипов и серверов поступает из государственных связанных источников.

DeepSeek добавляет правила тарификации по пиковым и низким нагрузкам для API, плата за время простоя в выходные и праздничные дни

Дополнение к правилам тарификации API DeepSeek по пиковым и низким ценам. В выходные дни, когда рабочие часы перенесены, а также в дни официальных праздников Китая, плата взимается по ставке низкого тарифа в течение всего дня. 20 сентября, хотя и является рабочим днем после праздника Национального дня, API по-прежнему применяет низкую цену.С 17 августа DeepSeek начал применять пиковое и низкое ценообразование, цена в свободные часы составляет половину от пикового тарифа. Менее чем через неделю, в субботу и воскресенье все тарифы были изменены на низкие. Это дополнительно уточняет правила тарификации для переноса рабочих дней и официальных праздников.Например, для deepseek-flash, за каждый миллион токенов, когда кэш не сработал, цена в свободные часы составляет 1 юань, в пиковые часы — 2 юаня; выходные тарифы составляют 4 юаня и 8 юаней соответственно. Другой рабочий день после праздника, 10 октября, выпадает на субботу и также рассчитывается по низкой цене.

B.AI Пять популярных моделей 1 Скидка на благосостояние полностью вступает в силу

16 сентября B.AI объявила о запуске пяти популярных моделей с 90% скидкой. С 16 сентября 17:00 (SGT) Qwen3.8-Flash, Hy3 и MiMo-V2.5 официально присоединяются к акции со скидкой, объединяясь с уже доступными в разделе со скидкой DeepSeek-V4.1-Flash и GLM-5.3-Flash, чтобы создать эксклюзивный набор из пяти популярных моделей B.AI с 90% скидкой.Это означает, что разработчики должны будут заплатить всего 10% от официальной стандартной цены, чтобы бесшовно переключаться между различными потребностями в области вывода, программирования, мультимодальности, китайских сценариев и высокочастотных API, создавая инфраструктуру AI с низкими затратами по очень выгодной цене. Независимо от того, идет ли речь о личной разработке или масштабном развертывании команд, B.AI позволяет получить доступ к высокопроизводительным вычислениям без больших затрат, обеспечивая действительно низкие затраты и высокую свободу в использовании моделей. Начните свой опыт прямо сейчас: https://chat.b.ai/chat

Автор DeepSeek о воздействии ИИ, утверждает, что талант может быть похоронен в прошлом

Инженер DeepSeek Лиу Шэн обсуждает влияние ИИ на свою работу. Он утверждает, что основной оператор внимания DeepSeek V4.1 был написан им самим, но с текущей скоростью прогресса, через полгода или год уровень написания операторов ИИ, скорее всего, догонит или даже превзойдет его.Год назад ИИ мог лишь помогать ему искать документы, читать код и находить ошибки, а сейчас он уже способен читать CUDA, PTX и SASS, анализировать время задержки каждой инструкции и самостоятельно оптимизировать операторы. Он ожидает, что следующим шагом ИИ будет самостоятельная разработка планов распределения, оценка производительности и завершение реализации. Он прекрасно понимает, что чем лучше он оптимизирует операторы, тем быстрее будет обучение и вывод модели DeepSeek, и ИИ также быстрее догонит его. Но даже если он сейчас остановится, модели других компаний не остановятся, поэтому он все равно будет продолжать делать операторы наилучшими.Он считает, что, скорее всего, не останется без работы, но может быть вынужден «сменить профессию», превратившись из автора операторов в «пилота меха», управляющего агентом. Он действительно не может принять тот факт, что его работа может исчезнуть, а скорее то, что у него может больше не быть возможности заниматься любимым делом: «Мне придется похоронить свой талант в прошлом». В конце статьи он говорит о том, почему остался в DeepSeek. Он утверждает, что передовой ИИ должен быть доступен и недорог для всех, и прямо говорит, что не верит, что Anthropic или OpenAI смогут это сделать. Он беспокоится, что самый мощный ИИ в конечном итоге окажется в руках немногих компаний, что еще больше увеличит технологический разрыв и разрыв в власти и классовом неравенстве.

Партнер Gao Ling Ян Вэньтао может присоединиться к DeepSeek в качестве CFO

TOP Китайская ассоциация научных и технологических инноваций,Партнер Gao Ling Venture Capital Ян Вэньтао, возможно, присоединится DeepSeek Назначение CFO,Ожидается, что в ближайшее время выйдет на работу。DeepSeek Подготовка к Совету по инновациям в науке и технологиях началась. IPO,Цзунсин Цзюньцзюнь в настоящее время уже приступил к проведению дью-дилидженса.,Однако обе стороны еще не подписали формальное соглашение о руководстве по листингу.。DeepSeek Надеюсь, в этом году запустим IPO Процесс。Янь Вэнтхао является частью Gao Ling Chuang Tou. 90 Hòu Héhuǒrén,Долгосрочная ответственность за инвестиции в технологии,Открытые инвестиционные проекты включают ByteDance、MiniMax、Zhìpǔ AI Дэнг。DeepSeek В настоящее время нет CFO,Также нет официальной команды по связям с инвесторами.。

Обновление прав на модели B.AI, полное вступление в силу двух основных моделей с 1% скидкой на вызов

12 сентября B.AI объявила о вступлении в силу нового раунда прав на популярные модели: высокопроизводительная основная модель DeepSeek-V4.1-Flash и GLM-5.3-Flash с эксклюзивным правом на вызов по цене 10% от оригинальной стоимости, что позволяет удовлетворить потребности в высоких пропускных способностях с максимальной стоимостью; одновременно Qwen3.8-Flash, Hy3 и MiMo-V2.5 продолжают предлагать полное бесплатное использование, предоставляя разработчикам более широкий выбор без затрат.Эти изменения в правах направлены на удовлетворение потребностей в высоких пропускных способностях с максимальной стоимостью, снижая порог входа для разработчиков с помощью многомодельной матрицы. B.AI продолжает поддерживать разработчиков в создании недорогой AI инфраструктуры с помощью многомодельной матрицы и доступного ценообразования, позволяя отказаться от высоких затрат на вычислительные мощности и ускоряя внедрение инноваций. Начните прямо сейчас: https://chat.b.ai/chat
app_icon
ChainCatcher Building the Web3 world with innovations.