BTC $79,685.22 +0.39%
ETH $2,459.21 +0.91%
BNB $765.61 +7.18%
XRP $1.41 +0.21%
SOL $102.95 +1.27%
TRX $0.3332 +1.15%
DOGE $0.0875 +2.79%
ADA $0.2160 +0.76%
BCH $250.35 -0.20%
LINK $11.85 +1.90%
HYPE $85.44 +0.19%
AAVE $129.97 -0.68%
SUI $0.7973 +5.95%
XLM $0.1836 +1.67%
ZEC $1,016.98 +2.73%
BTC $79,685.22 +0.39%
ETH $2,459.21 +0.91%
BNB $765.61 +7.18%
XRP $1.41 +0.21%
SOL $102.95 +1.27%
TRX $0.3332 +1.15%
DOGE $0.0875 +2.79%
ADA $0.2160 +0.76%
BCH $250.35 -0.20%
LINK $11.85 +1.90%
HYPE $85.44 +0.19%
AAVE $129.97 -0.68%
SUI $0.7973 +5.95%
XLM $0.1836 +1.67%
ZEC $1,016.98 +2.73%

мультимодальный

Все
Статьи
Новости

B.AI запустила флагманскую модель MiMo-V2.5 с полными модальностями и открыла бесплатный доступ к вызовам

Сообщение ChainCatcher, платформа B.AI объявила, что флагманская полумодальная модель Xiaomi MiMo-V2.5 теперь доступна для полного бесплатного использования. Как модель с 310B разреженными MoE, MiMo-V2.5 поддерживает текстовые, графические, видео и аудио полумодальные входные данные и обладает 1M сверхдлинным контекстным окном и высокой скоростью отклика, специально оптимизирована для многомодальных агентов, интеллектуального анализа аудио и видео, а также для высокоинтенсивных практических сценариев общего программирования.С сегодняшнего дня разработчики могут разблокировать возможности передовой полумодальной модели Xiaomi без каких-либо затрат через официальный API группы платформы B.AI, без каких-либо барьеров интегрировать передовые многомодальные возможности в свои приложения и рабочие процессы. Войдите на chat.b.ai/chat, чтобы бесплатно испытать новый полумодальный интеллектуальный опыт, который предлагает Xiaomi MiMo-V2.5.

DeepSeek-V4-Flash-Vision-Exp вход в B.AI, полностью бесплатно открыт

Сообщение от ChainCatcher, платформа B.AI запустила новый флагманский многомодальный экспериментальный модель DeepSeek-V4-Flash-Vision-Exp, в настоящее время официальная группа API уже завершила полный доступ и открыла его для всех пользователей бесплатно.Эта модель, продолжая лучшие возможности V4-Flash в области чистого текста и кода Agent, официально разблокировала родные возможности понимания изображений, комплексные показатели многомодального Agent уже близки к флагманскому уровню Claude Opus-4.8.Новая модель поддерживает смешанный ввод текста и изображений и 1M сверхдлинный контекст, она легко справляется с такими сложными сценариями, как генерация многомодальных PPT, сложная реконструкция пользовательского интерфейса и фронтенд-эффекты, ввод изображений тарифицируется по токенам, за одно изображение взимается максимум 384 токена. Теперь все пользователи, войдя на платформу B.AI, могут без барьеров бесплатно использовать возможности этой новейшей многомодальной модели, позволяя передовым вычислительным мощностям ускорить реализацию креативности и производительности.

DeepSeek визуальная модель мультимодального агента достигает уровня Opus 4.8, 4 предмета заканчиваются со счетом 2:2

Сообщение ChainCatcher, DeepSeek опубликовал первые результаты тестирования Agent V4-Flash-Vision-Exp. В 4-х многомодальных оценках Agents' Last Exam 27.3 против 25.7, ZeroBench 35.0 против 34.0; ApexBench 36.5 против 39.4, Chartography 64.3 против 65.0, с результатом 2 победы и 2 поражения против Opus 4.8.По сравнению с чисто текстовой версией V4-Flash-0731, визуальная версия в ApexBench увеличилась с 26.2 до 36.5, Agents' Last Exam с 25.2 до 27.3. Официально указано, что текстовая версия игнорирует многомодальное содержание, поэтому в основном отражает способности после добавления визуального ввода. После добавления визуального ввода способности текстового агента не уменьшились, в 7 текстовых оценках 6 показали результаты выше V4-Flash-0731, например, DeepSWE увеличился с 54.4 до 59.3 (превысив Opus 4.8 с 58.0), Toolathlon 75.9 почти сравнялся с Opus 4.8 с 76.2.Этот результат получен из официального самотестирования DeepSeek, не является независимым рейтингом третьей стороны; публичная задача текстового агента Code Agent использует ультра-простой режим DeepSeek Harness, уровень вывода - max.

hot_img OpenAI опубликовала данные о пользователях ChatGPT из разных стран: доля "выполнения" в рабочих сценариях достигла двукратного значения по сравнению с повседневной жизнью, доля пользователей старше 35 лет увеличилась на 5 процентных пунктов

Сообщение ChainCatcher, OpenAI 6 августа впервые опубликовала данные об использовании ChatGPT в разных странах, показывающие значительные различия в использовании в зависимости от различных сцен, возрастов и регионов. В рабочих сценариях более 50% пользователей используют ChatGPT для выполнения задач (написание, редактирование, анализ и т.д.), что более чем в два раза превышает долю в нерабочих сценариях; в нерабочих сценариях по-прежнему преобладает "информационный поиск". По возрастным группам доля пользователей старше 35 лет в мире увеличилась на 5 процентных пунктов по сравнению с прошлым годом, во Франции и Чехии рост составил более 10 процентных пунктов, почти в трех четвертях стран Европы рост превышает средний мировой уровень, в то время как в некоторых регионах Юго-Восточной Азии рост был незначительным.С точки зрения регионов, Латинская Америка, Африка и Океания сокращают разрыв с ранними последователями, Перу, Уругвай и Коста-Рика показывают самый быстрый рост в рейтинге. Мультимодальные (генерация и анализ изображений и т.д.) случаи использования являются самыми быстрорастущими, их доля в мире возросла до 7,8%, в таких странах, как Бразилия и Колумбия, она превышает 10%. OpenAI заявила, что соответствующие данные были опубликованы через платформу OpenAI Signals, с целью помочь политикам и исследователям понять тенденции использования более чем 1 миллиарда пользователей.
app_icon
ChainCatcher Building the Web3 world with innovations.