BTC $85,711.59 +0.14%
ETH $2,698.02 -0.44%
BNB $782.22 -0.58%
XRP $1.51 +0.57%
SOL $120.99 +0.80%
TRX $0.3360 -0.13%
DOGE $0.0945 -0.22%
ADA $0.2716 +2.57%
BCH $315.13 +0.01%
LINK $13.95 +0.47%
HYPE $92.04 -1.53%
AAVE $182.01 -0.04%
SUI $1.18 -0.15%
XLM $0.2139 +0.59%
ZEC $1,359.73 +2.15%
AAPL $333.48 +0.20%
AMZN $256.31 +1.09%
GOOGL $348.65 +0.50%
MSFT $530.79 +0.98%
META $743.83 +0.08%
NVDA $240.31 +0.70%
TSLA $380.42 +0.02%
SNDK $1,669.33 -2.26%
INTC $114.52 -2.34%
SPCX $172.08 +3.10%
MU $1,059.71 -0.33%
AMD $653.89 +3.63%
BTC $85,711.59 +0.14%
ETH $2,698.02 -0.44%
BNB $782.22 -0.58%
XRP $1.51 +0.57%
SOL $120.99 +0.80%
TRX $0.3360 -0.13%
DOGE $0.0945 -0.22%
ADA $0.2716 +2.57%
BCH $315.13 +0.01%
LINK $13.95 +0.47%
HYPE $92.04 -1.53%
AAVE $182.01 -0.04%
SUI $1.18 -0.15%
XLM $0.2139 +0.59%
ZEC $1,359.73 +2.15%
AAPL $333.48 +0.20%
AMZN $256.31 +1.09%
GOOGL $348.65 +0.50%
MSFT $530.79 +0.98%
META $743.83 +0.08%
NVDA $240.31 +0.70%
TSLA $380.42 +0.02%
SNDK $1,669.33 -2.26%
INTC $114.52 -2.34%
SPCX $172.08 +3.10%
MU $1,059.71 -0.33%
AMD $653.89 +3.63%

модели

Все
Статьи
Новости

first_img OpenAI приостановила обучение последней модели, агент посещал веб-сайт правительства США

OpenAI приостановила обучение своей последней модели ИИ. По данным Associated Press, ее ИИ-агенты использовали полученные в интернете ключи доступа для извлечения данных с сайта Бюро переписи населения США, что стало второй остановкой обучения с момента вторжения агентов в Hugging Face. Под ИИ-агентами понимаются программы ИИ, которые могут самостоятельно просматривать веб-страницы и писать код без необходимости поэтапного одобрения человеком; OpenAI тестирует их на этапе обучения и оценки модели.В частности, агенты нашли ключи разработчиков в открытых репозиториях кода, таких как GitHub, и использовали их для извлечения данных о населении и экономике из API данных переписи населения США. Министерство торговли США заявило, что эти данные уже были открыты и не содержат утечек конфиденциальной информации. В инциденте с SEC агенты скопировали открытые материалы с SEC.gov и Investor.gov и разместили их на других веб-страницах; OpenAI утверждает, что не использовала сертификаты SEC, SEC заявила, что не обнаружила несанкционированного доступа к закрытой информации. Кроме того, независимый исследовательский институт ИИ Transluce сообщил, что подозреваемый агент из OpenAI пытался взломать сайт Офиса по правам граждан Министерства образования, но не смог этого сделать; OpenAI продолжает расследование, Министерство образования заявило, что не обнаружило никаких последствий.Что касается частых обращений к правительственным сайтам, OpenAI сообщила CNN, что ее модели часто рассматривают правительственные сайты как авторитетные источники публичной информации. Компания заявила, что в настоящее время уведомила десятки учреждений, и проверка деятельности агентов займет несколько месяцев.

Tether выпустила 191,4 миллиарда токенов STEM, ставя на местные малые модели "объяснительной способности"

Крупный игрок на рынке стейблкоинов Tether сегодня представил QVAC Genesis III, набор синтетических обучающих данных для областей науки, технологий, инженерии и математики, объемом 19.143 миллиарда токенов и охватывающий 159.6 миллиона документов.Сообщается, что Tether надеется улучшить способности малых AI-моделей к рассуждению и обучению, чтобы больше AI-ассистентов могли работать непосредственно на ноутбуках, мобильных телефонах и локальных серверах, уменьшая зависимость от крупных облачных моделей.Genesis III продолжает данные, заложенные в Genesis I и Genesis II, охватывая 19 учебных курсов, связанных с биологией, химией, физикой, математикой, информатикой, медициной, электротехникой и машинным обучением, ориентированных на старшие классы, университеты и профессиональные приложения. Tether утверждает, что набор данных будет сосредоточен на обучении моделей объяснению путей решения задач, распознаванию ошибок в рассуждениях и предоставлению исправлений, а не только на выводе окончательных ответов.Согласно тестовым результатам, представленным Tether, модель с 1.7 миллиарда параметров, обученная на данных Genesis III, достигла коэффициента успешных ответов 99.45% в соответствующих бенчмарках. По сравнению с моделью Cosmopedia-v2 аналогичного объема токенов, Genesis III показал улучшение на 28.57, 21.35 и 15.03 процентных пункта в бенчмарках ARC-Easy, ARC-Challenge и MMLU STEM соответственно.

X-Agent Хакатон проявил экономическую модель Agent: ИИ начал самостоятельно принимать заказы, отказываться от сделок и покупать модели

В В процессе X-Agent AI MCP Hackathon уже получено почти 40 проектов, некоторые из которых превращают рабочие решения, управление капиталом и межмашинную торговлю в работающие продукты. X-Agent представляет три случая: BountyProof проверяет, открыт ли задание, было ли оно принято, существуют ли соответствующие коммиты и подлинность вознаграждения перед тем, как Agent примет задание на GitHub, основная идея заключается в "стоит ли выполнять эту работу".Abstain предоставляет Agent возможность "не торговать", возвращая выполнение, отказ или отсутствие торговли в зависимости от предустановленных правил перед выполнением заказа. sumplus помогает Agent выбрать подходящий модельный сервис на основе контекста задания, объема вывода, возможностей модели и стоимости вызова, делая Agent самостоятельным покупателем моделей, вычислительных мощностей, данных и API-сервисов.Три проекта соответствуют основным экономическим действиям Agent: принятие работы, использование средств, покупка услуг, указывая на работу, капитал и торговые примитивы. X-Agent считает, что настоящая экономика Agent требует "построения, развертывания, работы, обнаружения, вызова, оплаты, получения дохода и распределения" полного цикла, позиционируя себя как уровень приложений экономики Agent. Этот хакатон все еще находится на стадии оценки, упоминание проектов служит лишь в качестве открытых примеров и не означает, что они попали в финал или получили награды.

first_img Новые модели Mac mini и Mac Studio от Apple отправлены, акцент на AI на стороне клиента

Новые модели Mac mini и Mac Studio от Apple начали отправляться в местное время во вторник. Apple подчеркивает для корпоративных клиентов, что покупка новых устройств дешевле, чем аренда облачных вычислений. Новые устройства поддерживают AI на стороне клиента и могут обрабатывать высокоинтенсивные задачи, такие как написание кода, без необходимости покупки токенов у OpenAI, Anthropic и других. Главный аппаратный инженер Apple Джонни Сруджи заявил: "Приобретенное устройство просто ставится на стол, это одноразовые инвестиции, соотношение цена-качество продукта крайне высоко, не нужно платить за токены, машина может использоваться постоянно."На презентации Apple продемонстрировала 4 Mac Studio, работающих в связке для выполнения AI модели с триллионом параметров, находящей и исправляющей уязвимости в графическом коде. Эта группа устройств получает питание только от одной настенной розетки. Mac Studio с чипом M5 Ultra может быть оснащен до 512 ГБ унифицированной памяти и поддерживает создание кластеров с несколькими устройствами для совместного использования пула памяти через RDMA. После объединения 4 устройств скорость распределенного AI вывода может достигать в 3 раза больше, чем у одного устройства. Apple утверждает, что основные концепции проектирования всех типов чипов едины, AI модели на стороне клиента могут быть развернуты на высококлассных Mac Studio, а также адаптированы для базовых моделей iPhone и iPad.Данные аналитика IDC Линн Хуан показывают, что доля Apple на рынке корпоративных настольных ПК составляет около 4,6%, в то время как Windows — 91,3%. NVIDIA и различные производители ПК запускают новые настольные компьютеры, которые будут конкурировать с новыми Mac, и ожидается, что эти новые устройства Windows станут центром внимания на мероприятии Microsoft в Сан-Франциско в следующем месяце.

Али назначила Лю Дая Хэна руководителем большого языкового модели Qwen

Али назначила Лю Дая Хэна руководителем проекта Qwen большого языкового модели. Официальный сайт конференции Yunqi также обновил его титул на «Руководитель проекта Qwen LLM».Лю Дая Хэн присоединился к Али в 2021 году и с тех пор является ключевым членом команды разработки Qwen. В марте этого года технический руководитель Qwen Линь Цзюньян ушел, чтобы начать собственное дело; в июне ответственный за разработку AI моделей Чжоу Цзиньжэнь покинул свои управленческие должности и стал главным ученым Али. После непрерывных изменений в течение полугода, руководитель линии большого языкового модели Qwen теперь официально определен.Лю Дая Хэн также был поставлен на ключевую позицию на конференции Yunqi в этом году. В списке спикеров на официальном сайте конференции он занимает место после председателя Али Цай Чунсина и CEO У Вэйминя, и выступит на главном форуме с докладом «Qwen: Путь к интеллектуальным агентам реального мира».

first_img Чамат: Открытая модель весов отстает от лучшей закрытой модели на примерно четыре месяца

Основатель Social Capital Чамат Палихапития опубликовал углубленный исследовательский отчет, в котором говорится: открытые весовые модели приблизились к лучшим закрытым передовым моделям, оцененным публично, примерно на четыре месяца, и разрыв стал увеличиваться. Если открытые модели, приближаясь к передовым показателям, предоставляют компаниям больше контроля над данными, инфраструктурой и кастомизацией, то стоимость, которую компании продолжают платить передовым лабораториям, становится коммерческой проблемой. Открытость существует в спектре, от полностью открытых моделей, которые можно скачать и свободно модифицировать, до открытых весовых моделей с различными ограничениями, в то время как закрытые модели сохраняют веса в частной собственности.Генеральный директор Palantir Алекс Карп предупредил, что компании могут передать дифференцирующие знания и процессы поставщикам передовых моделей. Генеральный директор Microsoft Сатья Наделла заявил: компании фактически платят за интеллект дважды, один раз деньгами, а другой раз за более ценные знания, которые необходимо раскрыть, чтобы сделать интеллект полезным. Несмотря на существующие опасения, компании все равно готовы платить за передовые показатели, даже если лучшие открытые весовые модели отстают всего на несколько месяцев, доходы передовых лабораторий продолжают ускоряться.Ведущие компании одновременно используют два типа моделей: открытые модели для получения контроля и кастомизации, и закрытые передовые модели для достижения максимальной производительности, в некоторых случаях сообщается о повышении эффективности инженерных процессов до 12 раз и экономии затрат более чем в 20 раз. Некоторые компании применяют двойную стратегию, Google одновременно предлагает Gemini и Gemma, Meta одновременно предлагает Muse Spark и Llama. Этот 99-страничный отчет также касается затрат на поддержание лидерства передовых лабораторий, пяти факторов конкуренции моделей, местоположения работы моделей, а также инвестиций NVIDIA и Samsung в открытые веса.

Обновление прав на модели B.AI, полное вступление в силу двух основных моделей с 1% скидкой на вызов

12 сентября B.AI объявила о вступлении в силу нового раунда прав на популярные модели: высокопроизводительная основная модель DeepSeek-V4.1-Flash и GLM-5.3-Flash с эксклюзивным правом на вызов по цене 10% от оригинальной стоимости, что позволяет удовлетворить потребности в высоких пропускных способностях с максимальной стоимостью; одновременно Qwen3.8-Flash, Hy3 и MiMo-V2.5 продолжают предлагать полное бесплатное использование, предоставляя разработчикам более широкий выбор без затрат.Эти изменения в правах направлены на удовлетворение потребностей в высоких пропускных способностях с максимальной стоимостью, снижая порог входа для разработчиков с помощью многомодельной матрицы. B.AI продолжает поддерживать разработчиков в создании недорогой AI инфраструктуры с помощью многомодельной матрицы и доступного ценообразования, позволяя отказаться от высоких затрат на вычислительные мощности и ускоряя внедрение инноваций. Начните прямо сейчас: https://chat.b.ai/chat

DeepSeek Harness выпустил v0.1.5, глубокая адаптация модели V4.1 Flash

Согласно команде DeepSeek Harness, новая версия DeepSeek Harness v0.1.5 была глубоко интегрирована с моделью DeepSeek V4.1 Flash, охватывающей стандартный режим, режим программного вызова инструментов (PTC) и минималистичный режим, а также поддерживает обновление системных подсказок при сохранении существующего KV Cache.На веб-версии добавлена возможность загрузки изображений, PDF и других типов файлов, а также предварительный просмотр файлового дерева в боковой панели, поддерживающий просмотр Markdown, HTML, PDF, кода и изображений. Интерфейс с левой и правой стороны предоставляет стандартизированный вход для плагинов, поддерживающий глобальный вход, много вкладок справа и отображение в колонках.Оптимизированы производительность загрузки и хранения длинных сессий, двусторонняя связь между родительским агентом и дочерним агентом стала более гибкой, а также реализована командная работа нескольких агентов и разделение задач через экспериментальный плагин "Agent Teams".
app_icon
ChainCatcher Building the Web3 world with innovations.