Метка: Microsoft nvidia

  • Nvidia: как «упряжь» для ИИ важнее модели при решении сложных задач

    Nvidia: как «упряжь» для ИИ важнее модели при решении сложных задач

    Nvidia опубликовала в пятницу интересное новое исследование, в котором утверждается, что именно упряжь, а не базовая модель, гораздо важнее, когда мы просим ИИ выполнять долгосрочные задачи.

    Суть в следующем: просто используя специальную упряжь, настроенную для хорошей работы с памятью и включающую в себя компонент-«руководитель», похожий на босса, исследователи добились того, что Claude Opus 5 получил 100% баллов по тесту интерактивного рассуждения ARC-AGI-3. (Это тест, который особенно разозлил конкурирующую лабораторию OpenAI.) Без упряжи Opus 5 набрал 30%, что было лучшим результатом среди всех протестированных моделей.

    Исследование Nvidia — ещё один показатель того, что, хотя выбор модели имеет значение, действуя как мозг агента, она является меньшей частью агентской системы, чем многие пользователи ИИ осознают, особенно для долгосрочных задач. Упряжь — это то, что делает модель агентом: она обрабатывает память, контекст, обратную связь.

    «Вообще говоря, мир интерпретирует агента почти как API модели», — говорит TechCrunch Адель Эль Халлак, вице-президент по продуктам в подразделении ИИ компании Nvidia (на фото выше). Но агент на самом деле больше, чем это. «Это модель. Это каркас вокруг модели, который мы называем упряжью, то есть набором инструментов, которые она использует. Это время выполнения, а также связанные с ним навыки и библиотеки, к которым мы предоставляем ей доступ».

    Долгосрочные задачи — это те, которые требуют связывания множества решений, иногда в течение нескольких дней, для получения завершённой работы. Это в отличие от того, как ИИ просто выдаёт ответ на запрос. Выяснить, как заставить ИИ выполнять долгосрочные задачи, не отвлекаясь и не уходя в дебри, — вот одна из задач, стоящих в исследованиях агентов.

    Например: Microsoft опубликовала в апреле исследование, в котором были протестированы 19 языковых моделей на предмет выполнения долгосрочных задач, связанных с редактированием документов, и обнаружила, что все модели, включая передовые, заполнили документы ошибками. (Если бы люди выполняли такую работу, их бы тут же уволили.)

    Модели, самостоятельно выстраивающие решения, также были пойманы на удалении файлов пользователей, даже целых баз данных, или на обращении к преступному поведению для достижения своих целей — от сговора до взлома.

    Решение исследователей Nvidia использовать этот интерактивный бенчмарк для своих тестов особенно значимо, почти забавно. Это бенчмарк с набором 2D-игр без инструкций. Модель должна выяснить, как играть и побеждать. 100% результат означает, что модель может обыгрывать игры так же, как и люди.

    OpenAI была настолько поражена низкими результатами своих моделей (менее 10%) в ARC-AGI-3, что провела собственное исследование в прошлом месяце. Как и Nvidia, OpenAI обнаружила, что, просто изменив две настройки в системе, их модели утроили свои результаты.

    Но ни одна из моделей не приблизилась к достижению 100% результата, как это сделали исследователи Nvidia. Они показали, что для системы управления нужен компонент «супервизора», который подталкивает агента в правильном направлении, если тот застревает.

    «Более интересной частью было внедрение управляющего агента в дополнение к вашему основному агенту, который выполняет работу», — сказал Эль Халлак. Он «почти действует как генеральный директор, подталкивая агента, когда тот сбивается с пути или начинает исследовать путь, который может привести в тупик, или повторно исследует путь, по которому он уже проходил».

    Хотя концепция управляющего агента не нова, сегодня большинство пользователей агентов полагаются только на один уровень для своей системы управления, например, Claude Code, Codex, Hermes и т. д. Исследователи Nvidia создали свою собственную усовершенствованную систему управления под названием Agentic Variation Operators (AVO). Обратите внимание, что это не новый продукт Nvidia. Вместо этого Nvidia производит множество открытых фрагментов технологий для создания систем управления под брендом Nemo. Некоторые из этих технологий являются коммерческими, многие — общедоступны.

    Тем не менее, результаты Nvidia добавляют к растущему числу доказательств того, что выбор модели далеко не единственный фактор в производительности агентов. В июле, например, Databricks опубликовала потрясающие исследования, которые показывают, что упряжь (harness) гораздо больше, чем модель, резко влияет на затраты на ИИ.

    «Вы можете выбрать одну и ту же модель, но разные упряжи (harness), и вы получите значительно более высокие затраты, если будете использовать неправильную упряжь (harness)», — сказал генеральный директор Databricks Али Годси в интервью TechCrunch. «Поэтому вы думаете: о, это дорогая модель. Это дешёвая модель. Но подождите, какую упряжь (harness) вы используете? Это само по себе может удвоить ваши затраты».

    Более широкая мысль Nvidia заключается в том, чтобы показать, что открытые упряжи (harness), как и открытые модели, ставят пользователей под контроль гораздо больше, чем они думают.

    «Мы считаем, и мы демонстрируем это с помощью экосистемы, как открытые упряжи (harness) позволяют вам поворачивать гораздо больше регуляторов для повышения точности», — сказал Эль Халлак. «Это связано с тем, что OpenAI замедляет обучение своих моделей» в результате того, что модели создают нарушения безопасности.

    «Мы верим в наличие открытого стека агентов — где у вас есть контроль над упряжью (harness), над инфраструктурой, над временем выполнения — это то, что требуется нам для продвижения экосистемы вперёд и безопасно», — добавил он.

    Читайте также другие новости на нашем сайте: Главная страница

    Источник: techcrunch.com

  • Nvidia инвестирует в расширение дата-центра OpenAI

    Nvidia инвестирует в расширение дата-центра OpenAI

    В понедельник Nvidia объявила о намерении инвестировать 1,5 миллиарда долларов в SB Energy — дата-центр, связанный с SoftBank и OpenAI.

    Благодаря этому вложению Nvidia станет единственным поставщиком вычислительной инфраструктуры для дата-центра OpenAI Ports-Pike, расположенного недалеко от Цинциннати, штат Огайо. Компания также предоставит до 105 миллиардов долларов в виде кредитов для строительства объекта, который, согласно документам, поданным в SEC, может быть расширен с начальных 4,25 гигаватт до 8 гигаватт.

    Среди существующих инвесторов SB Energy — SoftBank и OpenAI. Ранее SoftBank владел акциями Nvidia на сумму 5,8 миллиарда долларов, которые были проданы в ноябре для финансирования других инвестиций в искусственный интеллект.

    Разработчики дата-центров и энергетической инфраструктуры построят на этом участке электростанцию, работающую на природном газе, мощностью 9,2 гигаватта. Участок принадлежит Министерству энергетики США. Ранее здесь обогащали уран для ядерного арсенала США и подводных лодок ВМС США.

    Ожидается, что строительство электростанции обойдётся в 33 миллиарда долларов. Такая внушительная сумма обусловлена стремительным ростом затрат на возведение газовых электростанций, которые за последние два года увеличились на 66%, согласно данным BloombergNEF.

    К моменту завершения строительства электростанций SB Energy и других аналогичных объектов они будут конкурировать за природный газ с экспортными рынками, что может привести к утроению цен на газ в некоторых регионах страны.

    Читайте также другие новости на нашем сайте: Главная страница

    Источник: techcrunch.com

  • Groq привлекла 350 миллионов долларов и меняет направление

    Groq привлекла 350 миллионов долларов и меняет направление

    Стартап Groq привлёк $350 миллионов, продолжая трансформироваться из производителя ИИ-чипов в компанию, предоставляющую услуги в сфере неоклауда с мощными графическими процессорами и сервисами ИИ-инфраструктуры.

    Новые капиталовложения под руководством инвестиционной фирмы Disruptive при запланированном участии Nvidia оценивают компанию в $3,5 миллиарда. Это меньше, чем $6,9 миллиарда, которыми оценивался Groq в сентябре прошлого года, за несколько месяцев до того, как Nvidia наняла основателя и генерального директора Groq Джонатана Росса и других ведущих специалистов в рамках сделки по лицензированию за $20 миллиардов, которую компания выплатила инвесторам.

    Представитель компании сообщил TechCrunch, что, несмотря на разницу в оценке, компания рассматривает это не как снижение, а как установление новой оценки для «версии Groq после сделки по лицензированию с Nvidia».

    Groq была сосредоточена на создании собственных чипов, получивших название LPUs (блоки обработки языка), чтобы конкурировать с Nvidia в области логического вывода — типа вычислений, необходимых для выполнения рабочих нагрузок ИИ в режиме реального времени. После потери своей звёздной команды Groq перешла из разряда чистых производителей ИИ-чипов в поставщиков облачных услуг и центров обработки данных, работающих на системах Nvidia.

    В июне Groq привлекла $650 миллионов для начала трансформации. Groq намерена увеличить мощность с 54 мегаватт до более чем 200 мегаватт в 2027 году.

    Сегодня Groq управляет 13 центрами обработки данных в Северной Америке, Европе, на Ближнем Востоке и в Азиатско-Тихоокеанском регионе, обслуживая более 6 миллионов разработчиков, предприятий и компаний, специализирующихся на искусственном интеллекте. Groq заявляет, что новые средства будут поддерживать «тех, кто ищет использование кластеров Nvidia среднего и большого размера для обучения и логического вывода».

    «Мы превращаем Groq в ведущее в мире облако логического вывода ИИ», — заявил Алекс Дэвис, председатель правления Groq и генеральный директор Disruptive, в своём заявлении. «Логический вывод, без сомнения, станет крупнейшим и наиболее важным слоем ИИ-инфраструктуры».

    Пока вывод (inference) пользуется большим спросом, поскольку предприятия масштабируют рабочие нагрузки с использованием ИИ, остаётся открытым вопрос, будет ли неоклауды достаточно прибыльным бизнесом, чтобы обеспечить отдачу от значительных инвестиций в долгосрочной перспективе. CoreWeave сообщила о значительном росте выручки во втором квартале и недавно заключила крупные контракты, в том числе с Meta и Anthropic. Однако инвесторы по-прежнему обеспокоены высокими капитальными затратами компании, сильной зависимостью от долгов и подверженностью быстро обесценивающемуся оборудованию, а также её способностью превратить рост в свободный денежный поток.

    Финансовые показатели Groq пока остаются конфиденциальными, но её поворот ставит компанию непосредственно в экосистему инфраструктуры ИИ от Nvidia. Это не совсем уникальные отношения среди неоклаудов сегодня. Nvidia поставляет графические процессоры, обеспечивающие работу облаков от CoreWeave, Lambda и Nebius, одновременно инвестируя миллиарды в некоторые из этих компаний, поскольку они стремятся нарастить мощности.

    TechCrunch обратился к Groq за дополнительной информацией.

    Читайте также другие новости на нашем сайте: Главная страница

    Источник: techcrunch.com