К содержанию
Новости

d-Matrix: рынок AI-инференса разделяется на два сегмента с разной экономикой

Инфографика: 10 раз больше за миллион токенов
Графика: hegai.media

Глава d-Matrix Сид Шет считает, что рынок AI-чипов начинает разделяться на два отдельных сегмента, хотя со стороны всё ещё кажется, что в нём доминирует NVIDIA. По его словам, быстрее всего сейчас растёт направление AI-инференса, где главную роль играют интерактивность и мгновенный отклик. В такой модели пользователи готовы платить в 10 раз больше за миллион токенов, а ограничения пропускной способности памяти в GPU-системах становятся структурным барьером для части задач.

Как сообщает Eye on AI (Craig Smith podcast), Шет называет этот подход «premium token economy». Он считает, что специализированные архитектуры могут быть лучше адаптированы к таким нагрузкам, чем традиционные GPU-платформы. По его оценке, именно этот сегмент сейчас расширяется особенно быстро.

Шет также рассказал, что использует Claude для обсуждения M&A-стратегии. По его словам, модель способна за 15 минут подготовить полноценный план интеграции, хотя раньше для таких задач требовалось участие банковских консультантов. Он добавил, что AI постепенно перестаёт быть инструментом, который просто повторяет идеи пользователя. Теперь системы всё чаще могут спорить, указывать на упущения и давать обратную связь с достаточной уверенностью, чтобы это приносило практическую пользу.

Отдельно глава d-Matrix описал переход от индивидуальных AI-агентов к тому, что он называет «organizational AI». Речь идёт о системах из нескольких агентов, способных управлять целыми функциями компании на высоком уровне абстракции.

Ключевые факты

  • Сид Шет заявил, что пользователи готовы платить в 10 раз больше за миллион токенов ради мгновенных ответов.

  • Глава d-Matrix связал ограничения GPU-систем с пропускной способностью памяти.

  • По словам Шета, Claude подготовил полный план интеграции для M&A-задачи за 15 минут.

  • В d-Matrix ожидают переход от индивидуальных AI-агентов к «organizational AI», группам агентов для управления функциями компании.

Вопросы и ответы

Почему d-Matrix считает, что рынок AI-инференса начинает отделяться от классического GPU-рынка?

Сид Шет говорит, что в интерактивных AI-сценариях пользователи готовы платить в 10 раз больше за миллион токенов ради мгновенного отклика. При этом узким местом GPU-систем становится пропускная способность памяти, из-за чего специализированные архитектуры могут оказаться выгоднее под такие нагрузки.

Что меняется на практике для корпоративного использования AI, а не только для отдельных сотрудников?

По оценке d-Matrix, рынок движется от индивидуальных AI-агентов к «organizational AI»: группам агентов, которые смогут управлять целыми функциями компании на высоком уровне абстракции, а не выполнять одиночные запросы пользователя.

Какой пример реальной управленческой задачи AI уже способен закрывать быстрее консультантов?

Шет рассказал, что Claude подготовил полный план интеграции для M&A-сделки за 15 минут. Ранее задачи такого типа обычно требовали участия инвестиционных банковских консультантов.

Контекст по теме