Писатель делает ставку на более дешевых ИИ-агентов с Palmyra X6 и более легким обвесом.

Писатель делает ставку на более дешевых ИИ-агентов с Palmyra X6 и более легким обвесом.

      Компания Writer, занимающаяся искусственным интеллектом для бизнеса, запустила Palmyra X6, свою новую флагманскую модель, наряду с обновленным «ремнем», созданным для того, чтобы сделать то, что отрасль с любопытством уклонялась от обещания: тратить меньше токенов.

      Модель является пост-тренировочной вариацией на основе открытого кода GLM-5.2 от Z.ai и доступна клиентам Writer с сегодняшнего дня.

      Предложение появляется в нервный момент. Поскольку агентный ИИ тихо умножает шаги, а значит, и токены, за каждой задачей, счета предприятий начали щипать.

      Writer ставит на то, что backlash по затратам уже пришел, и она далеко не одна, улавливая эту возможность, поскольку Baseten привлекла 1,5 миллиарда долларов на теории о том, что прибыль ИИ заключается в дешевой инференции.

      Ремень, по словам Writer, является слоем оркестрации, обернутым вокруг модели, механизмом, который решает, как многошаговый агент фактически выполняет каждый запрос.

      Оптимизируйте этот слой, сократив избыточные вызовы и раздутое контекстное окружение, которое агенты, как правило, накапливают, и вы сократите потребление токенов, не касаясь самой модели.

      Сбережения, по словам Writer, значительны. Компания оценивает, что новая модель и ремень вместе сокращают затраты на целых 50% для базовых задач, в то время как исследовательская работа Writer показала, что изменения в эффективности ремня сами по себе сократили затраты примерно на 40% в среднем по тестированию.

      Что делает ремень интересным, так это то, что он не зависит от модели. Он работает с собственными моделями Writer, но также и с внешними, предоставляемыми через Microsoft Azure и Amazon Bedrock, так что приросты эффективности не привязаны к дорожной карте одного поставщика.

      «Ремень — это единственный компонент, эффективность которого умножается на каждую модель, которую использует организация, как настоящую, так и будущую», — пишут исследователи Writer, подчеркивая оркестрацию, а не качество самой модели, как рычаг, который предприятия игнорировали.

      Это также довольно резкое утверждение. Основное утверждение Writer заключается в том, что крупные лаборатории имеют мало стимулов помогать вам тратить меньше, потому что их доходы растут с каждым токеном, который вы сжигаете. Недоверие к этой схеме играет большую роль в сообщениях компании.

      Генеральный директор Мэй Хабиб выразила это прямо. «Предприятие абсолютно устало гоняться за следующей планкой», — сказала она. «Им нужно снижение затрат». Это аккуратное переворачивание обычного сценария продаж, в котором каждая новая модель быстрее, умнее и, неизменно, более жадная.

      Широкая тенденция к экономии, в которой покупатели выбирают более дешевые китайские модели, уже начала расшатывать оценки, лежащие в основе будущих IPO OpenAI и Anthropic, что является признаком того, что чувствительность к цене больше не является маргинальной проблемой.

      Строительство флагмана на основе GLM-5.2 говорит само за себя. Вместо того чтобы обучать передовую модель с нуля, Writer взяла способную открытую базу и специализирована ее через пост-тренировку, что позволяет снизить затраты и аккуратно соответствует экономной истории, которую она продает.

      Для европейских покупателей это должно показаться знакомым. Скептицизм по поводу стимулов американских гиперскейлеров и предпочтение архитектур, которые не зависят от одного поставщика, были постоянной темой с этой стороны Атлантики, и Writer нацеливается прямо на это.

      Есть предостережения, которые стоит иметь в виду. Показатели эффективности, предоставленные поставщиком о своем собственном продукте, заслуживают обычной доли скептицизма, и «до» 50% не то же самое, что гарантированные 50%, но направление движения трудно оспорить.

      Глубокий сдвиг — это то, что Writer называет инженерией ремня: дисциплина тратить меньше токенов на задачу, а не гоняться за еще одной точкой в рейтинге. Если это укоренится, и стимулы все больше указывают на то, что это произойдет, эпоха постоянно жадной модели, возможно, наконец, встретит свой бюджет.

Другие статьи

Goldman Sachs привлекает инвесторов к финансированию Nvidia в размере $500 млрд для вычислений на основе ИИ. Goldman Sachs привлекает инвесторов к финансированию Nvidia в размере $500 млрд для вычислений на основе ИИ. Goldman Sachs привлекает инвесторов к финансированию Nvidia на сумму 500 миллиардов долларов для ИИ-вычислений после того, как занял ведущую роль, и хочет превратить чипы в торгуемый актив, похожий на облигации. Goldman Sachs привлекает инвесторов к финансированию Nvidia в размере 500 миллиардов долларов на вычисления в области ИИ. Goldman Sachs привлекает инвесторов к финансированию Nvidia в размере 500 миллиардов долларов на вычисления в области ИИ. Goldman Sachs привлекает инвесторов к финансированию Nvidia на сумму $500 миллиардов для ИИ-вычислений после того, как занял ведущую роль, и хочет превратить чипы в торгуемый актив, похожий на облигации. Goldman Sachs привлекает инвесторов к финансированию Nvidia в размере $500 миллиардов на вычисления в области ИИ. Goldman Sachs привлекает инвесторов к финансированию Nvidia в размере $500 миллиардов на вычисления в области ИИ. Goldman Sachs привлекает инвесторов к финансированию Nvidia в размере 500 миллиардов долларов на вычисления в области ИИ после того, как занял ведущую роль, и хочет превратить чипы в торгуемый актив, похожий на облигации. Apple обучила свою собственную модель ИИ для Китая и передала мозг Alibaba. Apple обучила свою собственную модель ИИ для Китая и передала мозг Alibaba. Apple обучила крупную языковую модель, предназначенную только для Китая, с помощью Alibaba, став первой иностранной компанией, получившей разрешение на предложение собственного ИИ-модели на материковом Китае. Новый ультрабыстрый режим OpenAI работает на GPT-5.6 Sol в 14 раз быстрее на чипах Cerebras. Новый ультрабыстрый режим OpenAI работает на GPT-5.6 Sol в 14 раз быстрее на чипах Cerebras. OpenAI представила Ultrafast, уровень API, который работает на GPT-5.6 Sol с максимальной скоростью до 14 раз на оборудовании Cerebras, делая ставку на то, что задержка, а не только интеллект, делает ИИ-агентов удобными для использования. Apple обучила свою собственную модель ИИ для Китая и передала мозг Alibaba. Apple обучила свою собственную модель ИИ для Китая и передала мозг Alibaba. Apple обучила языковую модель, предназначенную только для Китая, с помощью Alibaba, став первой иностранной компанией, получившей разрешение на предложение собственного ИИ-модели на материковом Китае.

Писатель делает ставку на более дешевых ИИ-агентов с Palmyra X6 и более легким обвесом.

Компания Writer запустила Palmyra X6 и обновленный комплект, который, по ее словам, может сократить затраты на AI-агентов до 50%, делая ставку на то, что backlash по затратам для предприятий уже наступил.