Усе эканомяць на ШІ: кампаніі пераходзяць да «мадэльмаксінгу»
Кампаніі пераходзяць ад бязлімітнага выкарыстання ШІ да больш дакладнага выбару мадэляў. Цяпер у модзе «мадэльмаксінг»: складаныя задачы аддаюць дарагім флагманам, а для руціны выкарыстоўваюць кампактныя, старыя або open-source-мадэлі.
Кампаніі пераходзяць ад бязлімітнага выкарыстання ШІ да больш дакладнага выбару мадэляў. Цяпер у модзе «мадэльмаксінг»: складаныя задачы аддаюць дарагім флагманам, а для руціны выкарыстоўваюць кампактныя, старыя або open-source-мадэлі.
Тэхнічны дырэктар ШІ-стартапа Bold Metrics Морган Лінтан расказаў Business Insider, што двойчы на тыдзень тлумачыць камандзе з 16 інжынераў, якую мадэль варта выкарыстоўваць для розных задач. Адной групе ён раіць Claude Fable у рэжыме low, другой — GPT-5.5 у рэжыме high, трэцяя працуе ў Cursor з Composer 2.5. «Мая каманда карыстаецца найлепшымі інструментамі, але робіць гэта значна эфектыўней», — кажа Лінтан.
Такі падыход дазваляе не ўводзіць жорсткія ліміты на токены. Замест гэтага супрацоўнікі атрымліваюць рэкамендацыю: калі сапраўды патрэбна дарагая мадэль з максімальным узроўнем развагі, а калі дастаткова больш таннай альтэрнатывы.
Генеральны дырэктар Coinbase Браян Армстранг яшчэ ў чэрвені выказаў меркаванне, што ў бліжэйшыя 12–18 месяцаў каля 80% задач будуць выконваць мадэлі, якія апынуцца на 99% танней за цяперашнія перадавыя сістэмы. Самыя дарагія мадэлі, паводле яго, застануцца для астатніх 20% задач, дзе патрабуецца максімальны ўзровень інтэлектуальных магчымасцей.
Суснавальнік стартапа Hechura Крыс Макані прытрымліваецца падобнай логікі. Ён не падтрымлівае ідэю кругласутачных аўтаномных агентаў, якія працягваюць пісаць код уначы без кантролю чалавека. Пры працы з агентам OpenClaw ён спачатку выкарыстоўваў недарагія мадэлі Gemini, а потым пераключыўся на Claude Haiku. «Я не баюся спрабаваць больш танныя мадэлі і правяраць, ці хапае іх інтэлекту для патрэбнай задачы», — сказаў Макані.
Разраб навучыўся «хаваць» прампты ў PNG і эканоміць да 70% токенаў
Дызайнер карыстальніцкага вопыту Танві Пісал расказала, што спачатку «патраціла месяцы токенаў», спрабуючы з нуля прадумваць UX у Claude. Цяпер яна спачатку стварае дызайн у Figma, потым перадае мадэлі скрыншоты і просіць захаваць інтэрфейс, але пабудаваць логіку і карыстальніцкія сцэнары.
«Працэс, у якім спачатку ствараецца дызайн, сапраўды дапамагае мне эканоміць токены», — патлумачыла Пісал. Для брэйнштормінгу яна выкарыстоўвае карпаратыўны ChatGPT, а больш прапрацаваныя ідэі пераносіць у Claude, каб атрымаць структураваныя дакументы.
Каб не прымушаць супрацоўнікаў уручную выбіраць мадэлі, кампаніі ўсё часцей выкарыстоўваюць model routing — сервісы, якія самі ацэньваюць складанасць запыту і накіроўваюць яго ў адпаведную мадэль. Такія платформы могуць пераключаць частку задач на больш танныя або адкрытыя мадэлі, не адпраўляючы кожны запыт у Claude або GPT.
Кіраўнік стартапа Rayline Дэвід Гілмар кажа, што многія кампаніі спачатку паддаюцца страху прапусціць выгаду і выкарыстоўваюць самыя дарагія мадэлі паўсюль, а потым атрымліваюць рахунак за API і пачынаюць шукаць спосабы скараціць выдаткі. Паводле дадзеных галоўнага эканаміста Ramp Ары Хараз’яна, доля кампаній, якія выкарыстоўваюць маршрутызацыю запытаў паміж мадэлямі, вырасла прыкладна з 1% летась да 5% сёлета.
Эканаміст Дэн Арыэлі звязвае імкненне «спаліць» адведзеныя токены з псіхалогіяй дэфіцыту. Ён параўнаў ліміты на ШІ з тарыфамі мабільнай сувязі, калі карыстальнікі імкнуліся выкарыстаць усе ўключаныя хвіліны да канца месяца, нават без рэальнай неабходнасці. «Токены ствараюць мадэль дэфіцыту: людзі разумеюць, што не могуць карыстацца ШІ столькі, колькі хочуць, і пачынаюць успрымаць ліміт як мэту», — патлумачыў навуковец.
Рэлацыраваліся? Цяпер вы можаце каментаваць без верыфікацыі акаўнта.