{"id":25605,"date":"2026-08-15T08:02:35","date_gmt":"2026-08-15T08:02:35","guid":{"rendered":"https:\/\/shm.studio\/news\/writer-modello-ai-riduzione-costi-token-2026-2\/"},"modified":"2026-08-15T08:02:35","modified_gmt":"2026-08-15T08:02:35","slug":"writer-modello-ai-riduzione-costi-token-2026-2","status":"publish","type":"news","link":"https:\/\/shm.studio\/en\/news\/ai-model-writer-token-cost-reduction-2026-2\/","title":{"rendered":"Writer launches low-cost AI model to reduce tokens"},"content":{"rendered":"<h2>Cosa \u00e8 cambiato: il nuovo modello Writer e il harness aggiornato<\/h2>\n<p>Il 13 agosto 2026, Writer ha reso pubblica una doppia novit\u00e0. Da un lato, un nuovo modello AI ottimizzato per i costi di inferenza. Dall&#8217;altro, una versione aggiornata del proprio <em>harness<\/em>, ovvero il sistema di orchestrazione che controlla le chiamate al modello. Entrambe le novit\u00e0 puntano allo stesso obiettivo: ridurre il consumo di token senza sacrificare la qualit\u00e0 dell&#8217;output.<\/p>\n<p>Il nuovo modello \u00e8 costruito come variante post-training di <strong>GLM-5.2<\/strong>, il modello open source sviluppato da Z.ai. Pertanto, Writer non parte da zero. Lavora su una base gi\u00e0 consolidata, applicando tecniche di fine-tuning orientate ai task enterprise. Il risultato dichiarato \u00e8 un sistema <em>deployment-ready<\/em> at a significantly lower cost per token compared to high-end competitors.<\/p>\n<p>According to reports by <a href=\"https:\/\/techcrunch.com\/2026\/08\/13\/writer-introduces-new-ai-model-and-upgraded-harness-to-contain-token-costs\/\" target=\"_blank\" rel=\"noopener noreferrer\">TechCrunch<\/a>, l&#8217;aggiornamento dell&#8217;harness \u00e8 altrettanto rilevante. Infatti, gran parte del costo operativo di un sistema AI aziendale non dipende solo dal modello, ma da come vengono strutturate le richieste. Un harness pi\u00f9 efficiente riduce il <em>token overhead<\/em> in complex pipelines.<\/p>\n<h2>L&#8217;architettura della riduzione dei costi: post-training su GLM-5.2<\/h2>\n<p>Vale la pena soffermarsi sulla scelta tecnica di Writer. Costruire su GLM-5.2 di Z.ai significa sfruttare un modello open source gi\u00e0 allenato su larga scala. Tuttavia, il valore aggiunto di Writer sta nel post-training verticale. Questo processo adatta il modello ai casi d&#8217;uso specifici del marketing e della produzione di contenuti aziendali.<\/p>\n<p>Analogamente a quanto accade con altri modelli derivati da basi open source, il vantaggio economico \u00e8 strutturale. I costi di pre-training sono gi\u00e0 stati sostenuti dalla comunit\u00e0 open source. Writer li trasforma in valore commerciale attraverso specializzazione e ottimizzazione. Di conseguenza, il prezzo finale per il cliente enterprise risulta pi\u00f9 contenuto.<\/p>\n<p>In particolare, l&#8217;aggiornamento del harness introduce meccanismi di <em>token compression<\/em> e gestione intelligente del contesto. Questi elementi riducono il numero di token inviati al modello per ogni richiesta. Per le aziende che gestiscono volumi elevati di contenuti \u2014 come quelle che operano campagne multicanale \u2014 l&#8217;impatto economico \u00e8 diretto e misurabile.<\/p>\n<p>Chi vuole approfondire il tema dell&#8217;efficienza nei modelli linguistici pu\u00f2 consultare la ricerca di <a href=\"https:\/\/www.mckinsey.com\/capabilities\/quantumblack\/our-insights\/the-state-of-ai\" target=\"_blank\" rel=\"noopener noreferrer\">McKinsey on the AI market<\/a>, che evidenzia come la riduzione dei costi di inferenza sia oggi una delle priorit\u00e0 principali per l&#8217;adozione enterprise.<\/p>\n<h2>Immediate impact for Italian marketing teams<\/h2>\n<p>Per i responsabili marketing e digital delle PMI italiane, questa notizia ha implicazioni concrete. Molte aziende hanno sperimentato soluzioni AI per la produzione di contenuti negli ultimi due anni. Tuttavia, i costi token hanno spesso rappresentato un freno alla scalabilit\u00e0.<\/p>\n<p>Furthermore, the pipelines of <a href=\"https:\/\/shm.studio\/en\/servizi\/ai\/\">AI applied to marketing<\/a> richiedono spesso centinaia o migliaia di chiamate al modello al mese. In questo contesto, una riduzione anche del 30-40% del costo per token si traduce in budget liberato per altri investimenti. Quindi, la mossa di Writer non \u00e8 solo tecnica: \u00e8 una leva strategica per chi vuole scalare l&#8217;automazione dei contenuti.<\/p>\n<p>We of <a href=\"https:\/\/shm.studio\/en\/\">SHM Studio<\/a> we work daily on projects of <a href=\"https:\/\/shm.studio\/en\/servizi\/digital-marketing\/\">digital marketing<\/a> e <a href=\"https:\/\/shm.studio\/en\/servizi\/seo\/copywriting\/\">AI-assisted copywriting<\/a> per aziende italiane. Pertanto, monitoriamo con attenzione ogni evoluzione che incide sulla sostenibilit\u00e0 economica delle pipeline di contenuto automatizzato.<\/p>\n<h2>The construction site is still open: what Writer has not yet resolved<\/h2>\n<p>Nonostante ci\u00f2, \u00e8 opportuno mantenere una lettura critica. Writer opera in un mercato affollato, dove anche <a href=\"https:\/\/openai.com\" target=\"_blank\" rel=\"noopener noreferrer\">OpenAI<\/a> e Anthropic stanno comprimendo i prezzi dei propri modelli. La competizione sul costo token \u00e8 intensa e in rapida evoluzione.<\/p>\n<p>Inoltre, la qualit\u00e0 del post-training su GLM-5.2 dovr\u00e0 essere verificata su casi d&#8217;uso reali. Le dichiarazioni di performance dei vendor AI vanno sempre validate con benchmark indipendenti. In particolare, per task complessi come la generazione di contenuti multilingue o la gestione di brief creativi articolati, le differenze qualitative tra modelli restano significative.<\/p>\n<p>Altres\u00ec, l&#8217;ecosistema di integrazioni di Writer \u00e8 ancora meno maturo rispetto a player consolidati. Chi gestisce stack martech complessi dovr\u00e0 valutare attentamente la compatibilit\u00e0 con i propri strumenti di <a href=\"https:\/\/shm.studio\/en\/servizi\/digital-marketing\/google-ads-campaigns\/\">Google Ads campaign management<\/a> e <a href=\"https:\/\/shm.studio\/en\/servizi\/digital-marketing\/linkedin-campaigns\/\">LinkedIn Ads<\/a>.<\/p>\n<h2>What nobody is saying: the market is fragmenting<\/h2>\n<p>C&#8217;\u00e8 una lettura pi\u00f9 ampia che vale la pena fare. La mossa di Writer non \u00e8 isolata. Negli ultimi dodici mesi, il mercato dei modelli AI per uso enterprise si sta frammentando in modo significativo. Da un lato, i grandi modelli generalisti di OpenAI e Google. Dall&#8217;altro, una costellazione crescente di modelli specializzati, pi\u00f9 economici e verticali.<\/p>\n<p>Questo fenomeno \u00e8 coerente con quanto analizzato da <a href=\"https:\/\/www.gartner.com\/en\/articles\/what-is-generative-ai\" target=\"_blank\" rel=\"noopener noreferrer\">Gartner nel suo Hype Cycle per l&#8217;AI generativa<\/a>. La fase di disillusione sta cedendo il passo alla fase di produttivit\u00e0. Le aziende non cercano pi\u00f9 il modello pi\u00f9 potente in assoluto. Cercano il modello pi\u00f9 adeguato al loro caso d&#8217;uso, al prezzo pi\u00f9 sostenibile.<\/p>\n<p>Per questo motivo, soluzioni come quella di Writer trovano terreno fertile. I responsabili marketing non sono ingegneri AI. Vogliono strumenti che funzionino, che si integrino con i loro workflow e che non facciano esplodere il budget. Dunque, la competizione sul costo token \u00e8 destinata a intensificarsi nei prossimi trimestri.<\/p>\n<h2>What to do now: operational guidance for marketing managers<\/h2>\n<p>Prima di tutto, chi sta gi\u00e0 utilizzando Writer nella propria pipeline di contenuti dovrebbe verificare se l&#8217;aggiornamento del harness \u00e8 disponibile nel proprio piano. In molti casi, gli upgrade infrastrutturali vengono distribuiti automaticamente, ma \u00e8 opportuno controllare la documentazione ufficiale.<\/p>\n<p>In seguito, vale la pena condurre un audit dei costi token attuali. Molti team non hanno una visibilit\u00e0 precisa su quanto spendono per ogni tipo di task AI. Quindi, prima di valutare il nuovo modello di Writer, \u00e8 utile avere un benchmark di partenza.<\/p>\n<p>Infine, per chi sta valutando l&#8217;adozione di soluzioni AI per la produzione di contenuti, questo \u00e8 un momento favorevole. I prezzi scendono, la qualit\u00e0 migliora e l&#8217;offerta si diversifica. Noi di <a href=\"https:\/\/shm.studio\/en\/\">SHM Studio<\/a> supportiamo le aziende italiane nella valutazione e nell&#8217;implementazione di stack <a href=\"https:\/\/shm.studio\/en\/servizi\/ai\/\">AI for marketing<\/a>, from model selection to result measurement.<\/p>\n<p>Chi gestisce attivit\u00e0 di <a href=\"https:\/\/shm.studio\/en\/servizi\/seo\/\">SEO<\/a> o <a href=\"https:\/\/shm.studio\/en\/servizi\/web\/\">web development<\/a> con componenti AI pu\u00f2 trovare in queste evoluzioni un&#8217;opportunit\u00e0 concreta per ridurre i costi operativi e aumentare la scalabilit\u00e0 dei progetti. Per un confronto diretto sulle opzioni disponibili, il team di <a href=\"https:\/\/shm.studio\/en\/contacts\/\">SHM Studio \u00e8 disponibile per una consulenza<\/a>.<\/p>\n<h2>Outlook: where the AI marketing market is heading in 2027<\/h2>\n<p>Guardando ai prossimi dodici-diciotto mesi, la direzione sembra chiara. I modelli AI per uso enterprise diventeranno sempre pi\u00f9 accessibili economicamente. Tuttavia, il vantaggio competitivo si sposter\u00e0 dall&#8217;accesso al modello alla qualit\u00e0 dell&#8217;orchestrazione e dell&#8217;integrazione con i dati aziendali.<\/p>\n<p>Inoltre, la pressione sui costi token spinger\u00e0 verso architetture ibride, dove modelli leggeri gestiscono i task ripetitivi e modelli pi\u00f9 potenti vengono riservati ai task ad alto valore. Questo approccio \u00e8 gi\u00e0 visibile nelle strategie dei vendor pi\u00f9 avanzati. Di conseguenza, competenze come il <em>Prompt engineering<\/em> e la gestione dei workflow AI diventeranno sempre pi\u00f9 strategiche per i team marketing.<\/p>\n<p>To deepen one's skills on these topics, the <a href=\"https:\/\/shm.studio\/en\/blog\/\">SHM Studio Blog<\/a> pubblica regolarmente analisi e aggiornamenti sul mercato AI applicato al marketing digitale italiano. In sintesi, il momento per strutturare una strategia AI sostenibile \u00e8 adesso \u2014 non quando i prezzi saranno gi\u00e0 stabilizzati e il vantaggio del first mover sar\u00e0 svanito.<\/p>","protected":false},"excerpt":{"rendered":"<p>Writer presents a new AI model optimized for token costs, based on GLM-5.2. Here is what changes for the martech campaigns of Italian SMEs.<\/p>","protected":false},"author":7,"featured_media":25603,"template":"","meta":{"_acf_changed":false,"footnotes":""},"tags":[],"news-category":[162],"class_list":["post-25605","news","type-news","status-publish","has-post-thumbnail","hentry","news-category-ai","entry"],"acf":{"tldr_content":"<p>Writer ha annunciato un nuovo modello AI pensato per contenere i costi di inferenza. Il sistema \u00e8 costruito come variante post-training del modello open source GLM-5.2 di Z.ai. Pertanto, promette capacit\u00e0 pronte alla produzione a un prezzo significativamente inferiore rispetto alle soluzioni enterprise tradizionali.<\/p><p>Inoltre, Writer ha aggiornato il proprio <em>harness<\/em> di orchestrazione, lo strato tecnico che gestisce le chiamate al modello. Questo intervento mira a ottimizzare il numero di token consumati per ogni task. Di conseguenza, i team marketing possono aspettarsi una riduzione concreta dei costi operativi nelle pipeline di contenuto automatizzato.<\/p><p>In sintesi, per i responsabili marketing e digital delle PMI italiane si apre una finestra interessante. Noi di <strong>SHM Studio<\/strong> monitoriamo questa evoluzione con attenzione, perch\u00e9 l'accessibilit\u00e0 economica dei modelli AI incide direttamente sulla sostenibilit\u00e0 delle campagne martech. Infine, la mossa di Writer consolida un trend chiaro: il mercato si sta spostando verso modelli specializzati ed economicamente efficienti, lontano dai grandi LLM generalisti ad alto costo.<\/p>"},"yoast_head":"<!-- This site is optimized with the Yoast SEO plugin v28.2 - https:\/\/yoast.com\/product\/yoast-seo-wordpress\/ -->\n<title>Writer lancia modello AI low-cost per ridurre i token<\/title>\n<meta name=\"description\" content=\"Writer presenta un nuovo modello AI ottimizzato sui costi token, basato su GLM-5.2. Ecco cosa cambia per le campagne martech delle PMI italiane.\" \/>\n<meta name=\"robots\" content=\"index, follow, max-snippet:-1, max-image-preview:large, max-video-preview:-1\" \/>\n<link rel=\"canonical\" href=\"https:\/\/shm.studio\/en\/news\/ai-model-writer-token-cost-reduction-2026-2\/\" \/>\n<meta property=\"og:locale\" content=\"en_US\" \/>\n<meta property=\"og:type\" content=\"article\" \/>\n<meta property=\"og:title\" content=\"Writer lancia modello AI low-cost per ridurre i token\" \/>\n<meta property=\"og:description\" content=\"Writer presenta un nuovo modello AI ottimizzato sui costi token, basato su GLM-5.2. Ecco cosa cambia per le campagne martech delle PMI italiane.\" \/>\n<meta property=\"og:url\" content=\"https:\/\/shm.studio\/en\/news\/ai-model-writer-token-cost-reduction-2026-2\/\" \/>\n<meta property=\"og:site_name\" content=\"SHM Studio\" \/>\n<meta name=\"twitter:card\" content=\"summary_large_image\" \/>\n<meta name=\"twitter:label1\" content=\"Est. reading time\" \/>\n\t<meta name=\"twitter:data1\" content=\"6 minutes\" \/>\n<!-- \/ Yoast SEO plugin. -->","yoast_head_json":{"title":"Writer launches low-cost AI model to reduce tokens","description":"Writer presents a new AI model optimized for token costs, based on GLM-5.2. Here is what changes for the martech campaigns of Italian SMEs.","robots":{"index":"index","follow":"follow","max-snippet":"max-snippet:-1","max-image-preview":"max-image-preview:large","max-video-preview":"max-video-preview:-1"},"canonical":"https:\/\/shm.studio\/en\/news\/ai-model-writer-token-cost-reduction-2026-2\/","og_locale":"en_US","og_type":"article","og_title":"Writer lancia modello AI low-cost per ridurre i token","og_description":"Writer presenta un nuovo modello AI ottimizzato sui costi token, basato su GLM-5.2. Ecco cosa cambia per le campagne martech delle PMI italiane.","og_url":"https:\/\/shm.studio\/en\/news\/ai-model-writer-token-cost-reduction-2026-2\/","og_site_name":"SHM Studio","twitter_card":"summary_large_image","twitter_misc":{"Est. reading time":"6 minutes"},"schema":{"@context":"https:\/\/schema.org","@graph":[{"@type":"WebPage","@id":"https:\/\/shm.studio\/news\/writer-modello-ai-riduzione-costi-token-2026-2\/","url":"https:\/\/shm.studio\/news\/writer-modello-ai-riduzione-costi-token-2026-2\/","name":"Writer launches low-cost AI model to reduce tokens","isPartOf":{"@id":"https:\/\/shm.studio\/#website"},"primaryImageOfPage":{"@id":"https:\/\/shm.studio\/news\/writer-modello-ai-riduzione-costi-token-2026-2\/#primaryimage"},"image":{"@id":"https:\/\/shm.studio\/news\/writer-modello-ai-riduzione-costi-token-2026-2\/#primaryimage"},"thumbnailUrl":"https:\/\/shm.studio\/wp-content\/uploads\/2026\/08\/modello-ai-riduzione-costi-token-writer-2026.jpg","datePublished":"2026-08-15T08:02:35+00:00","description":"Writer presents a new AI model optimized for token costs, based on GLM-5.2. Here is what changes for the martech campaigns of Italian SMEs.","breadcrumb":{"@id":"https:\/\/shm.studio\/news\/writer-modello-ai-riduzione-costi-token-2026-2\/#breadcrumb"},"inLanguage":"en-US","potentialAction":[{"@type":"ReadAction","target":["https:\/\/shm.studio\/news\/writer-modello-ai-riduzione-costi-token-2026-2\/"]}]},{"@type":"ImageObject","inLanguage":"en-US","@id":"https:\/\/shm.studio\/news\/writer-modello-ai-riduzione-costi-token-2026-2\/#primaryimage","url":"https:\/\/shm.studio\/wp-content\/uploads\/2026\/08\/modello-ai-riduzione-costi-token-writer-2026.jpg","contentUrl":"https:\/\/shm.studio\/wp-content\/uploads\/2026\/08\/modello-ai-riduzione-costi-token-writer-2026.jpg","width":1536,"height":1024,"caption":"Writer ottimizza i costi token con GLM-5.2: opportunit\u00e0 per il martech italiano"},{"@type":"BreadcrumbList","@id":"https:\/\/shm.studio\/news\/writer-modello-ai-riduzione-costi-token-2026-2\/#breadcrumb","itemListElement":[{"@type":"ListItem","position":1,"name":"Home","item":"https:\/\/shm.studio\/"},{"@type":"ListItem","position":2,"name":"News","item":"https:\/\/shm.studio\/news\/"},{"@type":"ListItem","position":3,"name":"Writer lancia modello AI low-cost per ridurre i token"}]},{"@type":"WebSite","@id":"https:\/\/shm.studio\/#website","url":"https:\/\/shm.studio\/","name":"SHM Studio","description":"Your digital partner","publisher":{"@id":"https:\/\/shm.studio\/#organization"},"potentialAction":[{"@type":"SearchAction","target":{"@type":"EntryPoint","urlTemplate":"https:\/\/shm.studio\/?s={search_term_string}"},"query-input":{"@type":"PropertyValueSpecification","valueRequired":true,"valueName":"search_term_string"}}],"inLanguage":"en-US"},{"@type":"Organization","@id":"https:\/\/shm.studio\/#organization","name":"SHM Studio","url":"https:\/\/shm.studio\/","logo":{"@type":"ImageObject","inLanguage":"en-US","@id":"https:\/\/shm.studio\/#\/schema\/logo\/image\/","url":"https:\/\/shm.studio\/wp-content\/uploads\/2026\/06\/shmlogotipo.svg","contentUrl":"https:\/\/shm.studio\/wp-content\/uploads\/2026\/06\/shmlogotipo.svg","caption":"SHM Studio"},"image":{"@id":"https:\/\/shm.studio\/#\/schema\/logo\/image\/"}}]}},"_links":{"self":[{"href":"https:\/\/shm.studio\/en\/wp-json\/wp\/v2\/news\/25605","targetHints":{"allow":["GET"]}}],"collection":[{"href":"https:\/\/shm.studio\/en\/wp-json\/wp\/v2\/news"}],"about":[{"href":"https:\/\/shm.studio\/en\/wp-json\/wp\/v2\/types\/news"}],"author":[{"embeddable":true,"href":"https:\/\/shm.studio\/en\/wp-json\/wp\/v2\/users\/7"}],"version-history":[{"count":0,"href":"https:\/\/shm.studio\/en\/wp-json\/wp\/v2\/news\/25605\/revisions"}],"wp:featuredmedia":[{"embeddable":true,"href":"https:\/\/shm.studio\/en\/wp-json\/wp\/v2\/media\/25603"}],"wp:attachment":[{"href":"https:\/\/shm.studio\/en\/wp-json\/wp\/v2\/media?parent=25605"}],"wp:term":[{"taxonomy":"post_tag","embeddable":true,"href":"https:\/\/shm.studio\/en\/wp-json\/wp\/v2\/tags?post=25605"},{"taxonomy":"news-category","embeddable":true,"href":"https:\/\/shm.studio\/en\/wp-json\/wp\/v2\/news-category?post=25605"}],"curies":[{"name":"wp","href":"https:\/\/api.w.org\/{rel}","templated":true}]}}