El panorama dels models d’intel·ligència artificial de codi obert ha fet un gir significatiu amb l’arribada d’Inkling, el model més gran mai creat per una empresa nord-americana fora dels gegants asiàtics. Presentat per Thinking Machines Lab, la startup fundada per l’ex CTO d’OpenAI, Mira Murati, aquest model de 975 mil milions de paràmetres promet redefinir el que les empreses poden aconseguir amb IA oberta. Amb una llicència Apache 2.0, Inkling no només està disponible per a la seva descàrrega i ús, sinó que també permet una personalització profunda, convertint-lo en una eina clau per a desenvolupadors que busquen crear aplicacions a mida amb capacitats de raonament avançades.
El model utilitza una arquitectura de mescla d’experts (MoE) amb 256 experts encaminats i dos de compartits, activant al voltant de 41 mil milions de paràmetres per token generat. Això permet que, malgrat la seva mida massiva, Inkling ofereixi un rendiment competitiu en maquinari modern, com les GPU NVIDIA B300 o H200. Thinking Machines ha entrenat el model des de zero utilitzant 45 bilions de tokens de text, imatges, àudio i vídeo, executant-se sobre sistemes NVIDIA GB300 NVL72. La companyia afirma que Inkling iguala o supera models com DeepSeek V4 o Nemotron 3 Ultra en benchmarks com Terminal Bench 2.1, tot i que amb un ús més eficient de tokens de pensament, reduint costos operatius per a les empreses.
Una de les característiques més destacades d’Inkling és la seva capacitat per gestionar contextos de fins a un milió de tokens, equivalent a una memòria a curt termini excepcional. Això el fa ideal per a tasques complexes com la gestió de grans bases de codi, cerques d’agulla en un paller o anàlisi de documents extensos. A més, en ser un model de raonament entrenat amb aprenentatge per reforç, pot 'pensar' abans de respondre, reduint al·lucinacions i millorant la precisió en tasques que requereixen lògica. Per a les empreses que busquen integrar aquestes capacitats en els seus fluxos de treball, comptar amb socis tecnològics com Q2BSTUDIO pot marcar la diferència: la seva experiència en intel·ligència artificial, ciberseguretat i cloud AWS/Azure permet a les organitzacions adaptar models com Inkling a les seves necessitats específiques, ja sigui per a assistents virtuals, automatització de processos o anàlisi predictiva.
La flexibilitat d’Inkling s’estén al seu ecosistema d’eines. A través de la plataforma Tinker de Thinking Machines, els desenvolupadors poden afinar el model amb scripts generats per la mateixa IA, accelerant la personalització. Això és particularment útil per a empreses que requereixen automatització de processos o solucions de Business Intelligence potenciades per IA. Per exemple, un equip de BI que utilitzi Power BI podria integrar Inkling per generar consultes en llenguatge natural i descobrir patrons ocults a les dades, mentre que el departament de ciberseguretat podria emprar-lo per analitzar logs i detectar amenaces en temps real. La capacitat del model per escriure els seus propis scripts d’ajust fi el converteix en una opció atractiva per a desenvolupadors que busquen reduir el temps d’implementació.
Inkling no només competeix en mida, sinó també en eficiència. Thinking Machines afirma que, per a tasques de raonament, el model utilitza aproximadament un terç dels tokens que necessitaria Nemotron 3 Ultra per aconseguir resultats equivalents. Això es tradueix en menors costos d’API per als usuaris finals, un factor crític en projectes empresarials on el pressupost d’inferència pot disparar-se. La companyia també ha llançat una versió quantitzada NVFP4 que redueix els requisits de memòria a la meitat, permetent executar el model en configuracions més modestes sense sacrificar massa qualitat. Per a empreses que encara no han migrat completament al núvol, Q2BSTUDIO ofereix serveis de cloud AWS/Azure que faciliten el desplegament de models a gran escala, garantint escalabilitat i seguretat.
Juntament amb Inkling, Thinking Machines ha presentat una vista prèvia d’Inkling-Small, un model de 276 mil milions de paràmetres amb 12 mil milions actius, dissenyat per a aplicacions on la latència és prioritària. Tot i que encara no està disponible públicament, la seva existència indica una estratègia clara: cobrir des de càrregues de treball intensives fins a respostes en temps real. Aquest enfocament recorda la tendència de crear agents d’IA especialitzats, un camp on la personalització és clau. Les empreses que desitgin explorar aquest camí poden beneficiar-se del coneixement de Q2BSTUDIO en el desenvolupament de programari a mida, integrant models d’IA amb sistemes existents per crear fluxos de treball intel·ligents.
L’arribada d’Inkling marca una fita en la democratització de la IA avançada. En oferir un model de primer nivell sota una llicència permissiva, Thinking Machines Lab obre la porta a que startups, pimes i grans corporacions competeixin en el terreny de la intel·ligència artificial sense dependre de proveïdors tancats. No obstant, el veritable avantatge no es troba només en el model, sinó en com s’implementa. Aquí és on serveis com els de Q2BSTUDIO resulten essencials: des de la consultoria en IA fins a la integració amb eines de BI/Power BI o l’adopció de mesures de ciberseguretat, l’experiència adequada pot convertir un model genèric en una solució empresarial única. Amb Inkling, el futur de la IA oberta sembla més prometedor que mai, i les empreses que actuïn ràpid estaran millor posicionades per aprofitar les seves capacitats.



