Des que els models de llenguatge de gran escala (LLMs) van començar a demostrar habilitats sorprenents en tasques de programació, la comunitat tecnològica es va preguntar si algun dia podrien competir en igualtat de condicions amb els millors programadors humans. Els concursos de programació competitiva, i en particular les Olimpíades d'Informàtica, representen l'escenari més exigent: problemes complexos, temps limitat i avaluacions rigoroses. En aquest context neix LiveOIBench, un benchmark que promet mesurar amb precisió fins on arriben realment les intel·ligències artificials en aquest terreny. Però, estan les IA a punt de superar els humans? La resposta, segons els primers resultats, és més matisada del que sembla.
LiveOIBench es compon de 403 problemes seleccionats per experts, extrets de 72 competicions reals d'Olimpíades d'Informàtica celebrades entre 2023 i 2025. Cada problema inclou una mitjana de 60 casos de prova oficials, cosa que garanteix una cobertura molt més àmplia que altres benchmarks existents. A més, el sistema és completament offline i reproducible, evitant la dependència d'APIs externes i reduint el risc de contaminació de dades. Aquesta aproximació permet comparar directament els models d'IA amb els participants humans d'elit, establint percentils que revelen la distància real que encara existeix.
Els resultats inicials mostren que el model GPT-5 assoleix el percentil 81,76, una xifra impressionant però encara per sota dels millors competidors humans. Al costat dels models de codi obert, GPT-OSS-120B es queda al percentil 60, cosa que indica que la bretxa és especialment notable en absència d'optimitzacions propietàries. Una anàlisi detallada dels raonaments generats per les IA revela que els models més robustos prioritzen una anàlisi precisa del problema sobre una exploració excessiva de solucions. És a dir, la qualitat del raonament és més important que la quantitat d'intents.
Des d'una perspectiva empresarial, aquestes troballes tenen implicacions directes. A Q2BSTUDIO, empresa especialitzada en desenvolupament de programari i tecnologia, sabem que la intel·ligència artificial no només es mesura en competicions, sinó en la seva capacitat per integrar-se en processos reals de negoci. La capacitat d'un model per resoldre problemes algorítmics complexos és un indicador del seu potencial en tasques com l'optimització de codi, la detecció d'errors o fins i tot la generació d'arquitectures de programari. No obstant, la distància amb els humans suggereix que, de moment, la IA és una eina complementària, no un substitut.
Per a les empreses que busquen aplicacions a mida, la lliçó és clara: els models actuals poden assistir en tasques repetitives o en la generació de prototips, però la supervisió humana continua sent indispensable. En l'àmbit de la ciberseguretat, per exemple, un model que falla en un problema d'Olimpíada pot passar per alt vulnerabilitats crítiques. Per això, des de Q2BSTUDIO oferim serveis de ciberseguretat que combinen la potència de la IA amb l'experiència d'analistes humans, garantint una defensa robusta.
Un altre aspecte rellevant és el núvol. Els benchmarks com LiveOIBench requereixen una infraestructura escalable i reproducible. A Q2BSTUDIO treballem amb cloud AWS/Azure per desplegar models d'IA de forma eficient, assegurant que els resultats siguin fiables i replicables. La capacitat d'executar avaluacions offline, com proposa LiveOIBench, encaixa perfectament amb entorns cloud privats on la seguretat i el control són prioritaris.
En el camp de la intel·ligència artificial aplicada al negoci, la comprensió dels raonaments dels models és clau. Les anàlisis de LiveOIBench mostren que els models que 'pensen' més abans de respondre obtenen millors resultats. Això recorda els sistemes d'agents IA que dissenyem a Q2BSTUDIO, on els agents no només executen tasques, sinó que planifiquen i verifiquen cada pas. La integració de Business Intelligence (BI) i Power BI permet visualitzar aquests processos i prendre decisions basades en dades.
L'automatització de processos és un altre camp on aquests benchmarks tenen impacte. Un model que resol problemes complexos de programació pot aplicar-se per automatitzar fluxos de treball en empreses, reduint costos i errors. A Q2BSTUDIO ajudem les organitzacions a implementar automatitzacions personalitzades, adaptant solucions d'IA a les seves necessitats específiques, ja sigui en entorns on-premise o al núvol.
Tornant a la pregunta inicial: súperen les IA als humans en Olimpíades d'Informàtica? L'evidència de LiveOIBench suggereix que encara no, però la bretxa s'estreny ràpidament. La clau és la qualitat del raonament i la capacitat dels models per aprendre de problemes mai vistos, cosa que els humans fan de forma natural però que les IA encara dominen de manera limitada. Per a les empreses tecnològiques, aquest benchmark és un termòmetre que indica cap a on dirigir la inversió en R+D.
A Q2BSTUDIO seguim de prop aquests avenços. El nostre equip integra les últimes innovacions en IA, núvol i ciberseguretat per oferir solucions que no només resolen problemes, sinó que anticipen els propers reptes. Ja sigui desenvolupant agents IA personalitzats o implantant sistemes de BI amb Power BI, la nostra meta és transformar la tecnologia en valor real per a les empreses.
LiveOIBench és només un exemple de com mesurar el progrés. Però la veritable competició no és en un rànquing, sinó en com apliquem aquests coneixements per millorar processos, protegir dades i crear programari que marqui la diferència. I en això, la col·laboració entre humans i màquines segueix sent l'estratègia guanyadora.





