EN
Cinemap
Tech & Research

Cinemap

Anàlisi de dades del cinema espanyol

Una dècada de cinema espanyol en una sola pantalla

Artefacto · Cine Español és una plataforma de recerca desenvolupada per Artefacto Films. Reuneix en una sola interfície les dades públiques del cinema espanyol estrenat entre el 2016 i el 2025 i les converteix en visualitzacions interactives que permeten respondre preguntes concretes sobre el sector. Qui treballa amb qui. De què van realment les pel·lícules. Com es veuen els cartells. Què premien els Goya. Quants diners públics reben cada projecte i de quina convocatòria.

El punt de partida és una constatació senzilla. Les dades existeixen i són públiques, però viuen disperses en butlletins oficials, catàlegs institucionals i portals de fitxes tècniques. La plataforma els ajunta, els neteja i els fa consultables en segons.

Què hi ha dins

El corpus reuneix 1.652 pel·lícules i prop de 4.700 persones indexades amb 13 oficis diferents. Les fonts principals són aquestes.

  • La taquilla oficial de l’ICAA, amb el Top 100 de cada any entre el 2016 i el 2025, ampliada amb la taquilla internacional de Comscore.
  • Pel·lícules espanyoles estreades directament a les plataformes de streaming, fora del circuit teatral.
  • El palmarès complet dels Premis Goya al llarg de 12 edicions i la presència espanyola al Festival de Cannes entre 2016 i 2026.
  • Els ajuts públics al cinema des de tres convocatòries oficials (ICAA per a llargmetratges i curtmetratges i ICEC per a coproducció minoritària), amb més de 3.280 projectes i uns 395 M€ traçats.
  • Les fitxes tècniques oficials, les metadades de TMDB i les puntuacions de portals externs com FilmAffinity o IMDb.

Què permet fer

Explorar la taquilla. Taules i gràfics amb filtres per any, gènere, mercat o plataforma, i una xarxa de col·laboració que dibuixa el graf de les persones que han treballat juntes, amb més de 4.600 col·laboracions detectades.

Veure el cinema com a mapa. Més de 1.400 cartells organitzats en un pla bidimensional on la proximitat significa semblant. Hi ha dos mapes complementaris. En un, les pel·lícules s’agrupen pel seu ADN narratiu, calculat a partir de les sinopsis. A l’altre els cartells s’agrupen per la semblança visual, i també es poden buscar per color dominant.

Preguntar amb llenguatge natural. La funció «A què s’assembla?» accepta una sinopsi inventada o una idea escrita en text lliure i torna les pel·lícules del corpus més afins, amb una explicació de en què s’assemblen cadascuna.

Llegir el fons del corpus. Una secció de troballes sintetitza patrons agregats, com els arquetips narratius del tipus «Una X que I» extrets de cada sinopsi. El més freqüent de la dècada és el retrat íntim d’una figura de l’art o la cultura, amb més d’un centenar de pel·lícules.

Estimar una ajuda pública. Un simulador calcula limport probable d’una subvenció segons el pressupost del projecte, usant la distribució històrica real de cada convocatòria.

Consulteu fitxes individuals. Cada persona i cada pel·lícula tenen fitxa pròpia, amb filmografia, premis, ajuts rebuts, plataformes de disponibilitat i pel·lícules similars.

A més hi ha una trivialitats de 526 preguntes generades a partir del corpus complet.

Com funciona per dins

La plataforma està pensada per ser ràpida i fàcil de mantenir. Gairebé tota la informació està calculada per endavant i guardada en fitxers lleugers, així que la web carrega a l’instant i funciona amb molt pocs recursos. Un servidor petit s’ocupa dels comptes d’usuari i de connectar-se amb els models computacionals de manera segura, sense que les claus d’accés surtin mai al navegador.

El resultat és una web veloç i molt barata de mantenir, perquè els models computacionals de pagament només entren en joc en les dues funcions que de debò els necessiten.

On entren els models computacionals

Els models computacionals intervenen en dos moments diferents del projecte.

El primer és la construcció del corpus, un pipeline de més de cent scripts de Python que s’executa fora de la web. Diversos models de llenguatge van ajudar a ordenar i contrastar informació ja publicada: Claude Haiku 4.5 va estructurar i normalitzar els camps dispersos del catàleg, Claude Opus va reconstruir les dades que les fonts oficials deixaven incomplets i Gemini 2.5 Flash va classificar els motius gràfics dels cartells. Cada sinopsi es va convertir en un vector numèric amb Gemini Embedding 2 (3.072 dimensions reduïdes a 192 mitjançant PCA) i cada cartell es va processar amb CLIP, el model de visió d’OpenAI. Les posicions dels mapes surten de projectar aquests vectors a dues dimensions amb UMAP. Que dues pel·lícules quedin a prop no és una decisió editorial. És geometria sobre els seus continguts.

El segon moment és lús en viu. La cerca «A què s’assembla?» vectoritza el text de l’usuari amb Gemini, el compara amb tot el corpus i demana a Claude Sonnet 4 que ordeni els candidats i justifiqui cada elecció. L’anàlisi conversacional permet interrogar les dades amb el corpus carregat en context. Ambdues funcions consumeixen crèdit d’API de pagament i per això queden reservades a comptes autoritzats.

Qui pot entrar

L’accés requereix registre. Cada persona entra amb el vostre compte de Google, que arriba amb el correu ja verificat, i tot compte nou queda pendent fins que un administrador l’aprova des del panell de gestió. A partir d’aquí, els rols determinen què pot veure i fer servir cada persona.

Un projecte de recerca

Artefacto · Cine Español és un projecte de recerca concebut per Artefacto Films dins dels seus processos de documentació i anàlisi del sector audiovisual espanyol. No pretén substituir les fonts oficials, que segueixen sent la referència, sinó oferir-ne una capa de lectura. La plataforma viu a cinemap.artefactofilms.com i la seva metodologia completa es pot consultar dins de la pròpia aplicació.