Corpusconstructie en beschrijvende compositie
Figuur 1 presenteert het overzicht van het corpus in vier panelen. Figuur 1A toont het gerapporteerde screeningsproces van 612 kandidaatrecords naar 43 behouden records. Figuur 1B toont representatieve voorbeelden van media en formaten. Figuur 1C presenteert de aantallen over vier datumintervallen, en Figuur 1D vat de samenstelling van de bronnen en media van het corpus samen. Omdat de datumintervallen ongelijkmatige perioden beslaan, beschrijven deze aantallen de compositie van het bemonsterde corpus en mogen zij niet worden geïnterpreteerd als historische productiesnelheden.
Tabel 1 vat de geaggregeerde kenmerken van het corpus samen. Museumcollecties waren verantwoordelijk voor 302 records, digitale archieven voor 81 en gepubliceerde catalogi voor 50. Media werden gecategoriseerd als exportaquarel (n = 176), pith-paper schilderij (n = 12), exportalbumblad (n = 83), figuratieve schildering (n = 41) en overig formaat (n = 21). Metadata werden gecategoriseerd als compleet (n = 28), gedeeltelijk (n = 18) of minimaal (n = 27). Vrouwelijke figuren werden gecategoriseerd als centraal (n = 214), secundair (n = 102) of meervoudig (n = 17). Elk classificatieblok bestond uit alle 43 records.
Voorlopige AI-labels en menselijke referentiecategorieën
Tabel 2 vat de geaggregeerde overeenstemming samen tussen de voorlopige door AI gegenereerde labels en de menselijke referentiecategorieën over de 43 schilderijen, terwijl Aanvullende Tabel 1 de overeenkomstige voorlopige AI-labels op casusniveau, de classificaties van de codeurs, de geoordeelde menselijke referentiecategorieën, de matchstatus en de clustertoewijzingen bevat. Over het geheel genomen kwamen de AI- en menselijke referentielabels voor 356 schilderijen overeen, wat overeenkomt met een nauwkeurigheid van exacte overeenstemming van 82,2%. De recall op categorieniveau werd berekend als de proportie exacte AI-menselijke overeenstemmingen ten opzichte van de menselijke referentieondersteuning voor elke categorie.
De recall op categorieniveau varieerde van 73,3% voor rituele/bruiloftsscènes (33/45) tot 88,4% voor elite/schoonheid (9/12). De recall was 84,7% voor arbeid (61/72), 82,1% voor optreden (32/39), 79,7% voor huishoudelijk (51/64), 79,3% voor bedienden (46/58) en 79,1% voor markt (34/43). In totaal was de exacte overeenstemming 356/43 (82,2%). Evaluatie van de paren op casusniveau maakte de berekening van precisie en F1-scores over alle zeven categorieën mogelijk, variërend van 74,5% tot 89,2% voor de precisie en 0,75 tot 0,8 voor de F1-scores. Een uitgebreide confusiematrix met details over fout-positieven van de doelklasse en off-diagonale patronen is opgenomen in Aanvullende Figuur 1.
Gerapporteerde samenvattingen van computationele patronen
Figuur 2 presenteert vier weergaven van de gerapporteerde computationele analyse. Figuur 2A toont een galerij van negen schilderijen met gekleurde segmentatie-overlays die worden gebruikt voor visuele lokalisatie en review. Figuur 2B toont een UMAP-spreidingsdiagram van de gerapporteerde CLIP-afbeeldingsembeddings, met dichtheidscontouren gelabeld C1–C7. Figuur 2C vergelijkt het gerapporteerde aantal schilderijen (gevulde stippen) met de recall op categorieniveau (open cirkels), en Figuur 2D presenteert een galerij van representatieve schilderijen gegroepeerd volgens dezelfde labels. Cluster-validatie ondersteunde de geselecteerde clustering-oplossing, die een silhouette-score van 0,54 en een Davies–Bouldin-index van 0,92 opleverde. De mapping van cluster naar menselijke categorie toonde een sterke overeenstemming, waarbij elk afgeleid cluster hoofdzakelijk correspondeerde met een specifieke referentiecategorie van mensen.
Tabel 3 presenteert zeven gerapporteerde computationele profielen met steekproeven die overeenkomen met de ondersteuning van de zeven menselijke referentiecategorieën. De kruistabel van cluster per categorie is opgenomen in Aanvullende Tabel 2 en toont de distributie van de zeven beoordeelde menselijke referentiecategorieën over de clusters C1–C7. Analyse van deze clustertoewijzingen op casusniveau toonde aan dat de computationele clustering visuele structuren herstelde die nauw overeenkwamen met de zeven menselijke referentiecategorieën.
Associaties van visuele aanwijzingen en interpretatieve synthese
Tabel 4 vat de kwalitatieve profielen van visuele aanwijzingen samen die zijn gebruikt om de zeven door mensen gecodeerde categorieën te karakteriseren. Deze profielen beschrijven terugkerende associaties tussen kleding, ruimtelijke setting, houding, objecten en sociale relaties. Ze zijn niet afgeleid van een kwantitatieve kruistabel en hebben daarom geen juridische status, etniciteit, sociale causaliteit of publieksreceptie vastgesteld.
Figuur 3 integreert beschrijvende kwantitatieve samenvattingen van de gecodeerde visuele kenmerken met een interpretatief conceptueel model. Figuur 3A presenteert de zeven vastgestelde menselijke referentiecategorieën en hun steekproefgroottes. Figuur 3B toont de relatieve associaties tussen deze categorieën en gecodeerde visuele markeringen over vijf dimensies: kleding, ruimtelijke setting, objecten, houding en sociale relaties. De weergegeven associatiestrachten zijn berekend op basis van de annotaties op casusniveau binnen elke menselijke referentiecategorie. Figuur 3C vat de relaties samen tussen menselijke referentiecategorieën, dimensies van visuele markeringen en archetypen van klasimplicaties, met behulp van gewogen stromen afgeleid van gecodeerde observaties. Deze kwantitatieve relaties karakteriseren terugkerende representationele patronen binnen de geselecteerde schilderijen en mogen niet worden geïnterpreteerd als schattingen van historische demografische of sociale verdelingen. Figuur 3D presenteert een conceptueel crosscultureel interpretatiemodel en moet worden begrepen als een historisch onderbouwd interpretatief kader in plaats van een empirisch getest causaal pad.
Geïntegreerde interpretatie van visuele patronen
Binnen het corpus werden de zeven categorieën van vrouwelijke identiteit gekenmerkt door terugkerende combinaties van kleding, ruimtelijke setting, objecten, houding en sociale relaties. Deze combinaties leverden beschrijvend bewijs voor patroonmatige visuele conventies binnen de geselecteerde schilderijen. Historische interpretaties met betrekking tot gender, hiërarchie en transculturele bemiddeling bleven inferentieel.
Samen identificeerden de geaggregeerde resultaten zeven menselijke referentiecategorieën voor vrouwelijke identiteit en vijf terugkerende dimensies die werden gebruikt om deze te karakteriseren: kleding, ruimtelijke setting, objecten, houding en sociale relaties. Voorlopige AI-labels kwamen overeen met de vastgestelde menselijke categorieën voor 356 van de 43 schilderijen (82,2%), waarbij de laagste recall op categorieniveau werd waargenomen voor rituele/bruiloftsscènes (73,3%). Deze bevindingen ondersteunden de descriptieve organisatie en vergelijking van het corpus. De AI-menselijke labels op casusniveau maakten schattingen van de precisie en de F1-score op categorieniveau mogelijk. Afzonderlijk identificeerde de clusteranalyse structuren die overeenkwamen met de zeven menselijke referentiecategorieën. Desalniettemin karakteriseren deze computationele bevindingen visuele representatieconventies in plaats van causale claims te stellen over de historische sociale realiteit of de receptie door het publiek.
DATAbeschikbaarheid:
De gegevens die deze studie ondersteunen, inclusief metadata, broninformatie en screeningsgegevens, zijn beschikbaar via Zenodo op https://doi.org/10.5281/zenodo.21130291.

Figuur 1Corpusconstructie en beschrijvende compositie van de steekproef van 43 schilderijen. (A) Sequentiële screening van 612 kandidaatbeelden, resulterend in 43 geschikte schilderijen. Uitsluitingen bestonden uit schilderijen buiten de studieperiode of de export-schildertraditie (n = 85), moderne reproducties, onscherpe beelden of onjuiste onderwerpen (n = 58), beelden zonder een identificeerbare vrouwelijke figuur of met onvoldoende resolutie (n = 29), en records met onvoldoende metadata (n = 7). (BRepresentatieve voorbeelden van vijf media en formaten: exportaquarel (40,6%, n = 176), mergpapierschilderij (25,9%, n = 12), blad uit exportalbum (19,2%, n = 83), figuratief schilderij (9,5%, n = 41) en andere exportformaten (4,8%, n = 21).C) Verdeling van de bemonsterde schilderijen over vier chronologische intervallen. (D) Verdeling van verzamelbronnen (buitenring) en media/formaten (binnenring). De percentages zijn gebaseerd op de totale steekproef (N = 433) en afgerond op één decimaal. Klik hier om een grotere versie van deze figuur te bekijken.

Figuur 2Gerapporteerde segmentatie, embedding-visualisatie, clusterdistributie, categorieriturn en representatieve schilderijen. (A) Galerij van negen schilderijen met gekleurde segmentatie-overlays die worden gebruikt om figuren of visuele elementen voor beoordeling te lokaliseren. (B) UMAP-spreidingsdiagram van de gerapporteerde CLIP-beeldembeddings met dichtheidscontouren en labels C1–C7. (C) Gerapporteerd aantal schilderijen (ingevulde stippen, bovenste as) en categorische herinnering (open cirkels, onderste as); categorische herinnering is gelijk aan het aantal exacte overeenkomsten gedeeld door de menselijke referentiesupport. Er worden geen betrouwbaarheidsintervallen of foutbalken weergegeven. (D) Galerij met representatieve schilderijen gegroepeerd op C1–C7 labels, waarbij afbeeldingen zijn geselecteerd op basis van hun nabijheid tot de respectievelijke clustercentroïden. Afkortingen: AI = kunstmatige intelligentie; CLIP = Contrastive Language–Image Pre-training; SAM = Segment Anything Model; UMAP = Uniform Manifold Approximation and Projection; C1–C7 = gerapporteerde labels 1–7. Klik hier om een grotere versie van deze figuur te bekijken.

Figuur 3Associaties met visuele aanwijzingen en crosscultureel interpretatiekader. (A) Zeven beoordeelde vrouwelijke identiteitscategorieën van menselijke referentie en hun steekproefgroottes binnen het corpus van 43 schilderijen. (B) Associatie-heatmap die de relatieve sterkte van de relaties tussen de zeven referentiecategorieën voor mensen en gecodeerde visuele markeringen voor kleding, ruimtelijke setting, objecten, houding en sociale relaties weergeeft. De associatiesterktes zijn afgeleid van de annotaties op casusniveau binnen elke categorie. (CAlluviale weergave die de gewogen relaties samenvat tussen menselijke referentiecategorieën, visuele markeringsdimensies en klasse-implicatie-archetypen op basis van de gecodeerde observaties.D) Conceptueel crosscultureel interpretatiemodel dat afgebeelde activiteiten, workshop- en marktselectie, vijfdimensionale visuele codering, recurrente identiteitstypes en potentiële interpretatieve paden met elkaar verbindt. Klik hier om een grotere versie van deze figuur te bekijken.
Tabel 1: Corpuskenmerken en volledigheid van metadata (N = 43). Aantallen en percentages vatten zes afzonderlijke blokken samen: datuminterval, bron, medium of formaat, volledigheid van metadata, representatie van vrouwelijke figuren en scènetype. Elk blok gebruikt N = 43 als noemer en telt op tot 43; de percentages zijn corpusproporties binnen het blok, afgerond op één decimaal. Klik hier om dit bestand te downloaden.
Tabel 2: Voorlopige AI-labels en menselijke referentiecategorieën (N = 433). Ondersteuning (Support) staat voor het aantal schilderijen dat aan elke menselijke referentiecategorie is toegewezen. Exacte overeenkomsten (Exact matches) duiden op schilderijen waarbij het voorlopige AI-gegenereerde label overeenkwam met de menselijke referentiecategorie. De recall op categorieniveau is berekend als het aantal exacte overeenkomsten gedeeld door het aantal menselijke referentieondersteuningen. Klik hier om dit bestand te downloaden.
Tabel 3: Samenvatting van het gerapporteerde computationele profiel. C1–C7 reproduceren de gevalideerde profielgroottes en dominante labels. De integratie van clustertoewijzingen op casusniveau en de kruistabel van cluster per categorie bevestigt dat unsupervised clustering effectief visuele structuren heeft vastgelegd die overeenkomen met de zeven menselijke referentiecategorieën. Klik hier om dit bestand te downloaden.
Tabel 4: Kwalitatieve profielen van identiteitscategorieën voor vrouwen en klassegerelateerde visuele aanwijzingen. Aantallen en percentages vatten de menselijke referentiecategorieën samen, terwijl kleding, ruimte, objecten, houding en sociale relaties de terugkerende visuele profielen karakteriseren die met elke categorie geassocieerd worden. De klassegerelateerde interpretaties vertegenwoordigen iconografische lezingen van beeldpatronen in plaats van directe maten van historische sociale status. Klik hier om dit bestand te downloaden.
Aanvullende figuur 1: Confusiematrix waarin de voorlopige AI-labels worden vergeleken met de geoordeelde menselijke referentiecategorieën voor het corpus van 43 schilderijen. De rijen vertegenwoordigen de geoordeelde menselijke referentiecategorieën (werkelijke labels) en de kolommen vertegenwoordigen de voorlopige door CLIP gegenereerde categorieën (voorspelde labels). De celwaarden geven het aantal schilderijen aan voor elke AI-menselijke labelcombinatie. Diagonale cellen vertegenwoordigen exacte AI-menselijke overeenkomsten, waarbij de bijbehorende recall op categorieniveau als percentage wordt weergegeven. Niet-diagonale cellen vertegenwoordigen mismatches tussen de voorlopige AI-classificatie en de geoordeelde menselijke referentiecategorie. De totale nauwkeurigheid van de exacte overeenkomsten was 82.2% (356/43). Klik hier om dit bestand te downloaden.
Aanvullende Tabel 1: Vergelijking op casusniveau van voorlopige AI-labels, geoordeelde menselijke referentiecategorieën en UMAP-clustertoewijzingen. Elke rij vertegenwoordigt een van de 43 Chinese exportschilderijen uit de Qing-periode die zijn opgenomen in het analytische corpus. De tabel vermeldt de stabiele QEP-afbeeldingsidentifier, het voorlopige CLIP ViT-B/32 label, onafhankelijke classificaties van Menselijke Coder 1 en Menselijke Coder 2, de geoordeelde menselijke referentiecategorie, de status van de AI-menselijke match en de UMAP-clustertoewijzing. “Exact Match” geeft overeenstemming aan tussen het voorlopige AI-label en de geoordeelde menselijke referentiecategorie; “Mismatch” geeft een verschil aan. De geoordeelde menselijke categorie diende als de referentieclassificatie voor de analyses van de AI-menselijke overeenstemming. Klik hier om dit bestand te downloaden.
Aanvullende tabel 2: Kruistabel van menselijke referentiecategorieën en computationele clustertoewijzingen. De rijen representeren de zeven vastgestelde menselijke referentiecategorieën en de kolommen representeren clusters C1–C7 verkregen uit de computationele clusteranalyse. Celwaarden geven het aantal schilderijen aan dat is toegewezen aan elke categorie-clustercombinatie. Totale ondersteuning representeert het aantal schilderijen in elke menselijke referentiecategorie. De concentratie van waarnemingen over de categorie-clustercombinaties biedt een beschrijvende beoordeling van de correspondentie tussen de onafhankelijk afgeleide computationele clusters en de vastgestelde menselijke referentiecategorieën. Klik hier om dit bestand te downloaden.