| Computer workstation | Hardware | Qualquer computador moderno capaz de executar Python 3.11 e processar corpora de texto; ≥8 GB RAM recomendado | Nenhum número de catálogo necessário Origem: Genérico (qualquer fornecedor) |
|---|
| Sistema operacional | Software | Windows 10/11, macOS, ou Linux (registre a versão exata do SO em logs/run_notes.txt) | Versão registrada em run_notes.txt Origem: Instalado no sistema |
|---|
| Python | Software | Python 3.11 | Versão registrada em logs/pip_freeze.txt Origem: Distribuição da Python Software Foundation |
|---|
| jieba | Biblioteca de software | 0.42.1 | jieba==0.42.1 Origem: Repositório de pacotes PyPI |
|---|
| spaCy | Biblioteca de software | 3.7.2 | spacy==3.7.2 Origem: Repositório de pacotes PyPI |
|---|
| Modelo de pipeline em inglês | Modelo de NLP | en_core_web_sm 3.7.1 (pacote de modelo spaCy) | en_core_web_sm==3.7.1; instalação registrada em run_notes.txt Origem: Repositório de modelos spaCy |
|---|
| scikit-learn | Biblioteca de software | 1.4.2 | scikit-learn==1.4.2 Origem: Repositório de pacotes PyPI |
|---|
| RapidFuzz | Biblioteca de software | 3.6.1 | RapidFuzz==3.6.1 Origem: Repositório de pacotes PyPI |
|---|
| Editor de planilha | Software | Qualquer software capaz de editar arquivos .xlsx | Usado para visualizar/editar SourceRegister.xlsx, CorpusStats.xlsx, arquivos Candidates/Shortlist Origem: Genérico (qualquer fornecedor) |
|---|
| Editor de texto simples | Software | Qualquer software capaz de editar arquivos .txt e.csv | Usado para visualizar/editar logs/.txt e resources/.csv Origem: Genérico (qualquer fornecedor) |
|---|
| Ferramenta de conversão de texto UTF-8 | Software | Qualquer ferramenta capaz de exportar documentos para texto simples UTF-8 | Usado na Etapa 2.3; método exato registrado em run_notes.txt Origem: Genérico (qualquer fornecedor) |
|---|
| Modelo SourceRegister | Modelo de arquivo | SourceRegister.xlsx com campos: source_id, title, owner/publisher, language, genre, access_date, license_note | Congelado como outputs/SourceRegister_v1.xlsx Origem: Criado neste estudo |
|---|
| Modelo de estatísticas do corpus | Modelo de arquivo | CorpusStats.xlsx com campos: source_id, lang, n_chars_before, n_chars_after, timestamp, cleaning_ruleset | Gerado durante a Etapa 3.6 Origem: Criado neste estudo |
|---|
| Dicionário de usuário chinês | Arquivo de recursos | resources/userdict_zh.txt (lista de termos específicos do domínio para suporte de segmentação) | Cópia congelada salva; checksum registrado em thresholds.txt Origem: Criado/curado neste estudo |
|---|
| Mapa de palavras-chave do domínio | Arquivo de recursos | resources/domain_keywords.csv com regras de prioridade de domain_tag | Congelado como outputs/domain_keywords_v1.csv; checksum registrado em alignment_log.txt Origem: Criado/curado neste estudo |
|---|
| Tabela de mapeamento de termos chinês-inglês | Arquivo de recursos | resources/term_map_zh2en.xlsx com colunas term_zh e term_zh_en | Congelado como outputs/term_map_zh2en_v1.xlsx; cobertura registrada em alignment_log.txt Origem: Criado/curado neste estudo |
|---|
| Log de limite | Arquivo de log | logs/thresholds.txt (padrões, limites, versões da biblioteca, checksums de recursos) | Necessário para reexecuções determinísticas Origem: Gerado neste estudo |
|---|
| Log de alinhamento | Arquivo de log | logs/alignment_log.txt (pesos, k, cutoffs, configurações do vetorizador, cobertura do mapeamento, checksums do mapa) | Necessário para reexecuções determinísticas Origem: Gerado neste estudo |
|---|
| Planilha de anotação | Modelo de arquivo | validation/Annotation.xlsx (pair_id, term_zh, term_en, S, decisões, adjudicação, racionalização) | Congelado como outputs/Annotation_v1.xlsx após a Etapa 6.6 Origem: Criado neste estudo |
|---|
| Saída de avaliação | Arquivo de saída | outputs/Evaluation.xlsx (acordo bruto, kappa de Cohen, totais) | Produzido na Etapa 6.4 Origem: Gerado neste estudo |
|---|
| Exportação final do léxico | Arquivo de saída | outputs/FinalLexicon.xlsx seguindo o esquema da Tabela 2 | Produzido na Etapa 7.2 Origem: Gerado neste estudo |
|---|
| Exportação TBX | Arquivo de saída | Arquivo TBX gerado a partir do FinalLexicon.xlsx com mapeamento entry_id estável | Resultado de validação registrado em run_notes.txt Origem: Gerado neste estudo |
|---|