摘要

中国大陆跨性别公共史越来越依赖搜索、平台索引、数字档案与自动摘要作为入口。同一个历史对象进入不同检索界面后,读者首先看到的往往已经从原始文件变成一层压缩表示:标题、日期、来源标签、搜索摘要、平台标签、自动生成的简介与若干结构化字段。压缩提高了发现效率,同时重新分配了哪些历史事实最先进入视野。2009年的国家医疗规范可以在官方文件页中以文号、发布日期和规范性质出现,也可以在新闻摘要中主要呈现年龄、婚姻与证明材料;2017年全国跨性别调查可以作为完整调查项目出现,也可以在二次发现中被一个醒目数字代表;C先生案可以按劳动争议、违法解除、人格权或平等就业权进入搜索;北医三院的材料可以以当前门诊指南、科研新闻、历史团队文件或自动生成的档案摘要出现;金星的2011年争议与2015年主持人角色又会在不同查询框架中产生非常不同的第一印象。

本文以六组公开历史对象为固定样本,对2026年9月8日能够重复访问的公共网页、公开搜索结果、档案页面与平台页面进行一轮有边界的来源审计。分析单位是“检索表示”而非个人用户:记录历史对象、原始来源角色、页面元数据、查询框架、结果标题或摘要、自动生成状态以及读者可能据此形成的历史推断。文章提出两套可复用工具。第一套是检索压缩链历史对象 → 来源记录 → 页面元数据 → 索引表示 → 查询框架 → 结果摘要/自动摘要 → 读者推断。第二套是检索上下文账本:把 object_identitysource_rolehistorical_dateinstitutional_actorscope_or_denominatoridentity_provenancelegal_stagesummary_status 分列保存。对自动摘要再增加一份摘要来源契约,记录其生成状态、所指向的源对象、来源角色、观察时间、已知缺口、原始链接与档案关系。

固定样本显示,公共检索的关键风险往往来自“上下文脱钩”而非纯粹的页面消失:日期仍在,制度阶段可能淡出;数字仍在,分母与抽样框可能淡出;人物仍在,身份称谓由谁使用可能淡出;视频仍在,创作者与转载者的来源角色可能互换。与此同时,透明标注的自动摘要、来源档案和垂直搜索也提供了积极路径:机器生成状态、未知字段、最近核验日期和来源角色一旦被显式展示,压缩表示便可以成为进入原始材料的可靠索引层。本文因此把“可发现”进一步拆成“找到对象”与“带着足够来源上下文找到对象”两种能力。

关键词: 中国大陆跨性别历史;搜索;自动摘要;数字档案;平台可见性;来源链;检索上下文;AI辅助导航

1. 搜索结果已经成为历史材料的第二层封面

网页史研究长期指出,链接存活与内容存活属于两个不同问题。一个URL可以继续响应,页面内容也可能已经改变;一个原始页面也可以离线,同时由档案、引用与副本继续存在(Klein et al. 2014; Jones et al. 2016)。数字史研究进一步强调,网页界面、抓取时间、版本与平台基础设施本身都属于历史解释的一部分(Brügger 2012; Fickers 2020; Nix & Decker 2021)。对于跨性别公共史,这一层基础设施尤其重要,因为许多关键材料首先以新闻、社群报告、医院页面、倡导档案、视频平台页面或临时机构网页进入公共网络。

搜索与自动摘要又在这些材料之上增加了一层“第二封面”。读者通常先接触标题、域名、日期、摘要和少量结构化字段,然后才决定是否进入原页。平台化研究把这种可见性理解为由平台架构、排序逻辑、元数据与用户实践共同产生的结果(Poell, Nieborg & van Dijck 2019)。关于跨性别创作者的研究则说明,可见性同时带来连接、解释与暴露压力,创作者会主动形成对算法的民间理论和应对策略(DeVito 2022; Haimson et al. 2021)。日常算法审计研究也提示,普通用户能够通过重复观察、对照账户与界面变化来建立有限但有价值的证据(Shen et al. 2021; Simpson et al. 2022)。

本文把这个问题转向历史检索:当研究者输入一个人物、案件、报告或制度名称时,哪一层上下文先被搜索界面保留下来? 历史解释的关键字段包括来源角色、历史时间、制度阶段、分母、身份称谓来源、创作者关系与自动生成状态。一个结果摘要容量有限,压缩本身属于接口设计的必要动作;研究价值来自记录“压缩保留了什么、把什么推迟到下一次点击”。

这种观察与此前GenderLibs关于“史料怎样穿过网页更替”的数字保存研究形成互补。前者关注 origin → replica → community archive → web archive → discovery index 的生存路径;本文把镜头推进到最后一个环节内部,研究一个已经可发现的对象怎样被索引、摘要、平台标签和查询框架重新包装。页面生存回答“还能否到达”,检索上下文回答“到达之前先看见了什么”。

2. 材料与方法:六组固定对象,一份检索上下文账本

本轮观察选择六组在中国大陆跨性别公共史中已经拥有多种独立来源角色的对象:2009年《变性手术技术管理规范(试行)》、2017中国跨性别群体生存现状调查、贵阳C先生就业案、北医三院跨性别/“易性症”医疗公共记录、金星2011—2015年电视角色迁移,以及2021年纪录短片《跨越性别的一天》。选择标准是每个对象都存在“原始或机构记录 + 新闻/平台传播 + 档案或后续索引”中的至少两层,因此可以观察检索表示如何改变上下文结构。

观察日期固定为2026年9月8日。材料包括国家卫健委、医院、新闻机构、倡导组织、数字档案、创作者控制页面、视频平台与垂直搜索站点的公开页面。每个对象沿若干语义相近的查询框架检查:制度名称、人物/机构名称、事件描述、主题词与历史年份。本文保存能够由公开页面复核的标题、日期、来源角色和页面字段,并把即时排序位置视为一次观察环境中的界面现象。跨日期的排序统计、个性化账户差异与地域化搜索结果适合进入后续固定设备、固定查询、重复采样的控制实验。

账本采用八个核心字段:

字段历史问题典型压缩后果
object_identity当前结果究竟指向哪一个文件、案件阶段、节目或影片?同名对象被合并
source_role官方发布、同期新闻、倡导档案、转载、平台上传还是机器索引?二手入口看起来像源文件
historical_date事件、发布、转载、存档、更新分别发生何时?多只时钟折叠为一个日期
institutional_actor谁制定、发布、主办、裁判、制作或保存?机构关系变成模糊“有关方面”
scope_or_denominator数字对应哪一群体、样本、阶段或问卷?单一百分比脱离分母
identity_provenance身份称谓来自自称、媒体、医疗、法律还是当代编辑?历史标签被读成统一自称
legal_stage仲裁、一审、人格权/平等就业权、上诉分别处于何处?多条司法路径压成“胜诉”
summary_status人工编辑、页面原文、平台标签、搜索摘要还是自动生成?机器概括获得源文本外观

这一设计借鉴多点位平台研究的思路:同一对象在多个界面中的表现共同构成研究对象,而单个平台页面只提供其中一块证据(Dieter et al. 2019)。社区档案研究则提醒,保存的价值还包括由谁描述、以什么关系描述以及哪些群体获得自我表述空间(Caswell & Cifor 2016; Caswell et al. 2017; Wakimoto, Bruce & Partridge 2013)。因此,本轮观察同时记录“内容是什么”与“这段描述是谁/什么系统生成的”。

3. 2009年医疗规范:从治理文件压缩成资格条件

国家卫健委当前可访问的文件页保留了一个很完整的制度入口:标题为《卫生部办公厅关于印发〈变性手术技术管理规范(试行)〉的通知》,页面标示发布时间2009年11月20日、文号“卫办医政发〔2009〕185号”,正文说明该规范服务于医疗技术审核、临床应用管理、医疗质量与安全,并保留2009年11月13日的签发时间(卫生部 2009)。在这个页面里,读者首先看到的是文件类型、主管机关、规范目的和两只日期时钟

同一规范进入新闻发现后,标题和摘要常把注意力转移到手术申请条件、年龄、婚姻状态、证明材料与医院资质。这样的压缩对日常信息需求很有效:一个寻找“当时做手术需要什么条件”的读者可以快速定位答案。历史研究却需要再补回治理层:草案讨论、最终通知、技术审核对象、规范发布日期与后来监管框架的变化属于不同问题。原始制度文件与新闻摘要因此形成“制度来源 → 资格条件”的重心迁移。

跨与多元性别档案对同一文件提供了另一种表示。其页面在正文前显式保留国家卫健委来源链接,并同时给出 archive.md 与 Internet Archive 的存档链接(Trans Chinese Digital Archive 2026a)。Project Trans 的法律档案又把文件嵌入中国大陆跨性别法律法规的时间序列(Project Trans 2026)。此时压缩界面保留的重点变成“源URL + 存档关系 + 法律时间”。数字保存研究称这种多入口结构为对抗引用腐烂与内容漂移的重要手段(Klein et al. 2014; Jones et al. 2016),而本文的进一步观察是:一个历史对象可以同时拥有资格型摘要、治理型原页与来源型档案页,三者回答的搜索意图各自不同。

在检索上下文账本里,这个对象至少需要 source_role=official_rulehistorical_date=2009-11-13/20institutional_actor=卫生部object_identity=卫办医政发〔2009〕185号及附件。当搜索摘要主要显示手术条件时,这些字段仍可通过下一跳恢复;当研究者保存检索证据时,把它们与条件摘要一起记录,便可以防止后续引用只剩一个脱离治理来源的“标准清单”。

4. 2017年全国调查:一个醒目数字怎样遮住抽样框

2017中国跨性别群体生存现状调查提供了更典型的“数字压缩”场景。China Development Brief保存的同期发布记录指出,该调查由北京同志中心与北京大学社会学系共同发起,并在2017年11月20日公开发布(Beijing LGBT Center 2017)。后续研究和档案又保留了5,677份提交、2,060份有效问卷以及不同论文使用的分析子样本。一个数字进入搜索摘要后极具传播力,却天然缺少空间同时展示招募方式、有效样本、身份子组、题目口径和分析筛选。

这一问题和跨性别健康信息检索研究存在直接联系。Augustaitis等人的研究表明,跨性别用户需要在在线信息环境中判断健康资源的质量与适用性(Augustaitis et al. 2021);数字知识传播研究则指出,平台能够扩大边缘群体知识的可达范围,同时要求对来源与语境进行更精细的说明(MacKinnon, Kia & Lacombe-Duncan 2021)。调查数据同样需要这样的“可达性 + 语境”组合。

跨与多元性别档案的2017调查页提供了一个值得肯定的自动摘要范例。页面明确写出“摘要与附加信息为自动生成,仅供检索与参考”,并在结构化元数据中展示文件名、格式、大小、MD5、归档日期、原始链接、作者、地区、日期与标签(Trans Chinese Digital Archive 2026b)。这意味着机器生成状态本身进入了页面证据。读者能够利用摘要快速识别对象,同时知道精确数字与结论仍应回到PDF或同期发布记录核对。

这里可以定义一份最小的摘要来源契约summary_status=machine_generatedsource_object=2017 survey PDFsource_role=community_archiveobserved_at=2026-09-08original_url=<recorded source>archival_relation=archived copyuncertainty=<page-declared unknown/error channel>。Jaillant与Caputo讨论AI进入born-digital档案时强调跨学科解释与档案语境的重要性(Jaillant & Caputo 2022)。把机器摘要的身份写进界面,恰好把这种解释责任转化为可操作字段。

对调查类材料而言,检索上下文账本还需要强制保存 scope_or_denominator。任何百分比、风险比或人数都应能回到“哪个样本、哪个身份子组、哪个题目、哪个分析阶段”。这样,搜索摘要可以继续保持短,而历史引用在下一层恢复完整数字来源。

5. C先生案:一个“胜诉”标签内部有多条司法时间线

贵阳C先生案揭示的是法律阶段压缩。2016年中国新闻网的同期报道以当时的媒体措辞描述劳动争议和仲裁立案,文章同时记录了当事人的男性认同与工作场景(中国新闻网 2016)。2017年初的报道聚焦法院确认违法解除劳动关系及相应工资、赔偿,同时指出歧视因果关系在该阶段的司法认定具有更复杂的结构(RFA 2017a)。2017年7月的另一路诉讼报道又把焦点放到人格权、就业权与歧视问题(RFA 2017b)。同语后来的倡导档案则把“性别认同及性别表达”进入判决语言作为影响性诉讼成果来解释(Common Language 2020)。

若一个检索界面只留下“首例跨性别就业歧视案胜诉”,读者很容易把仲裁、劳动合同解除、人格权/平等就业权诉讼与后续倡导总结理解为一个单一裁判动作。法律史研究需要更细的 legal_stageworkplace_event → arbitration → labor judgment → personality/equality-rights judgment → later advocacy archive。此前GenderLibs对该案的双轨研究已经证明,同一组工作事实可以进入不同诉讼请求与证明任务;今天的检索观察进一步说明,搜索摘要会把这些阶段重新压缩成可点击的一句话。

这一压缩也涉及身份称谓来源。历史新闻标题可能采用当时媒体常见的表达,正文又可能记录当事人自己的身份表述。当前编辑叙述则通常使用“跨性别男性”等更稳定的说明语言。identity_provenance 字段因此应记录 self-identificationcontemporaneous-media-labellegal-languagecurrent-editorial-language 的区别。对数字档案而言,历史标题的保真与当前说明的尊重可以同时存在,前提是两种语言各自带有来源角色。

算法内容治理研究常把可见性问题理解为平台规则、社会分类和内容解释之间的权衡(Jiang et al. 2022; Haimson et al. 2021)。法律史检索也有相似结构:更短的标签提高可检索性,更完整的诉讼阶段提高解释精度。检索上下文账本让两种目标可以并存,而无需把结果摘要扩写成整份判决书。

6. 北医三院:当前服务页、历史文件与自动档案摘要属于不同来源角色

“北医三院 跨性别 / 易性症”这一类查询特别适合观察来源角色切换。北医三院整形外科当前公开的《易性症综合诊疗就诊指南》是一份服务型页面,重点是现行就诊流程与综合诊疗入口(PUH3 Department of Plastic Surgery 2025)。内分泌科2026年的科研新闻则报告团队在JAMA Network Open发表跨性别相关研究,并介绍新一轮全国调查数据(PUH3 Department of Endocrinology 2026)。2018年的团队成立记录属于机构史节点(PUH3 Department of Plastic Surgery 2018)。三类页面都谈“北医三院 + 跨性别/易性症”,却分别承担 service, research_news, institutional_history 三个角色。

跨与多元性别档案保存的旧版“序列治疗就诊指南”又增加了第四种角色:archived_historical_guide。该页面的自动摘要清楚标注生成状态,结构化字段同时显示 Original Link | [Unknown link(update needed)]Date | 未知(Trans Chinese Digital Archive 2026c)。在历史研究中,“未知”本身是一条重要证据:它把档案系统当前掌握的来源边界暴露给读者。一个看起来流畅的摘要与一个显式未知字段并排出现,提醒研究者把“文本内容可读”与“原始网页来源完全恢复”拆开处理。

这类页面也说明AI/自动摘要的质量不能只按语言流畅度评价。档案检索需要的是可追溯的流畅度:摘要帮助识别对象,结构化元数据告诉读者其来源链完整到什么程度。档案学中的激进同理与社区档案研究强调描述实践对被记录群体的影响(Caswell & Cifor 2016; Caswell et al. 2017);AI与数字档案研究则进一步把模型、数据和解释界面纳入档案责任(Jaillant & Caputo 2022)。北医三院档案页提供了一个具体设计原则:自动生成字段与未知来源字段都应可见。

在检索上下文账本中,医院材料至少需要 source_role, historical_date, institutional_actor, summary_status, original_url_status 五列。这样,一个2025服务指南与一个来源日期待考的旧PDF即使标题相近,也会在历史证据层被自然分开。

7. 金星:查询框架会选择“身份事件”还是“主持人角色”

金星的电视史展示了另一种压缩:查询框架选择人物的哪一种公共角色进入第一屏。 2011年9月的中国新闻网报道围绕评委资格争议组织标题,标题直接把“变性”作为事件解释框架(China News 2011a, 2011b)。同期后续采访继续围绕封杀、歧视与当事人回应展开(China News 2011c)。这些页面对于研究2011年电视机构如何处理跨性别身份非常重要,因为标题本身就是当时媒体分类的一部分。

到了2012年,新浪关于《金星撞火星》的报道把核心角色改写为“主持人”(Sina Entertainment 2012)。2015年的《金星秀》报道进一步以脱口秀、主持风格和节目品牌作为主要入口(China News 2015; People’s Daily 2015)。同一个人进入搜索时,金星 2011 评委金星 2015 金星秀 产生的是两条不同的角色路径:前者容易突出身份争议和资格门槛,后者容易突出主持权威与节目所有权。

这说明搜索摘要对人物史的压缩具有“查询条件依赖”。媒体可见性研究早已指出,代表性既涉及出现频率,也涉及出现方式与角色结构(Duguay 2016)。跨性别创作者研究进一步说明,平台中的身份展示与受众可见性由内容策略、算法和社区实践共同塑造(DeVito 2022)。金星案例把这个问题放进历史检索:研究者需要保存查询框架,才能解释为什么同一人物在同一检索系统中呈现出不同的历史封面。

因此,人物史的检索记录最好保存 query_framerole_frame。例如:query_frame=2011 judging dispute, role_frame=judge/access controversy; 或 query_frame=2015 talk show, role_frame=host/program brand。两条记录共同展示角色迁移,而任何一条都只是一张切片。

8. 《跨越性别的一天》:作品来源与平台上传来源需要两列

2021年纪录短片《跨越性别的一天》把来源角色问题带到视频平台。创作者Yennefer Fang控制的Vimeo页面说明影片记录中国三代、四位跨性别者的生活,标注作品由Yennefer Fang编剧、导演和制作,并记录片长20分钟与中国制作背景(Fang 2021)。这是一份接近作品来源的创作者控制页面。

Bilibili在2022年出现的4K上传则提供另一种传播证据:页面保留标题、上传时间、文化/人物/跨性别/LGBT等标签以及上传者信息,上传者简介同时表明其频道包含纪录片与其他影片,压制/转载行为与本人立场分开(Bilibili 2022)。对于传播史,这一页面非常有价值,因为它记录了作品怎样进入中文视频平台、被怎样标记、由谁上传,以及平台观众能看到哪些标签。

检索摘要若只显示Bilibili页面,uploader 很容易在视觉上靠近作品主体;若只显示Vimeo,中文平台再传播轨迹又会淡出。解决方式是把 creator_provenanceplatform_upload_provenance 分列。移动影像档案研究同样需要区分作品生产、首映、节展、平台流通与后来归档,这也是前一轮GenderLibs“影像证据链”的核心原则。平台检索观察把这个原则再推进一步:搜索结果中的“来源”字段首先告诉我们页面由谁托管,并自动等于作品由谁制作的推断需要另一个证据步骤。

社交媒体数据档案研究指出,API、平台接口和页面结构会塑造未来研究者能看到哪些元数据(Acker & Kreisberg 2020)。平台化研究也强调内容、市场与基础设施之间的关系(Poell, Nieborg & van Dijck 2019)。对于跨性别影像史,保存创作者与上传者两层来源,可以让平台传播证据发挥作用,同时保留作品生产关系。

9. 垂直搜索提供一个正面对照:来源角色也可以进入搜索产品

公共搜索的压缩并非只能减少上下文。TSIndex“多元寻迹”目前公开显示39个索引来源、39,364条可搜索记录和27,052条限制级记录,并把自己定位为跨性别、非二元、CDTS、伪娘、男娘、性转等内容的垂直搜索与导航平台(TSIndex 2026a)。其About页面进一步说明AI辅助导航、语义分析、知识图谱、质量/可靠性边界与搜索隐私等设计目标(TSIndex 2026b)。这些声明属于平台自述,需要按平台自述使用;它们同时展示了一种“把来源结构做成产品界面”的方向。

更有启发性的是TSIndex的“来源档案”。该页面为每个进入索引的网站记录发布者、网站定位、覆盖范围、适用场景、来源依据、分级、当前访问状态、最近核验日期、时效限制与重要变更,并说明来源暂时离线或迁移时继续保留来源档案与已有索引记录(TSIndex 2026c)。这套字段与本文提出的检索上下文账本高度同构:搜索产品可以把“为什么这个结果在这里”变成用户可查看的信息,而非只展示结果标题。

这种设计也对应社区档案理论中的“参与式描述”。Wakimoto等人对酷儿社区档案的研究强调档案工作与社区行动之间的关系(Wakimoto, Bruce & Partridge 2013),Caswell等人则强调代表性与“能够想象另一种可能”的社会作用(Caswell et al. 2017)。垂直检索的价值因此可以按两个维度评价:覆盖多少对象,以及保留多少来源上下文。后者对历史研究尤其关键。

10. 三个模型:检索压缩链、上下文账本、摘要来源契约

10.1 检索压缩链

本轮六组对象可以统一表示为:

历史对象 → 来源记录 → 页面元数据 → 索引表示 → 查询框架 → 结果摘要/自动摘要 → 读者推断

每一箭头都可能重新排序信息。原始文件强调制度文号,新闻标题强调资格条件;调查报告强调方法与样本,结果摘要强调单个数字;判决链强调诉讼阶段,搜索标题强调“胜诉”;创作者页面强调制作关系,平台页面强调上传者与标签。数字记忆研究把网络化记忆理解为持续重组的过程(Mandolessi 2024),这条链则为具体网页检索提供了一个可操作版本。

10.2 检索上下文账本

对研究者、档案馆和专题搜索服务而言,最小账本可以记录:

 1object_id
 2query_frame
 3observed_at
 4result_url
 5result_title
 6source_role
 7historical_date
 8institutional_actor
 9scope_or_denominator
10identity_provenance
11legal_stage
12creator_provenance
13platform_upload_provenance
14summary_status
15original_url_status
16archive_relation

字段无需全部在每个对象中填写。法律案件重视 legal_stage,调查重视 scope_or_denominator,人物史重视 identity_provenance,视频重视两层制作/上传来源,自动档案页重视 summary_statusoriginal_url_status。统一账本的作用是让空值也可见:当一个历史字段尚待查证时,系统可以显示“待核”并保留下一步验证路径。

10.3 摘要来源契约

自动摘要需要额外保存六类信息:

  1. generated_status:人工编辑、规则抽取、模型生成或混合流程;
  2. source_object:摘要实际概括的文件或页面;
  3. source_role:官方、机构、新闻、社群档案、平台转载等;
  4. generated_or_observed_at:摘要生成时间可得时记录生成时间,另保存观察时间;
  5. uncertainty:缺失原链、日期待考、解析失败、版本未知等;
  6. reopen_path:读者进入原文、PDF、存档快照或上游来源的路径。

这套契约的目的在于让摘要承担“导航接口”角色。AI与born-digital档案研究已经说明,自动化能够扩展大规模档案访问,同时解释性基础设施决定研究者如何理解机器处理结果(Jaillant & Caputo 2022)。当机器生成状态与未知字段公开时,摘要的速度和档案的可追溯性可以同时保留。

11. 反证、边界与可重复性

首先,结果摘要与排序具有时间性。搜索引擎会重新抓取页面、更新索引、测试界面和改变摘要生成方式;平台页面也会修改标签、标题与描述。本文因此把2026年9月8日作为观察时间,而把“长期稳定排序”留给重复采样研究。observed_at 是检索史的必要字段。

第二,短摘要本身具有正面价值。它让读者在大型结果集中快速判断对象相关性。本文的“压缩”是描述性概念,关注有限界面如何选择信息,而非把短文本视为质量缺陷。良好的压缩可以保留关键来源信号,并提供清晰的重新打开路径。

第三,公开搜索结果代表一个检索界面状态。公共意见、群体态度、平台总体推荐概率和个性化用户体验各自需要独立研究设计。echo chamber与内容治理研究展示了排序和互动之间的复杂关系(Gao, Liu & Gao 2023; Jiang et al. 2022),本轮来源审计只对可复核页面与观察到的检索表示提出结论。

第四,历史术语需要来源层。2009医疗规范、2011金星报道、2016 C先生新闻与当前社群语言处于不同时间和制度环境。历史标题可以按原样保存,当前编辑说明则可以使用稳定而尊重的语言。identity_provenance 让二者并列存在,并避免把媒体称谓自动提升为当事人自称。

第五,自动摘要的流畅度与证据完整度属于两条轴。北医三院档案页明确展示未知原链,2017调查档案页明确展示机器生成摘要提示,这两种设计都把系统边界暴露给读者。档案系统由此获得一种可审计的谦逊:已知字段服务发现,待核字段引导下一步研究。

12. 对跨性别公共史基础设施的实际建议

对于历史研究者,最小实践是保存查询框架、观察日期、结果标题/摘要、结果URL与原始来源角色。引用单个数字时加上分母和分析子样本;引用案件时加上诉讼阶段;引用人物称谓时加上称谓来源;引用视频平台时同时记录作品创作者和平台上传者。这样的记录成本很低,却可以显著提高多年后的可解释性。

对于社区档案,机器摘要可以继续承担大规模导航工作,同时把 summary_statussource_roleoriginal_url_statusarchived_at 放进用户可见界面。原链待考时显式展示待考状态。McMurry等人关于持久标识符的研究强调对象身份、可定位性与元数据之间的关系(McMurry et al. 2017);社区档案可以在网页层采用同样思路,把“这个对象是什么”与“现在从哪里找到它”分别记录。

对于专题搜索服务,来源档案是一种高价值搜索功能。结果页除了相关性,也可以提供来源类别、最近核验日期、地区、内容类型、档案状态和版本关系。这样,用户能够在点击前判断“这是官方原页、同期新闻、社区副本还是后来索引”。TSIndex现有来源档案已经展示了这种产品化可能(TSIndex 2026c)。

对于未来的平台审计,可以建立固定查询面板:每周在相同环境运行一组历史对象查询,保存前若干结果的标题、域名、日期、摘要、来源类型与自动摘要标识,然后比较字段留存率和来源多样性。固定面板一旦累积数月,就可以把今天的定性来源审计推进到检索变化时间序列。Shen等人的日常算法审计框架与Dieter等人的多点位平台方法都为这种设计提供了方法学基础(Shen et al. 2021; Dieter et al. 2019)。

结论

中国大陆跨性别公共史进入搜索时代之后,历史对象往往先以压缩表示抵达读者:一条制度被压缩成资格条件,一份调查被压缩成数字,一组诉讼被压缩成“胜诉”,一个医院档案被压缩成服务摘要,一位公众人物被查询框架切换为“身份争议”或“主持人”,一部影片又可能在平台结果中把上传来源置于创作者来源之前。

这类变化可以通过检索压缩链清晰定位:历史对象 → 来源记录 → 页面元数据 → 索引表示 → 查询框架 → 结果摘要/自动摘要 → 读者推断。它把搜索结果从透明入口转化为可研究的历史中介。网页的标题、摘要与标签因此既是导航信息,也是后来的历史研究材料。

检索上下文账本提供了恢复语境的最低成本办法。对每个对象保存来源角色、历史日期、机构行动者、分母、身份称谓来源、法律阶段与摘要状态,可以让搜索保持简短,同时让严肃引用恢复原始证据结构。对于自动摘要,摘要来源契约再把生成状态、源对象、未知字段与重开路径显式记录。

本轮最重要的发现因此可以表述为:可发现性有两个层次。第一层让人找到对象,第二层让人带着足够来源上下文找到对象。 中国大陆跨性别历史的数字基础设施已经出现两类同时发展的实践:通用检索提高进入速度,社区档案与垂直搜索开始把来源角色、未知字段、存档关系和核验时间重新放回界面。下一步的研究价值在于把这种“带上下文的发现”做成可重复测量、可长期保存的公共历史能力。

参考文献

  1. Poell, Thomas, David Nieborg, and José van Dijck. 2019. “Platformisation.” Internet Policy Review. https://policyreview.info/pdf/policyreview-2019-4-1425.pdf
  2. DeVito, Michael Ann. 2022. “How Transfeminine TikTok Creators Navigate the Algorithmic Trap of Visibility Via Folk Theorization.” https://dl.acm.org/doi/pdf/10.1145/3555105
  3. Haimson, Oliver L., Daniel Delmonaco, Peipei Nie, and Andrea Wegner. 2021. “Disproportionate Removals and Differing Content Moderation Experiences.” https://dl.acm.org/doi/pdf/10.1145/3479610
  4. Shen, Hong, Alicia DeVos, Motahhare Eslami, and Kenneth Holstein. 2021. “Everyday Algorithm Auditing.” https://dl.acm.org/doi/pdf/10.1145/3479577
  5. Duguay, Stefanie. 2016. “Lesbian, Gay, Bisexual, Trans, and Queer Visibility Through Selfies.” https://journals.sagepub.com/doi/pdf/10.1177/2056305116641975
  6. MacKinnon, Kinnon R., Hannah Kia, and Ashley Lacombe-Duncan. 2021. “Examining TikTok’s Potential for Community-Engaged Digital Knowledge Mobilization With Equity-Seeking Groups.” https://www.jmir.org/2021/12/e30315/PDF
  7. Augustaitis, Laima, Leland Merrill, Kristi E. Gamarel, and Oliver L. Haimson. 2021. “Online Transgender Health Information Seeking.” https://dl.acm.org/doi/pdf/10.1145/3411764.3445091
  8. Jiang, Jialun Aaron, Peipei Nie, Jed R. Brubaker, and Casey Fiesler. 2022. “A Trade-off-centered Framework of Content Moderation.” https://dl.acm.org/doi/pdf/10.1145/3534929
  9. Simpson, Ellen, Andrew Hamann, and Bryan Semaan. 2022. “How to Tame ‘Your’ Algorithm.” https://dl.acm.org/doi/pdf/10.1145/3492841
  10. Gao, Yichang, Fengming Liu, and Lei Gao. 2023. “Echo chamber effects on short video platforms.” Scientific Reports. https://www.nature.com/articles/s41598-023-33370-1.pdf
  11. Bartolome, Ava, and Shuo Niu. 2023. “A Literature Review of Video-Sharing Platform Research in HCI.” https://dl.acm.org/doi/pdf/10.1145/3544548.3581107
  12. Shang, Zheyu. 2025. “Shifting platform governance: examining participatory content moderation on a Chinese platform Bilibili.” https://www.tandfonline.com/doi/pdf/10.1080/1369118X.2025.2520004?needAccess=true
  13. Klein, Martin, Herbert Van de Sompel, Robert Sanderson, Harihar Shankar, Lyudmila Balakireva, Ke Zhou, and Richard Tobin. 2014. “Scholarly Context Not Found: One in Five Articles Suffers from Reference Rot.” PLOS ONE. https://journals.plos.org/plosone/article?id=10.1371/journal.pone.0115253
  14. Jones, Shawn M., Herbert Van de Sompel, Harihar Shankar, Martin Klein, Richard Tobin, and Claire Grover. 2016. “Scholarly Context Adrift: Three out of Four URI References Lead to Changed Content.” PLOS ONE. https://journals.plos.org/plosone/article?id=10.1371/journal.pone.0167475
  15. Jaillant, Lise, and Annalina Caputo. 2022. “Unlocking Digital Archives: Cross-Disciplinary Perspectives on AI and Born-Digital Data.” https://link.springer.com/article/10.1007/s00146-021-01367-x
  16. Brügger, Niels. 2012. “When the Present Web Is Later the Past: Web Historiography, Digital History and Internet Studies.” http://www.ssoar.info/ssoar/handle/document/38378
  17. Acker, Amelia, and Adam Kreisberg. 2020. “Social Media Data Archives in an API-Driven World.” https://link.springer.com/article/10.1007/s10502-019-09325-9
  18. Caswell, Michelle, and Marika Cifor. 2016. “From Human Rights to Feminist Ethics: Radical Empathy in the Archives.” http://archivaria.ca/index.php/archivaria/article/view/13557
  19. Caswell, Michelle, Alda Allina Migoni, Noah Geraci, and Marika Cifor. 2017. “‘To Be Able to Imagine Otherwise’: Community Archives and the Importance of Representation.” https://escholarship.org/uc/item/1h54v9m9
  20. Wakimoto, Diana K., Christine Bruce, and Helen Partridge. 2013. “Archivist as Activist: Lessons from Three Queer Community Archives in California.” https://eprints.qut.edu.au/58605/
  21. Fickers, Andreas. 2020. “Update für die Hermeneutik. Geschichtswissenschaft auf dem Weg zur digitalen Forensik?” http://orbilu.uni.lu/handle/10993/44086
  22. Nix, Adam, and Stephanie Decker. 2021. “Using Digital Sources: The Future of Business History?” https://research-information.bris.ac.uk/en/publications/using-digital-sources-the-future-of-business-history
  23. Dieter, Michael, Carolin Gerlitz, Anne Helmond, Nathaniel Tkacz, Fernando van der Vlist, and Esther Weltevrede. 2019. “Multi-Situated App Studies: Methods and Propositions.” https://doi.org/10.1177/2056305119846486
  24. Mandolessi, Silvana. 2024. “The Digital Turn in Memory Studies.” https://doi.org/10.1177/17506980231204201
  25. McMurry, Julie A., et al. 2017. “Identifiers for the 21st Century.” PLOS Biology. https://journals.plos.org/plosbiology/article?id=10.1371/journal.pbio.2001414
  26. 中华人民共和国卫生部. 2009. 《卫生部办公厅关于印发〈变性手术技术管理规范(试行)〉的通知》. https://www.nhc.gov.cn/zwgk/wtwj/201304/5a310ec69d264d4a890949d0b2fbcaf7.shtml
  27. Trans Chinese Digital Archive. 2026a. “变性手术技术管理规范(试行).” https://digital.transchinese.org/%E6%94%BF%E5%BA%9C%E5%8F%8A%E5%AE%98%E6%96%B9%E7%BB%84%E7%BB%87%E6%96%87%E4%BB%B6/%E4%B8%AD%E5%9B%BD%E5%A4%A7%E9%99%86/%E5%8F%98%E6%80%A7%E6%89%8B%E6%9C%AF%E6%8A%80%E6%9C%AF%E7%AE%A1%E7%90%86%E8%A7%84%E8%8C%83%EF%BC%88%E8%AF%95%E8%A1%8C%EF%BC%89/
  28. Project Trans. 2026. “变性手术技术管理规范(试行).” https://project-trans.org/china-legal/spec/2009-11-13/srs/readme/
  29. China Development Brief / Beijing LGBT Center. 2017. “中国跨性别群体生存现状调查报告圆满发布.” https://www.chinadevelopmentbrief.org.cn/news/detail/17772.html
  30. Beijing LGBT Center & Department of Sociology, Peking University. 2017. 2017中国跨性别群体生存现状调查报告. https://cnlgbtdata.com/doc/43/
  31. TGR Transgender Resource Center. 2017. “2017中国跨性别群体生存现状调研报告.” https://www.tgr.org.hk/index.php/zh/china/china-info/378-2017%E4%B8%AD%E5%9B%BD%E8%B7%A8%E6%80%A7%E5%88%AB%E7%BE%A4%E4%BD%93%E7%94%9F%E5%AD%98%E7%8E%B0%E7%8A%B6%E8%B0%83%E7%A0%94%E6%8A%A5%E5%91%8A
  32. Trans Chinese Digital Archive. 2026b. “2017中国跨性别群体生存现状调查报告_北京同志中心.” https://digital.transchinese.org/%E6%9D%82%E5%BF%97%E5%8F%8A%E6%96%B0%E9%97%BB%E6%8A%A5%E9%81%93/%E4%B8%AD%E5%9B%BD%E5%A4%A7%E9%99%86/2017%E4%B8%AD%E5%9B%BD%E8%B7%A8%E6%80%A7%E5%88%AB%E7%BE%A4%E4%BD%93%E7%94%9F%E5%AD%98%E7%8E%B0%E7%8A%B6%E8%B0%83%E6%9F%A5%E6%8A%A5%E5%91%8A%E5%8F%91%E5%B8%83_%E5%8C%97%E4%BA%AC%E5%90%8C%E5%BF%97%E4%B8%AD%E5%BF%83_page/
  33. 中国新闻网. 2016. 《“女扮男装”员工被开除 当事人申请仲裁已获立案》. https://www.chinanews.com.cn/m/sh/2016/03-16/7799284.shtml
  34. Radio Free Asia. 2017a. “首名跨性人告僱主勝訴獲償 續提控要求道歉.” https://www.rfa.org/cantonese/news/discrimination-01022017081923.html
  35. Radio Free Asia. 2017b. “贵阳法院就跨性别者就业歧视案做出判决 原告‘C’先生获胜.” https://www.rfa.org/mandarin/Xinwen/6-07272017134541.html
  36. Common Language. 2020. “影响性诉讼⑦:这次,把‘性别认同及性别表达’写进判决.” https://commonlanguage.github.io/TYarchives2020/20200518_1%E5%BD%B1%E5%93%8D%E6%80%A7%E8%AF%89%E8%AE%BC%E2%91%A6%E8%BF%99%E6%AC%A1%EF%BC%8C%E6%8A%8A%E2%80%9C%E6%80%A7%E5%88%AB%E8%AE%A4%E5%90%8C%E5%8F%8A%E6%80%A7%E5%88%AB%E8%A1%A8%E8%BE%BE%E2%80%9D%E5%86%99%E8%BF%9B%E5%88%A4%E5%86%B3.html
  37. PUH3 Department of Plastic Surgery. 2025. “北医三院易性症综合诊疗就诊指南.” https://www.puh3.net.cn/zxwk/info/1005/4211.htm
  38. PUH3 Department of Endocrinology. 2026. “北医三院性别医学团队在JAMA Network Open发表跨性别相关研究成果.” https://www.puh3.net.cn/nfmk/info/1271/4602.htm
  39. PUH3 Department of Plastic Surgery. 2018. “北医三院易性症序列医疗团队成立.” https://www.sar.com.cn/xinwen/news/12295.html
  40. Trans Chinese Digital Archive. 2026c. “北医三院‘易性症’序列治疗就诊指南.” https://digital.transchinese.org/%E7%A4%BE%E7%BE%A4%E5%8F%8ANGO%E6%96%87%E4%BB%B6/%E5%8C%BB%E9%99%A2%E5%92%8C%E5%8C%BB%E7%96%97%E4%BD%93%E7%B3%BB/%E5%8C%97%E5%8C%BB%E4%B8%89%E9%99%A2%E2%80%9C%E6%98%93%E6%80%A7%E7%97%87%E2%80%9D%E5%BA%8F%E5%88%97%E6%B2%BB%E7%96%97%E5%B0%B1%E8%AF%8A%E6%8C%87%E5%8D%97_page/
  41. China News. 2011a. “金星自曝因变性被封杀 愤慨斥遭歧视:决不接受.” https://www.chinanews.com/yl/2011/09-22/3346646.shtml
  42. China News. 2011b. “金星不满因‘变性’被取消评委资格 宋丹丹力挺.” https://www.chinanews.com/yl/2011/09-23/3349842.shtml
  43. China News. 2011c. “舞蹈家金星谈‘封杀’:这实在是太滑稽了.” https://www.chinanews.com.cn/cul/2011/09-30/3365004.shtml
  44. Sina Entertainment. 2012. “脱口秀《金星撞火星》17日首播 金星担任主持人.” https://ent.sina.com.cn/v/m/2012-03-07/13393574628.shtml
  45. China News. 2015. “金星推脱口秀叫板崔永元.” https://www.chinanews.com.cn/yl/2015/01-27/7007840.shtml
  46. People’s Daily. 2015. “东方卫视推出《金星秀》 舞蹈家想靠嘴征服世界.” https://media.people.com.cn/n/2015/0206/c40606-26518070.html
  47. Yennefer Fang. 2021. “A Day of Trans.” Vimeo. https://vimeo.com/647384537
  48. Bilibili. 2022. “【4K】跨越性别的一天 A Day of Trans.” https://www.bilibili.com/video/BV1pD4y1e7KB/
  49. TSIndex. 2026a. “多元性别搜索引擎.” https://www.tsindex.org/
  50. TSIndex. 2026b. “About / 关于我们.” https://www.tsindex.org/about
  51. TSIndex. 2026c. “来源档案.” https://www.tsindex.org/archive/
  52. Memento. 2026. “Time Travel for the Web.” https://mementoweb.org/about/