知行札记
跨领域研究与写作指南的适用边界

跨领域研究与写作指南的适用边界

比较证据综合、分析判断、内容设计与质量工具,保留仓库小型试用的历史结果,说明可借鉴原则和不能直接移植的要求。

核查于

研究问题与结论

本调研回答:不同领域的研究、写作与质量指南,哪些原则能够用于本站独立调研和专题,哪些要求需要限定场景,哪些不能直接移植?读者是评价方法依据及适用性的作者、主 Agent 和维护者。

结论是:可以借鉴围绕问题取得证据、按主张评价材料、明确推理与不确定性、根据读者基础组织解释、分项判断质量。正式系统综述流程、健康传播评分、政府服务的任务限定和英文数量规则,各自带有特定方法或使用条件,不能作为本站所有文章的默认要求。

这一结论来自来源比较及三个仓库小型试用。试用支持局部适用性,尚不足以证明真实读者效果或跨领域长期收益。本文保留研究取舍、历史检查和局限;通用方法的成熟讲解已整理到研究、写作与知识表达专题。

研究范围与历史基线

原研究于 2026-10-04 围绕问题定义、来源与证据、分歧和研究充分性、解释组织、文字示例与图表、质量评价查找资料。优先进入方法制定者、机构官方指南与原始研究,读取相关正文,再沿引用补查关键方法;站内搜索调研按同样标准评价,并核对当时安装源码及相关测试。

这是一项针对仓库问题的比较研究,未开展完整数据库检索、正式系统综述、中文目标读者研究或跨任务长期评测。执行成本按所需工作作定性判断,没有测量统一工时。公开资料以英文官方指南为主,其语言和领域集中性限制了推广。

2026-10-04 的仓库基线是提交 3c75cac9d5017a313862905d7e67744c462a4a69 及当时工作树。当时生产流程已有成果归属、主 Agent 责任、持续核查、格式和发布边界,具体研究、写作与质量方法仍待采用。代码核查确认 schema、过滤和 lint 维护技术接口,没有内容质量评分或句长门禁;历史 ADR 0007 已标注旧决策状态。12

2026-10-05 整理时,正式方法规范已经采用,执行入口为仓库 apps/site/docs/standards/README.md;本研究的未采用表述和完整条款草案已收敛为下文取舍。整理时选择性复核了关键官方入口,没有重跑下文 2026-10-04 的搜索与过滤实验,verified 保留原日期。

研究方法指南:借鉴问题与证据,保留方法边界

不同来源解决的问题不同,比较时同时查看可借鉴内容、额外成本与不能移植的部分。

来源与方法原用途本仓库可借鉴之处限制与取舍
Cochrane Handbook 的检索与研究选择干预研究的系统性证据综合检索匹配问题,识别同一研究的多个报告,关注限制和可能遗漏专业检索、筛选与偏倚评价成本高;正式任务另按方法要求执行,日常调研不据引用这些原则自称系统综述
PRISMA 2020系统综述的报告指导让读者获得评价研究所需的信息报告清单不评价方法实施质量;不转成本站统一章节或评分门禁
Cochrane 快速综述方法限缩资源下的效果证据综合提醒限缩方法会影响覆盖与偏差原研究取得官方入口,所链全文受限;未据未经全文核查的细则制定规则
ODNI ICD 203情报分析判断评价来源、区分信息假设判断、处理替代解释与不确定性采用通用分析视角;不移植情报概率词表、管理或保密规则
GRADE 的证据确定性评价特定结果的研究证据体评价关注偏差、分歧、间接性、不精确与发表偏倚正式等级有方法要求;泛技术调研直接解释具体缺口,不自行授予正式等级

这些来源共同支持按主张与证据条件评价材料,不能据此推导统一来源数量或固定搜索轮数。Cochrane 对停止检索的讨论还指出,停止规则的正式评价有限;反复得到重复材料只能提供辅助线索。34567

本站取舍是:边界明确的事实先核对直接材料,多来源判断开展针对问题的综合;后果较大、争议明显或依据间接时深化研究。正式系统综述或快速综述,只在实际任务需要且完成相应方法时使用其名称。成本增加需要服务具体判断,时间耗尽则报告中断与缺口。

Wineburg 与 McGrew 的横向阅读研究提供了来源核查线索:职业事实核查员会离开原网页查看外部信息。其样本是 10 名历史学者、10 名职业事实核查员与 25 名 Stanford 本科生,属于专家与新手比较,研究对象是人类评价社会政治网页。本站据此接受对陌生或存疑关键来源开展定向背景核查,没有将它写成 Agent 的因果效果或所有材料的固定步骤。8

NASEM 关于复现与复核的讨论,则帮助区分复查条件与实际复查结果。本文采用这个验证范围区别:提供代码不等同于本次成功重跑,相同样本重跑没有新增目标场景;不同领域的术语约定仍须按其自身方法核对。9

写作指南:按阅读目标选择组织与载体

来源原用途本仓库采纳与限制
GOV.UK 用户需要指导政府服务内容的任务支持采纳读者需要、结果和接受条件;其有效需要限定于动作或服务任务,不能据此要求所有专题都附操作
Google Technical Writing技术文档写作教学采纳读者知识距离、范围、术语一致、具体指代、自编辑、代码与图表目标;英文词形和数量建议不转换为中文阈值,课程练习不迁入本站正文
Diátaxis Explanation理解导向的解释文档采纳概念联系、语境、原因和替代观点;不将本站调研/专题分类强制映射成其四类文档
W3C WAIWeb 内容的可访问性采纳复杂图关键内容的文字替代和可辨结构;填写 alt 不证明辅助技术效果已验

GOV.UK、Google 和 Diátaxis 都关注读者需要,阅读目标却有差异。政府服务的“需要”受行动任务约束,Diátaxis 允许理解导向的解释,Google 的 Audience 也允许设计规格以学习信息为结果。本站因此接受理解、判断和操作作为不同目标,按实际任务提供支撑。101112

文字、表格和图示的建议也按关系采用。Google 的 Illustrating 帮助确定图的要点;Tables 区分适合横向映射的信息与连续论述;W3C 的 Complex Images 要求复杂图片的重要信息可由文字获得。本文没有采纳图或列表的数量上限,也没有证明这些选择改善中文阅读效果。131415

这一取舍增加了按内容选择媒介和审阅关联信息的工作;它保留了单篇正文自由组织的空间。完整方法讲解见专题的知识组织和写作与风格,本调研不再维护同一套教程。

质量工具:分清评价维度与实际效果

AHRQ 的 PEMAT 分别评价患者教育材料的可理解性与可行动性,不评价准确性、充分性,也不执行可读性测试;高分无法保证适合某个目标人群。CDC Clear Communication Index 同样面向公共健康传播,提醒清晰检查不能替代目标人群预试。Diátaxis 则分别讨论准确、完整、一致与有用,明确框架不能包办质量。161718

这些差异支持按具体缺陷分别评价质量,保留真实读者效果的证据边界。它们不直接证明本站六维质量标准的跨领域有效性:六维划分是面向当前任务的综合取舍,仍需更多场景检验。

因此,本文未采用健康传播的总分、90 分门槛、行动号召或逐项数量限制,也没有将中文句长或术语数量建立为质量代理指标。审阅投入按缺陷对理解、判断和操作的影响安排;案头审阅、代码检查、运行观察和真实读者试读分别报告。

作者核查成本较低,但熟悉主题可能掩盖理解缺口;同行或 Agent 可以提供具体审阅意见,却不能自动代表目标读者;真实读者试读能回答指定任务中的表现,需要相应人群和任务设计。当前材料支持保留这些区别,尚未测得各方法的成本收益比。

候选方法的小型试用

以下结果均来自 2026-10-04 原研究。薄弱待审文本由原研究构造,不代表现有文章存在这些错误;未修改既有文章、测试或配置。2026-10-05 整理保留记录,没有执行新实验。

试用一:主张与实际证据逐项核对

研究问题是:已有搜索样例能够支持怎样的“中文搜索可用”结论?构造的待审句为:“默认中文搜索已验证可用,十个查询全部命中,可直接用于真实站点。”材料包括站内搜索调研、官方静态搜索说明、安装源码及 apps/search-check/src/search.ts、apps/search-check/test/search.test.ts。1920

原待审主张2026-10-04 核查依据支持范围
静态搜索有导出与加载接口官方 Static Mode 及样例中的 staticGET、staticClient支持接口及受控样例往返;真实路由和请求另验
orama-static 路径表示引擎是 Oramafumadocs-core@16.15.18 该模块从 zbsearch 导入 create、load,当时官方文档注明 ZBSearch该版本使用 ZBSearch,历史模块路径不能单独确定引擎
十个查询全部命中断言要求至少九个命中,且“微调”“量化”命中;日志没有逐查询排名只支持所记录下界
可直接用于真实站点三篇固定文档,Node 环境替换索引下载,未测真实文档集或浏览器只支持受控样例,实际场景仍缺证据

当日使用 Node 24.12.0、pnpm 10.24.0,执行 pnpm --filter @doc-test/search-check check:code:类型检查通过,1 项测试通过。判定取原始结果前三项,再去掉 URL 锚点匹配目标页面;没有先按页面去重。

原结果支持:在 Fumadocs Core 16.15.18 的三篇受控中文文档中,官方静态接口完成导出与加载;十个查询中至少九个的原始前三项包含目标页面,“微调”和“量化”命中。真实文档集召回、索引规模成本和浏览器交互均未验证。

这个试用定位了接口、实现、样本结果与应用效果之间的三项过强推断,支持在局部任务中采用主张核对。重跑只增加相同样本的复核证据;没有测得该方法的缺陷检出率、额外工时或跨领域效果,也没有测试永久证据台账的收益。

试用二:问题驱动的过滤解释

研究问题是:首次接触本站的作者,怎样理解“子页标记已发布,但祖先入口仍为草稿时,子页为何不公开”?原构造摘要只列 toFumadocsSource、update.files 与 loader 顺序。改写补入目录入口定义、子页结果、过滤先于下游派生,以及开发模式保留草稿的条件。

原构造样例假定更上级入口均已发布,只讨论正文过滤:

文件状态开发模式生产过滤后
research/example/index.mdx草稿保留排除
research/example/details.mdx已发布保留排除

2026-10-04 将这些陈述与 filterPublishedFiles、source 调用顺序及已有单元测试核对,执行 pnpm exec vitest run tests/unit/content-filter.test.ts,8 项通过。已有断言覆盖草稿入口排除已发布后代、开发保留草稿及集合入口的上级边界。2

本例支持“按问题补齐对象和结果关系”在该稿中的案头适用性。没有招募目标读者、比较理解正确率或阅读耗时,没有比较图的额外收益;单元测试也没有验证表格显示或可访问性。可读性改善仍是待验证预期。

试用三:所有文章必须操作是否成立

候选规则为:“每份成果必须让读者完成一个操作。”原研究将它应用于上述过滤解释,发现需要额外加入修改元数据或运行构建;这些步骤没有回答原问题所需的新关系。

结合 GOV.UK、Google 与 Diátaxis 的用途差异,原案头试用否决所有文章必备操作的通用规则,接受按理解、判断或操作目标确定完成条件。其证据是来源比较与同稿件的范围检查,未测执行工时或长期收益,不能据此推导所有操作说明都可省略。101112

综合取舍与仍缺少的证据

本研究为本站提供了三个局部判断:主张核查能够限制搜索案例中的过强结论;问题驱动的解释能在稿件中补入可核查关系;领域规则需要通过任务范围评价适用性。这些判断足以支持继续试用相关原则,不能独立证明全部规范的真实效果。

原十项基础规范草案涉及的要求已整合进正式规范,本文保留采纳理由及证据。规范分层、风格与专项归属、接入取舍由规范体系组织方案调研继续评价;正式执行要求以仓库规范入口为准。

仍需进一步研究的事项包括性能与产品效果的代表样本、操作和迁移的失败恢复路径、高影响领域的专业方法、历史及社会材料的语境与代表性,以及中文解释、图表和辅助技术的真实阅读效果。现有来源和小型试用没有建立跨任务统一阈值。

实际目标读者试读、浏览器排版、辅助技术、实际应用及 AI 客户端验证均未执行。后续采用某种专项评估时,需要依据其问题选择方法,不能把本次案头确认或历史代码测试写成这些效果已经验证。

资料与定位

原研究的外部正文核查日期为 2026-10-04。下列出处保留其方法、领域与定位;仓库历史结果按上文时间和基线阅读。2026-10-05 的整理未重新建立全量研究结论或重跑历史实验。

Footnotes

  1. 原研究读取仓库 AGENTS.md、apps/site/AGENTS.md、research/write skills、apps/site/docs/production.md、当时的 apps/site/docs/writing/README.md 与 docs/ai.md。旧写作入口已在规范采用后迁出,历史基线可由 Git 追溯,现行入口为 apps/site/docs/standards/README.md。 ↩

  2. 原核查定位:apps/site/source.config.ts 的 PAGE_SCHEMA、apps/site/src/lib/content-filter.ts 的 filterPublishedFiles、apps/site/src/lib/source.ts 的过滤与 loader 顺序、apps/site/scripts/remark-lint-content.ts、apps/site/tests/unit/content-filter.test.ts,以及历史 apps/site/docs/adr/0007-chinese-writing-checks.md。 ↩ ↩2

  3. Page 等,2021,The PRISMA 2020 statement,Scope of the guideline、How to use PRISMA 2020。 ↩

  4. Cochrane Rapid Reviews Methods Group,Cochrane RR Methods,2024 更新针对效果快速综述,DOI: 10.1136/bmj-2023-076335。原研究核查到官方入口和范围,所链 BMJ 正文/PDF 获取受限。 ↩

  5. ODNI,Intelligence Community Directive 203: Analytic Standards,D.6.a、D.6.e.(1)–(4),PDF 正文页 3–6。 ↩

  6. Cochrane Handbook,Chapter 14: Completing ‘Summary of findings’ tables and grading the certainty of the evidence,14.2.1–14.2.2。原研究未开展正式 GRADE 评级。 ↩

  7. Wineburg、McGrew,Lateral Reading and the Nature of Expertise,Stanford 官方 PDF 第 2 页 Structured Abstract,专家与新手比较研究。 ↩

  8. NASEM,2019,Reproducibility and Replicability in Science,Chapter 3,Conclusion 3-1 及其前后复查条件与实际重算的讨论,DOI: 10.17226/25303。 ↩

  9. GOV.UK,Identify user needs,What the user wants to do and why、Write acceptance criteria。 ↩ ↩2

  10. Google Technical Writing,Audience,Define your audience、Determine what your audience needs to learn;Words、Self-editing、Creating sample code。 ↩ ↩2

  11. Diátaxis,Explanation,Explanation and understanding、Writing good explanation。 ↩ ↩2

  12. Google Technical Writing,Illustrating,Write the caption first、Constrain the amount of information in a single drawing、Focus the reader’s attention。 ↩

  13. Google developer documentation style guide,Tables,List or table?、Places not to use tables;W3C WAI,Tables Tutorial。 ↩

  14. W3C WAI,Complex Images,Overview、Long descriptions。 ↩

  15. AHRQ,PEMAT User’s Guide — Introduction,What Is the PEMAT?、Are All Materials With High PEMAT Scores High Quality?。 ↩

  16. CDC,Clear Communication Index User Guide,2019-08,印刷页 1–3。原研究未采用 90 分门槛或逐项评分规则。 ↩

  17. Diátaxis,Towards a theory of quality in documentation,Functional quality、Understanding the limits。 ↩

  18. 仓库内调研「Fumadocs 静态中文搜索」及「静态中文搜索接口核查」,原核查日期 2026-10-02,均尚未公开。源码位置分别为 apps/site/content/research/fumadocs-static-search/index.mdx 与 apps/site/content/research/fumadocs-static-search/reports/2026-10-02-baseline.mdx。2026-10-04 原研究又读样例、断言、包清单与安装实现,相关试用条件和结果见本文试用一;2026-10-05 未重跑。 ↩

  19. 原研究读取 Fumadocs Built-in Search 的 Static Mode、Internationalization,以及当时安装的 fumadocs-core@16.15.18/dist/search/client/orama-static.js 与 dist/search/server.js。实现判断限于该安装版本。 ↩

最后更新于

本页目录