DNA对比图中的“相似度”通常不是一个统一的百分比,而是指两份样本在某些遗传标记、等位基因、基因片段或统计模型上的相符程度。它究竟代表什么,要看检测方法和报告用途:亲子鉴定主要看遗传标记能否符合亲子传递关系,兄弟姐妹鉴定看不同亲缘假设下的支持程度,而祖源或基因相似性软件显示的数值,可能只是算法计算出的共享片段比例。
因此,不能只看到图上的“相似度高”就直接判断两人是亲子或兄弟姐妹。正确理解的关键是先确认比较的对象、使用的标记、数值的单位,以及报告最终支持的关系假设。
DNA对比图中的“相似度”到底在比较什么?
常见的DNA对比图可能把两个人的检测结果并排列出,也可能用颜色、条形或百分比展示匹配情况。不同图形背后的含义并不相同。
- 位点或等位基因匹配:图表逐行列出多个DNA位点,数字相同表示在该位点检测到了相同的等位基因。它说明的是局部标记一致,不等于整个基因组完全相同。
- 匹配位点比例:有些图把相符的位点数量除以检测位点总数,形成一个比例。这个比例受检测位点数量、位点区分能力和人群中常见基因型影响,不能直接当作亲子概率。
- 关系指数或似然比:报告会比较“存在某种亲缘关系”和“没有该关系”两种假设哪一种更能解释检测结果。这类数值属于统计证据,不是简单的基因相似百分比。
- 共享基因片段:全基因组或SNP检测可能估算两人共享多少遗传片段,更常见于亲属关系、祖源或群体分析。这与传统STR亲子鉴定图中的匹配位点不是同一指标。
例如,亲子检测中的STR图表,重点不是“父亲和孩子有多少基因相同”,而是孩子在每个检测位点上的两个等位基因,是否能够分别由生物学父母解释。孩子通常从父母各获得一个等位基因,因此判断重点是遗传传递是否连贯,而不是把双方所有数字简单相加后计算相似率。
为什么亲子、兄弟姐妹和无关个体不能用同一个相似度标准?
不同亲缘关系的遗传规律不同,检测报告所比较的假设也不同。即使两张图都出现“匹配”“相似”或“概率”这样的词,结论也不能直接横向套用。
| 比较对象 | 相似性通常表示什么 | 适合回答的问题 | 不能直接推出什么 |
|---|---|---|---|
| 亲子 | 孩子的遗传标记是否能由被检父母一方解释,并结合统计模型计算支持程度 | 某人是否可能是孩子的生物学父亲或母亲 | 不能仅凭若干相同位点证明双方整体基因完全相同 |
| 亲兄弟姐妹 | 两人共享的遗传标记或片段,以及全同胞、半同胞、无关个体等假设的相对支持程度 | 两人是否更符合兄弟姐妹关系 | 不能按亲子检测的“每个位点传递”规则直接判读 |
| Y染色体 | 男性之间是否具有相近的父系遗传标记 | 是否可能属于同一父系家族或父系支系 | 不能单独证明两人就是父子,也不能区分所有同父系男性 |
| 线粒体DNA | 是否具有相近的母系遗传特征 | 是否可能处于同一母系支系 | 不能单独确定具体的母子或兄弟姐妹关系 |
| 全基因组或祖源分析 | 共享片段、遗传距离或与参考人群的相似程度 | 祖源构成、遗传距离或亲属线索 | 不能把祖源相似度直接当作法律意义上的亲子结论 |
兄弟姐妹之间通常会共享较多遗传信息,但共享程度会因遗传组合而变化;无关个体之间也可能在一些常见位点出现相同结果。相反,亲子关系具有更明确的代际传递逻辑。因此,“相同位点多”与“符合某种亲缘关系”是两个相关但不完全相同的问题。
如果图上显示相似度很高,为什么最终结论仍可能不同?
第一,检测的位点数量和区分能力不同。只检测少量标记时,两个没有近亲关系的人也可能出现较多相同结果;检测位点更多、区分能力更强时,统计判断通常更有信息量。不同机构、不同检测平台产生的百分比,不能只按数值大小比较。
第二,比较的假设不同。同一对样本可以被分别放入“父子关系”“全同胞关系”“半同胞关系”或“无关个体”等模型中。报告不是在回答一个抽象的“像不像”,而是在判断哪一种关系更能解释观察到的遗传数据。
第三,样本和家庭结构会影响解释。如果疑似父亲无法提供样本,只能通过其他亲属进行间接鉴定,分析模型会不同;如果家族中存在多个近亲男性,也可能需要增加样本或采用更有区分力的检测方案。个别位点出现不一致,还可能涉及突变、样本质量或身份信息问题,不能脱离完整报告单独判断。
所以,看到“相似度高”时,先不要把它理解为“关系已经确定”。应继续查看报告是否写明排除、支持、不排除、关系指数、亲权概率或其他统计结论,并确认这些指标对应的是哪一种亲缘假设。
看懂一张DNA对比图,应该先核对哪些信息?
- 先看样本身份:确认每一列分别代表谁,是父母与孩子、两名疑似兄弟,还是不同家系成员。身份标注错误会使整张图失去解释基础。
- 再看检测方法:报告使用的是STR、SNP、Y染色体、线粒体DNA,还是全基因组分析。方法不同,图中的“相似”含义也不同。
- 确认数值单位:区分匹配位点数量、匹配比例、共享片段比例、关系指数和概率。带“%”的数字也不一定都是亲子概率。
- 看最终结论:关注报告对具体关系的支持或排除,而不是只看颜色、曲线或单个高数值。
- 核对比较条件:是否有可用的父母样本,是否存在近亲干扰,是否出现缺失位点或疑似突变,这些都会影响统计解释。
如果图表只展示彩色条带或一个“相似度分数”,却没有说明检测标记、计算方式和比较假设,那么这个数字通常只能作为筛查或提示,不能单独用于判断亲子或兄弟姐妹关系。
不同问题下,应该选择哪一种DNA比较结果?
如果要解决的是直接亲子关系,应重点看是否采用适合亲子鉴定的遗传标记,以及报告是否给出针对父子、母子关系的统计结论。若要判断兄弟姐妹关系,应明确比较的是全同胞、半同胞还是无关个体,并尽量结合可获得的父母或其他近亲样本。
如果问题是是否属于同一父系或母系,Y染色体或线粒体DNA可能更适合,但它们回答的是家系线索,不等同于确认某一位具体父亲或母亲。若关注的是祖源、遗传距离或较远亲缘,全基因组或SNP结果更有参考价值,但仍应按照其专门的统计口径解读。
概括来说,DNA对比图中的相似度只能说明“哪些遗传信息相符、相符程度如何”,不能脱离检测类型直接翻译成“就是亲子”或“就是兄弟姐妹”。判断时应优先选择与实际问题匹配的检测方法,再结合完整的统计结论,而不是单独比较两个图上的百分比。





