成果介绍
本申请适用于存储技术领域,尤其涉及编码方法、解码方法、装置、终端设备及可读存储介质。该编码方法可以获取待编码数据的初始碱基序列;然后可以对初始碱基序列进行分组,得到初始碱基序列对应的至少一组中间碱基序列,并利用G与C的占比满足预设条件的第一预设碱基序列对中间碱基序列进行替换,得到待编码数据对应的编码文件。即本申请实施例提供的编码方法可以使得编码文件中的GC占比符合要求,降低DNA序列合成和测序的成本以及出错的概率,降低DNA存储的成本,扩大DNA存储的应用规模。
成果亮点
1.一种编码方法,其特征在于,包括:
获取待编码数据的初始碱基序列;
对所述初始碱基序列进行分组,得到所述初始碱基序列对应的至少一组中间碱基序列;
利用与至少一组所述中间碱基序列一一对应的第一预设碱基序列将至少一组所述中间碱基序列替换,得到所述待编码数据对应的编码文件,所述第一预设碱基序列中包含的G与C的占比满足预设条件。
2.如权利要求1所述的方法,其特征在于,所述待编码数据为文本,所述获取所述待编码数据的初始碱基序列,包括:
统计所述文本中各字符的出现频率;
以各所述字符为叶子节点、以各所述字符的出现频率为该叶子节点的权值构建所述文本对应的四叉哈夫曼树;
将所述四叉哈夫曼树的每一条边用碱基表示,得到所述文本对应的编码表;
根据所述编码表确定所述文本的初始碱基序列。
团队介绍
1.一种编码方法,其特征在于,包括:
获取待编码数据的初始碱基序列;
对所述初始碱基序列进行分组,得到所述初始碱基序列对应的至少一组中间碱基序列;
利用与至少一组所述中间碱基序列一一对应的第一预设碱基序列将至少一组所述中间碱基序列替换,得到所述待编码数据对应的编码文件,所述第一预设碱基序列中包含的G与C的占比满足预设条件。
2.如权利要求1所述的方法,其特征在于,所述待编码数据为文本,所述获取所述待编码数据的初始碱基序列,包括:
统计所述文本中各字符的出现频率;
以各所述字符为叶子节点、以各所述字符的出现频率为该叶子节点的权值构建所述文本对应的四叉哈夫曼树;
将所述四叉哈夫曼树的每一条边用碱基表示,得到所述文本对应的编码表;
根据所述编码表确定所述文本的初始碱基序列。
成果资料