二维码生成与识别原理_修订版_第1页
二维码生成与识别原理_修订版_第2页
免费预览已结束,剩余19页可下载查看

下载本文档

版权说明:本文档由用户提供并上传,收益归属内容提供方,若内容存在侵权,请进行举报或认领

文档简介

1、QR 二维码的生成与识别原理一、简介二维码 (2-dimensional bar code),是用某种特定的几何图形按一定规律在平面 (二 维方向上)分布的黑白相间的图形记录数据符号信息的。二维码的种类包括:QRCode ,Data Matrix, Maxi Code, Aztec , Vericode, PDF417, Ultracode, Code 49, Code 16K等。 其中QR Code是被广泛使用的二维码,QR全称Quick Response,与其他编码方式相比,QR二维码具有存储容量大、编码速度快的特点,并且它也能表示更多的数据类型:比 女口:字符,数字,日文,中文等等。随着

2、近几年智能手机的迅猛发展,QR二维码得到了广泛的应用。关于QR二维码的标准,可参见标准文档(QR Code SpeO:http:/ 为了提高向机器内输入信息的速度,QR二维码得到迅猛发展,在许多行业中得到应用。在一维码时代, “扫码”主要应用在超市或图书馆等场所,以获取商品价格或图书 分类等有限的特定信息。二维码可以存储大容量数据,给人们的生活带来巨大方便。从开始的扫描二维码提取文字或网址,到后来 “扫一扫” 添加好友、关注个人或公 司微信或微博,再到扫码支付,二维码的应用已经非常普遍。三、基础知识QR码可分为不同的尺寸, 或者叫版本Version。Version 1是21 x 21的矩阵,V

3、ersion 2是25 x 25的矩阵,Version 3是29的尺寸,每增加一个version,就会增加4的尺寸, 公式是:(V-1)*4 + 21(V是版本号) 最高Version 40,(40-1)*4+21 = 177,所以最高是177 x 177的正方形。样例如下:定位图案Position Detection Pattern是定位图案,用于标记二维码的矩形大小。这三个定位图案有白边叫Separators for Postion Detection Patterns。之所以三个而不是四个意思就是三 个就可以标识一个矩形了。Timing Patterns也是用于定位的。原因是二维码有40

4、种尺寸,尺寸过大了后需要有根标准线,不然扫描的时候可能会扫歪了。Alignment Patterns只有Version 2以上(包括Version2)的二维码需要这个东东, 同样是为了定位用的。功能性数据Format In formati on存在于所有的尺寸中,用于存放一些格式化数据的。Version Information在Version 7以上,需要预留两块3 x 6的区域存放一些版本信 息。数据码和纠错码除了上述的那些地方,剩下的地方存放Data Code数据码 和Error Correction Code纠错码。Quiet ZonePiLUQt.氏mi/iPi-icrrSeparir

5、ors fbr PosinoiiDtlevlicMi PdLieiiihFunctionPa:ie:iis.T 血 lg PdiiterTijSvmbol-Alignrrenr Pane:nsFormat IriifnrriLaEiEn tidingRrgjon.Zati and ErrorCcsrectioa Cote words四、数据编码QR码支持如下的编码:Numeric mode:数字编码,从0到9。如果需要编码的数字的个数不是3的倍数, 那么,最后剩下的1或2位数会被转成4或7bits,则其它的每3位数字会被编成10,12,14bits,编成多长还要看二维码的尺寸。Alpha nu

6、meric mode:字符编码,包括0-9,大写的A到Z(没有小写),以及符号$ % * +-. / :包括空格。这些字符会映射成一个字符索引表。如下所示:(其中的SP是空格,Char是字符,Value是其索引值)编码的过程是把字符两两分组,然后转成下表的45进制,然后转成11bits的二进制,如果最后有一个落单的,那就转成6bits的二进制。而编码模式和字符的个数需要根据不同的Version尺寸编成9, 11或13个二进制(如下表中Table 3)Cti ar.VaieChar.Value: VgljECtiar. ValueChar.ValueCfar.:ValueChar : Valje

7、Char.Valte00s6C i 12I J 16024U i 30SP I 36421117D t 13J : 19p25V : 31$ t 37/4322sQE j 14K i 2026W : 32% i 38443399F : 15L j 21R27X 33* j 3941AAG MSMT22S28YT 344 T 4055B11H E 17N : 23T : 2SZ | 35-:41Byte mode:字节编码,可以是0-255的ISO-8859-1字符。有些二维码的扫描器可以自动检测是否是UTF-8的编码。Kanji mode:日文编码,也是双字节编码。同样,也可以用于中文编码。E

8、xte nded Cha nnel In terpretatio n (ECI) mode:主要用于特殊的字符集。并不是所有 的扫描器都支持这种编码。Structured Append mode:用于混合编码,也就是说,这个二维码中包含了多种编 码格式。FNC1 mode:这种编码方式主要是给一些特殊的工业或行业用的。比如GS1条形码之类的。这里我们主要介绍最常用的数字编码和字符编码。下面两张表中,Table 2是各个编码格式的“编号”(注:中文是1101),编号要写在Format In formation中。Table 3表示了不同版本 (尺寸)的二维码,对于数字、字符、 字节和Kanji模

9、式下,对于单个编码的2进制的位数。(编码规范表可参见二维码规格说 明书)Table 2 Mode indicatorsIndicatorECI0111Numeric0001Alphanumeric00106-bit01OQKanji1000Structured Append0011FNC10101 (First position J 1001(Second position)Terminator (Erd of Message)000Table 3 Number of brts in Character Count IndicatorVersionNumeicModeAlphanumericM

10、ode8-bit ByteModeKanji Mode1 tofi 1IDgaB10tc2611161027 to 4014131612举例说明:示例一:数字编码例如,在Version 1的尺寸下,纠错级别为H的情况下,编码:01234567的编码方式如下:1.把上述数字分成三组:012 345 672.把他们转成二进制:012转成0000001100;345转成0101011001;67转成1000011。3.把这三个二进制串起来:0000001100 0101011001 10000114.把数字的个数转成二进制(version 1-H是10 bits ): 8个数字的二进制是000000

11、10005.把数字编码的标志0001和第4步的编码加到前面:0001 0000001000 0000001100 0101011001 1000011示例二:字符编码同样,在Version 1的尺寸下,纠错级别为H的情况下,编码:AC-42的编码方式如下:1.从字符索引表中找到AC-42这五个字条的索引(10,12,41,4,2)2.两两分组:(10,12) (41,4) (2)3.把每一组转成11bits的二进制:(10,12)10*45+12等于462转成00111001110(41,4)41*45+4等于1849转成11100111001(2)等于2转成0000104.把这些二进制连接起

12、来:00111001110 11100111001 000010;5.把字符的个数转成二进制(Version 1-H为9 bits ): 5个字符,5转成000000101;6.在头上加上编码标识0010和第5步的个数编码:0010 00000010100111001110 11100111001 000010;五、结束符和补齐符假如我们有个HELLO WORLD勺字符串要编码,根据上面的示例二,我们可以得到F面的编码编码字符数HELLO WORLD勺编码001000000101101100001011 01111000110 10001011100 10110111000 100110101

13、00001101还要加上结束符:编码字符数HELLO WORLD勺编码结束001000000101101100001011 01111000110 10001011100 1011011100010011010100 0011010000按8bits重排如果所有的编码加起来不是8个倍数我们还要在后面加上足够的0,比如上面一共有78个bits,所以还要加上2个0,然后按8个bits分好组:00100000 01011011 00001011 01111000 11010001 01110010 11011100 01001101 0100001101000000补齐码(Padding Bytes

14、)最后,如果还没有达到最大的bits数的限制,还要加一些补齐码(Padding Bytes),Padding Bytes就是重复下面的两个bytes:11101100 00010001(这两个二进制转成十 进制是236和17,关于每一个Version的每一种纠错级别的最大Bits限制,可以参看QR Code SpeC假设我们需要编码的是Version 1的Q纠错级,那么,其最大需要104个bits,而我们上面只有80个bits,所以,还需要补24个bits,也就是需要3个Padding Bytes,我们就添加三个,于是得到下面的编码:00100000 01011011 00001011 011

15、11000 11010001 01110010 11011100 0100110101000011 01000000 11101100 00010001 11101100上面的编码就是数据码了,叫Data Codewords,每一个8bits叫一个codeword,我们还要对这些数据码加上纠错信息。六、纠错码上面我们说到了一些纠错级别,Error Correction Code Level,二维码中有四种级别的纠错,这就是为什么二维码有残缺还能扫出来,也就是为什么有人在二维码的中心位置加入图标。错误修正容量L 水平7%的字码可被修正M 水平15%的字码可被修正Q 水平25%的字码可被修正H 水

16、平30%的字码可被修正那么,QR是怎么对数据码加上纠错码的?首先需要对数据码进行分组,也就是分成不同的Block,然后对各个Block进行纠错编码,对于如何分组,可以查看QR CodeSpec的定义表。这里注意最后两列:Number of Error Code Correction Blocks:需要分多少个块。Error Correction Code Per Blocks:每一个块中的code个数,所谓的code的个数, 也就是有多少个8bits的字节。5134L2S1(l34J0ftJ3|M4&阿 43 胳Q7222(33 J 5.9)(34.16,9)HB822(33.11,1

17、1)(34J2J1J6172L362(W8JM644(43.27,8)Q964(f19t12J|H1124(43J5J4)亂& r): c - total numler af codewordsk = number af data codewords r = number of error correciion capacitybError correction capacily is IESSthan half lhe number of error correciion codewonas to reduce lheprobabiliiy of misdecodes.举例说明:上述

18、的Version 5 + Q纠错级:需要4个Blocks(2个Blocks为一组,共两组),第一组的两个Blocks中各15个bits数据+各9个bits的纠错码(注:表中的codewords就是一个8bits的byte)(再注:最后一例中的(c, k, r)的公式为:c = k + 2* r,因为后脚注解释了:纠错码的容量小于纠错码的一半)下图给一个5-Q的示例(因为二进制写起来会让表格太大,这里使用十进制表示,可以看到每一块的纠错码有18个codewords,也就是18个8bits的二进制数)组块数据对每个块的纠错码1167 85 70 134 87 38 85 194213 199 11

19、 45 115 247 241 223119 50 6 18 6 103 38229 248 154 117 154 111 86 161111 392246 246 66 7 118 134 24287 204 96 60 202 182 124 1577 38 86 22 198 199 146 6200 134 27 129 209 17 163 163120 13321182 230 247 119 50 7 118148 116 177 212 76 133 75 242134 87 38 82 6 134 151 50238 76 195 230 189 10 108 240719

20、2 141270 247 118 86 194 6 151235 159 5 173 24 147 59 33 10650 16 236 17 236 17 23640 255 172 82 2 131 32 178 23617 236(注:二维码的纠错码主要是通过Reed-Solo mon error correct ion(里德-所罗门纟纠错算法)来实现的)七、最终编码上述步骤完成之后,还要把数据码和纠错码的各个codewords交替放在一起。交替规则如下:对于数据码:把每个块的第一个codewords先拿出来按顺度排列好,然后再取第块的第二个,如此类推。如上述示例中的Data Codew

21、ords如下:块 1678570134 873885194 119 506186103 38块 2246 246 667118 134 242 7388622 198199 1466块 3182 230 247 119 5()7118 134 873882 6134151 5077块 470247 118 86194 6151 5016236 17 236 17236 17 236我们先取第一列的:67,246,182,70然后再取第二列的:6 7,2 4 6,1 8 2,7 0,8 5,2 4 6,2 3 0,2 4 7如此类推:67,246,182,70,85,246,230,247 .,

22、38,6,50,17,7,236对于纠错码,也是一样:块1213 199 1145115 247 241 223 229 248 15,41177154 111 86161 111 39块287 204 9660 202182 124 157 200 134 27129 209 17163163 120 133块3148 116 177 212 76133 75242 238 76195 230 189 10108 240 192 141块4235 159 5173 24147 5933106 40255 172 82213132178 236和数据码取的一样,得到:213,87,148,23

23、5,199,204,116,159,39,133,141,236然后,再把这两组放在一起(纠错码放在数据码之后)得到:67, 246, 182, 70, 85, 246, 230, 247, 70, 66, 247, 118, 134, 7, 119, 86, 87, 118, 50, 194, 38,134, 7, 6, 85, 242, 118, 151, 194, 7, 134, 50, 119, 38, 87, 16, 50, 86, 38, 236, 6, 22, 82, 17, 18,198, 6, 236, 6, 199, 134, 17, 103, 146, 151,236,

24、38, 6, 50, 17, 7, 236, 213, 87, 148, 235, 199,204, 116, 159, 11,96, 177, 5, 45, 60, 212, 173, 115, 202, 76, 24, 247, 182, 133, 147, 241, 124,75, 59, 223, 157, 242, 33, 229, 200, 238, 106, 248, 134, 76, 40, 154, 27, 195, 255, 117, 129,230, 172, 154, 209, 189, 82, 111, 17, 10, 2, 86, 163, 108, 131, 16

25、1, 163, 240, 32, 111, 120, 192, 178, 39, 133,141,236这就是数据区。Rema in der Bits最后再加上Reminder Bits,对于某些Version的QR,上面的还不够长度,还要加上Remainder Bits,比如:上述的5Q版的二维码,还要加上7个bits,Remainder Bits加零 就好了。关于哪些Version需要多少个Remainder bit,可以参看QR Code Spec的第15页的Table-1的定义表。八、画二维码图Positi on Detect ion Patter n首先,先把Position Det

26、ection图案画在三个角上。(无论Version如何,这个图案的尺寸不变)Alig nment Pattern然后,再把Alignment图案画上(无论Version如何,这个图案的尺寸就是这么大)关于Alignment的位置,可以查看QR Code Spec的第81页的Table-E.1的定义表(下表是不完全表格)Table E.1 Row/column coordinates of module Alignment PatternsVersionNumber ofAligrmentPatternsRow/Column coordinates af center motJjle10-216

27、1831&22416265163061&347662238Q5624429662646106&2850F图是根据上述表格中的Version8的一个例子(6,24,42)Version 8 QR Code0.0沟.回6EJ J H 2 4叵jEl-H 4262442Timi ng Pattern接下来是Timing Pattern的线ormat In formati onFormat In formation是一个15个bits的信息,每一个bit的位置如下图所示:(注意图中的Dark Module,是永远出现的)再接下来是Formation Information,下图

28、中的蓝色部分。这15个bits中包括:5个数据bits:其中,2个bits用于表示使用什么样的Error Correction Level,3个bits表示使用什么样的Mask10个纠错bits。主要通过BCH Code来计算然后15个bits还要与101010000010010做XOR操作。这样就保证不会因为我们选 用了00的纠错级别和000的Mask,从而造成全部为白色, 这会增加我们的扫描器的图 像识别的困难。下面是一个示例:AssurnB Error Carrection Level M-andMasis Pattern R-eference; gBCH bits;Unmasked b

29、it sequence;Mask pattern for XOR operation: ForrnaiInformation module pattern;关于Error Correction Level女口下表所示:Error Correction LevelBinary indreat&rL01MooQ11H10关于Mask图案如后面的Table 23所示。Versio n In formatio n再接下来是Version In formation(版本7以后需要这个编码),下图中的蓝色部分。00101001010011011100001011011100101010G00010

30、01D100000011001110Version Information共是18个bits,其中包括6个bits的版本号以及12个bits的纠错码,下面是一个示例:Version number:7Data:000111BCH bits;110010010100Format InfoimaUon module pattern:000111110C1CO1O1Q0而其填充位置如下:0 3ri9 t2 151471013162 581 11417VersitE Iniurm atiun in Lipper resht数据和数据纠错码然后是填接我们的最终编码,最终编码的填充方式如下:从左下角开始沿着

31、红线填我们的各个bits,1是黑色,0是白色。如果遇到了上面的非数据区,则绕开或跳过。QR v3 order, from bottom right掩码图案这样下来,图基本填好了,但是,也许那些点并不均衡,如果出现大面积的空白或黑块,扫描识别会变得困难。所以,最后还要做Masking操作。QR的Spec中描述到,0 123456pH9W1112巧1415 16 17Vursiun lnfkjrmaliun in lowtrQR有8个Mask你可以使用,其中,各个mask的公式在各个图下面。所谓mask,就是和上面生成的图做XOR操作。Mask只会和数据区进行XOR不会影响功能区。(注:Table

32、 23 Mask pattern generation con-d it ionsMask PatternRefere neeGonditionoco(i + 7) mod 2 = 0mi mpd 2 = 0DW/mod 3 = 0011Pi + D mod 3 = 0100ffrdiv 2) + (j div3)mod2 = D101(j j) mod 2 + (/ moc 3-3110iff/) mod 2 + /j) med 3) mod 2 = 0in(/) mod 3 + if+/) mod mod 2 = 0F面是Mask后的一些样子,可以看到被某些Mask XOR了的数据变得比较

33、零散了。Mask过后的二维码就成最终的图了。st选择一个合适的Mask也是有算法的)(yyz * x/3) % 2XV%2 * int width, int height Ion苗start - System, currenttts) i Result ra/Result = null;bytef= new bytef.length;80for (int y Q y height; y+) for (intM 0; x er ofdata bitsData capacityMumericAlphanumericByteKanjiErrorDetectiononly3206*L540106rvi

34、M斗3285-M3L1134231456M968181174L1612S3521159M4M14112SO1813BQ10302113951L19152412517101612B342014a131042716117H972171074可知应读取数据区连续的72个bits作为一个整体,比如我们读到如下数据:00100000 00101001 11001110 11100111 00100001 00000000 11101100 00010001 11101100对于该数据,按照QR码的规范,前四位为编码格式编号,即0010对应的是字符编号,说明后面的内容为字符;根据QR码编码规范,版本为1、

35、纠错级别为H的编码,数字个数占九位,即 取编码格式编号的后九位:000000101,转换成十进制为5,即得知该数据包含5个 字符。再次按照QR码编码规范,字符编码过程中,每一组数据为11位,并且如果最后有一个落单的,那就转成6bits的二进制。那么根据有5个字符,我们取随后 的28位数据,即为真正的数据编码:00111001110 11100111001 000010将上述三组数据转换成十进制即为(462,1849,2),根据字符编码的编码规范,编 码的过程是把字符两两分组,然后转成下表的45进制。那么,分别将462、1849、2转化为45进制转换之前的数据,得到(10,12) (41,4)

36、(2),查询字符编码表,得出对 应的字符分别为:A,C,-,4,2,即原始数据为AC-42,解码结束。3、将获取数据与解码关联在实际的应用中, 因为数据的识别解析过程比较慢, 并且二维码识别、 解码一 次不一定能成功, 那么要如何科学的把上述两步 (获取数据与解码) 关联在一起呢? 首先, 由于数据识别和解析是一个耗时操作,我们要利用线程机制, 在一个线 程中操作,这里我们定义了一个继承Thread的DecodeThread类,该线程与DecodeHandler配合,完成解析数据的功能,由于一次识别不一定成功, 那么就要在每次识别失败之后, 重新调用第一小节 中提到的方法,重新获取摄像头数据进

37、行再一次的解析。如此反复直到成功。那么程序又是如何判定失败的呢?在上面贴出的第95行代码处,将最终的解 析结果放置在rawResult变量中,后面对该变量就行判断,若不为空,则表示解析 成功, 若为空表示解析失败, 程序会向主线程发送解析失败的消息, 来进行再一次 的解析过程。附录一:YUV数据格式简介以及获得像素数据。YUV是一种颜色编码方法。“Y”表示明亮度(Luminance、Luma), “U”和V”则是色度、浓度。与我们熟知的RGB类似,YUV也是一种颜色编码方法,主要用于电视系统以及 模拟视频领域,它将亮度信息(Y)与色彩信息(UV)分离,没有UV信息一样可以显示完整的图像,只不过是黑白的,这样的设计很好地解决了彩色电视机与黑白电视的兼容问题。并且,YUV不像RGB那样要求三个独立的视频信号同时传输,所以用YUV方式传送占用极 少的频宽。YUV码流的存储格式其实与其采样的方式密切相关,主流的采样方式有三种,YUV4:4:4,YUV4:2:2,YUV420,用三个图来直观地表示采集的方式如下,其中黑点表示采样该像素点的Y分量,空心圆圈表示采用该像素点的YUV4;2:2(M_煽_$_-七_*-癒_題-7_空_1地还原了每个像素点的YUV值,才能通过YUV与RGB的

温馨提示

  • 1. 本站所有资源如无特殊说明,都需要本地电脑安装OFFICE2007和PDF阅读器。图纸软件为CAD,CAXA,PROE,UG,SolidWorks等.压缩文件请下载最新的WinRAR软件解压。
  • 2. 本站的文档不包含任何第三方提供的附件图纸等,如果需要附件,请联系上传者。文件的所有权益归上传用户所有。
  • 3. 本站RAR压缩包中若带图纸,网页内容里面会有图纸预览,若没有图纸预览就没有图纸。
  • 4. 未经权益所有人同意不得将文件中的内容挪作商业或盈利用途。
  • 5. 人人文库网仅提供信息存储空间,仅对用户上传内容的表现方式做保护处理,对用户上传分享的文档内容本身不做任何修改或编辑,并不能对任何下载内容负责。
  • 6. 下载文件中如有侵权或不适当内容,请与我们联系,我们立即纠正。
  • 7. 本站不保证下载资源的准确性、安全性和完整性, 同时也不承担用户因使用这些下载资源对自己和他人造成任何形式的伤害或损失。

评论

0/150

提交评论