返回列表 发新帖

http协议之chunked解析

194.4k 8
swmozowtfl 发表于 2015-7-10 20:44:48|湖北 | 查看全部 阅读模式
网上使用chunked编码的网站似乎并不是很多,除了那些使用gzip压缩的网站,例:google.com,还有就是大部分打开gzip压缩的php论坛。! y% d# H( p; }5 ^/ M$ r& R3 h! d
根据本人的理解,使用chunked编码的主要好处就在于一些程序的运算出过程中,可以动态的输出内容。& D8 Y2 L- q4 j" @
例如,要在后台处理一个小时的运算,但又不希望用户等一个小时才能看到结果。这时就可采用chunked编码将内容分块输出,用户随时都可以接收到最新的处理结果。' m- o; e, F& Q6 Z; z% L( G( _
asp关闭了缓存的输出模式,就是chunked编码的。(response.buffer = false)+ j) ?7 u, H, e$ P
而每一次的response.write,都是一个chunked,所以不要使用的太频繁哦,否则chunk数量太多,额外的数据太浪费空间了。
. ~. L9 M8 n' g  I若想了解chunked的具体编码结构,用asp关闭缓存调试蛮方便的。:)
8 m1 o/ c  g0 f- Z我们先来看看rfc2616中对chunked的定义:
4 \' |: P; \- j* ], z& O$ Kchunked-body = *chunk
4 z7 P* |" A; v$ v0 xlast-chunk
! T2 I' |! a4 J9 g/ f  G- \  W6 Ttrailer: R# a' ~- R. J: b
crlf
5 P5 X6 R" Y7 S8 N' G/ k$ E" Z" ?chunk = chunk-size [ chunk-extension ] crlf
; M+ n5 b( m% ]7 |, h( Schunk-data crlf
8 \! E5 t! C) a, q2 k% bchunk-size = 1*hex
& X' G: J+ l3 x, e) l# Wlast-chunk = 1*(0) [ chunk-extension ] crlf6 t  e6 N9 m' {6 [0 ^  m
chunk-extension= *( ; chunk-ext-name [ = chunk-ext-val ] )
, G" X$ H, h2 f; uchunk-ext-name = token
, o9 l$ m/ W; d! }6 j/ D; g2 fchunk-ext-val = token | quoted-string& i$ n* O1 l) L% s! P+ \, o
chunk-data = chunk-size(octet), v; f9 o* p4 Q  @, f) M
trailer = *(entity-header crlf)3 R$ i8 w" T) s* t
我们来模拟一下数据结构:6 E4 k5 z: c7 [# j1 y
[chunk大小][回车][chunk数据体][回车][chunk大小][回车][chunk数据体][回车][0][回车]/ w/ R: M* _8 w5 C# o+ J
注意chunk-size是以十六进制的ascii码表示的,比如86ae(实际的十六进制应该是:38366165),计算成长度应该是:34478,表示从回车之后有连续的34478字节的数据。8 O- S, F2 V: r6 o4 [( D
跟踪了的返回数据,发现在chunk-size中,还会多一些空格。可能是固定长度为7个字节,不满7个字节的,就以空格补足,空格的ascii码是0x20。; h1 Q+ e) v2 M' n+ v, a3 Q, _
以下是解码过程的伪代码:) n+ K& i2 S. z3 V; N
length := 0//用来记录解码后的数据体长度
% @' Z6 w$ t$ g& F7 D" `& _read chunk-size, chunk-extension (if any) and crlf//第一次读取块大小
8 ^4 i0 E( _2 p& G3 L- ywhile (chunk-size > 0) {//一直循环,直到读取的块大小为0' I1 s' x# P* M# N' z
read chunk-data and crlf//读取块数据体,以回车结束
5 M( t  f' }9 ?6 nappend chunk-data to entity-body//添加块数据体到解码后实体数据" m3 q4 t$ D. d$ i9 \( P6 j% i
length := length + chunk-size//更新解码后的实体长度
6 b# F/ S3 w2 }5 d0 D' e8 mread chunk-size and crlf//读取新的块大小
+ v9 r/ I  I* T( z: }0 w}
  O! n% ~- [5 B  W/ y" T7 ]. Yread entity-header//以下代码读取全部的头标记
9 T& q% h7 Q2 M4 k0 w8 xwhile (entity-header not empty) {9 L: U/ K  ]0 h5 P8 R3 L) k
append entity-header to existing header fields# e% ~- c  ^" G" T3 l* E
read entity-header
: |5 u" ], w9 N! g/ J0 x/ E}
( s5 @8 w' |2 d! N4 Wcontent-length := length//头标记中添加内容长度8 z: D# N$ ?8 B1 b
remove chunked from transfer-encoding//头标记中移除transfer-encoding
) |4 i, [8 b* _8 N- Q$ ~( R有空再研究一下gzip+chunked是如何编码的,估计是每个chunk块进行一次gzip独立压缩。
# ^( m7 P/ C( a9 Q  P/ r2 C使用了chunked,自然会在性能上稍微打点折扣,因为比正常的数据体多出了一些额外的消耗。! g1 [6 d2 r. c+ E
但是有一些情况下,必需要使用分块输出,这也是不得已而为之.
4 \( v% g+ |4 l  E( s
" Q5 {7 O7 i& F$ O1 W更多网页制作信息请查看: 网页制作

回复|共 8 个

gevaemaidovef 发表于 2016-3-24 15:23:38|Reserved | 查看全部
楼猪.重量级人物阿.
Mqokjdvq 发表于 2016-3-24 15:24:17|加拿大 | 查看全部
笨点也好~~~~
seazvyt 发表于 2016-3-24 15:24:19|英国 | 查看全部
我又回复了
tohme 发表于 2016-3-24 15:24:27|韩国 | 查看全部
cd:遮~~~~~~
tohme 发表于 2016-4-1 11:59:35|美国 | 查看全部
这话从何说起那~~~
buingeEvineus 发表于 2016-4-1 11:59:36|美国 | 查看全部
唉!猪!你怎么了?
GoodyFouppy 发表于 2016-4-1 12:00:15|美国 | 查看全部
这就是我斗胆的一点粗略分析,每天睡觉以前,我都会把您的帖子再三拜读,拜读。
bqtklouu 发表于 2016-4-1 12:00:44|美国 | 查看全部
你该这么说~~

回复

您需要登录后才可以回帖 登录 | 立即注册

本版积分规则

得知互动是一个融创意、设计、开发、营销、生活、互联网于一体的专业交流分享平台。
Copyright © 2026 得知互动-专注Ai与站长技术交流社区-Ai交流平台 版权所有 All Rights Reserved. Powered by Discuz! X5.0 鄂ICP备15006301号-5|鄂公网安备 42018502006730号
关灯 在本版发帖 扫一扫添加QQ客服 返回顶部
快速回复 返回顶部 返回列表