Python----字符编码方法

2024-04-15 05:08
文章标签 python 字符 编码方法

本文主要是介绍Python----字符编码方法,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

Python----字符编码方法

标签:  python 字符 ascii    python 字符串 字节    python 字节处理  
转自:  http://blog.csdn.net/scuhmz/article/details/16987891
ASCII标准在美国创建,并且定义了大多数美国程序员使用的文本字符串表示法。ASCII定义了从0到127的字符代码,并且允许每个字符存储在一个8位的字节中(实际上,只 
有其中的7位真正用到)。例如,ASCII标准把字符'a'映射为整数值97(十六进制中的0x61),它存储在内存和文件的一个单个字节中。如果想要看到这是如何工作的, 
Python的内置函数ord给出了一个字符的二进制值,并且chr针对一个给定的整数代码值 

返回其字符:


>>> ord('a') 
# 'a' is a byte with binary value 97 in ASCII 
97 
>>> hex(97) 
'0x61' 
>>> chr(97) 
# Binary value 97 stands for character 'a' 

'a'


编码是根据一个想要的编码名称,把一个字符串翻译为其原始字节形式
解码是根据其编码名称,把一个原始字节串翻译为字符串形式的过程

更程序化地说,字节和字符串之间的来回转换!

ASCII是UTF-8的一个7位的子集

对于所有小于128的字符代码,UTF-8编码与ASCII是二进制兼容的

但是,所有这些,ASCII、Latin-1、UTF-8以及很多其他的编码,都被认为是Unicode。

Unicode可以理解为一种规范。


Python的字符串类型
具体来说,Python语言提供了字符串类型在脚本中表示字符文本。在脚本中所使用的字
符串类型取决于所使用的Python的版本。Python 2.X有一种通用的字符串类型来表示二进
制数据和像ASCII这样的8位文本,还有一种特定的类型用来表示多字节Unicode文本:
str表示8位文本和二进制数据。
unicode用来表示宽字符Unicode文本。

Python 2.X的两种字符串类型是不同的(unicode考虑到字符的额外大小并且支持编码和
解码),但是,它们的操作集大多是重叠的。Python 2.X中的str字符串类型用于可以用8
位字节表示的文本,以及绝对字节值所表示的二进制数据。
相反,Python 3.X带有3种字符串对象类型——一种用于文本数据,两种用于二进制数
据:
str表示Unicode文本(8位的和更宽的)。
bytes表示二进制数据。
bytearray,是一种可变的bytes类型。

Python 3.0中所有3种字符串类型都支持类似的操作集,但是,它们都有不同的角色。
Python 3.X之后关于这一修改的主要目标是,把Python 2.X中常规的和Unicode字符串
类型合并到一个单独的字符串类型中,以支持常规的和Unicode文本:开发者想要删除
Python 2.X中的字符串区分,并且让Unicode的处理更加自然。假设ASCII和其他的8位文
本真的是一种简单的Unicode,这种融合听起来很符合逻辑


在Python2.6中,我们可以对简单的文本使用str并且对文本的更高级的形式使用二进制数据和
unicode;在Python 3.0中,我们将针对任何类型的文本(简单的和Unicode)使用str,
并且针对二进制数据使用bytes或bytearray。

这篇关于Python----字符编码方法的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!


原文地址:
本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若转载,请注明出处:http://www.chinasem.cn/article/904898

相关文章

使用Python和Matplotlib实现可视化字体轮廓(从路径数据到矢量图形)

《使用Python和Matplotlib实现可视化字体轮廓(从路径数据到矢量图形)》字体设计和矢量图形处理是编程中一个有趣且实用的领域,通过Python的matplotlib库,我们可以轻松将字体轮廓... 目录背景知识字体轮廓的表示实现步骤1. 安装依赖库2. 准备数据3. 解析路径指令4. 绘制图形关键

详解如何使用Python从零开始构建文本统计模型

《详解如何使用Python从零开始构建文本统计模型》在自然语言处理领域,词汇表构建是文本预处理的关键环节,本文通过Python代码实践,演示如何从原始文本中提取多尺度特征,并通过动态调整机制构建更精确... 目录一、项目背景与核心思想二、核心代码解析1. 数据加载与预处理2. 多尺度字符统计3. 统计结果可

Python中OpenCV与Matplotlib的图像操作入门指南

《Python中OpenCV与Matplotlib的图像操作入门指南》:本文主要介绍Python中OpenCV与Matplotlib的图像操作指南,本文通过实例代码给大家介绍的非常详细,对大家的学... 目录一、环境准备二、图像的基本操作1. 图像读取、显示与保存 使用OpenCV操作2. 像素级操作3.

Python使用FFmpeg实现高效音频格式转换工具

《Python使用FFmpeg实现高效音频格式转换工具》在数字音频处理领域,音频格式转换是一项基础但至关重要的功能,本文主要为大家介绍了Python如何使用FFmpeg实现强大功能的图形化音频转换工具... 目录概述功能详解软件效果展示主界面布局转换过程截图完成提示开发步骤详解1. 环境准备2. 项目功能结

使用Python实现Windows系统垃圾清理

《使用Python实现Windows系统垃圾清理》Windows自带的磁盘清理工具功能有限,无法深度清理各类垃圾文件,所以本文为大家介绍了如何使用Python+PyQt5开发一个Windows系统垃圾... 目录一、开发背景与工具概述1.1 为什么需要专业清理工具1.2 工具设计理念二、工具核心功能解析2.

Python实现一键PDF转Word(附完整代码及详细步骤)

《Python实现一键PDF转Word(附完整代码及详细步骤)》pdf2docx是一个基于Python的第三方库,专门用于将PDF文件转换为可编辑的Word文档,下面我们就来看看如何通过pdf2doc... 目录引言:为什么需要PDF转Word一、pdf2docx介绍1. pdf2docx 是什么2. by

Python函数返回多个值的多种方法小结

《Python函数返回多个值的多种方法小结》在Python中,函数通常用于封装一段代码,使其可以重复调用,有时,我们希望一个函数能够返回多个值,Python提供了几种不同的方法来实现这一点,需要的朋友... 目录一、使用元组(Tuple):二、使用列表(list)三、使用字典(Dictionary)四、 使

Python程序的文件头部声明小结

《Python程序的文件头部声明小结》在Python文件的顶部声明编码通常是必须的,尤其是在处理非ASCII字符时,下面就来介绍一下两种头部文件声明,具有一定的参考价值,感兴趣的可以了解一下... 目录一、# coding=utf-8二、#!/usr/bin/env python三、运行Python程序四、

python web 开发之Flask中间件与请求处理钩子的最佳实践

《pythonweb开发之Flask中间件与请求处理钩子的最佳实践》Flask作为轻量级Web框架,提供了灵活的请求处理机制,中间件和请求钩子允许开发者在请求处理的不同阶段插入自定义逻辑,实现诸如... 目录Flask中间件与请求处理钩子完全指南1. 引言2. 请求处理生命周期概述3. 请求钩子详解3.1

使用Python实现网页表格转换为markdown

《使用Python实现网页表格转换为markdown》在日常工作中,我们经常需要从网页上复制表格数据,并将其转换成Markdown格式,本文将使用Python编写一个网页表格转Markdown工具,需... 在日常工作中,我们经常需要从网页上复制表格数据,并将其转换成Markdown格式,以便在文档、邮件或