Unicode/ASCII/UTF的关系(模板字面量、模板字符串、占位符)

2024-02-29 06:04

本文主要是介绍Unicode/ASCII/UTF的关系(模板字面量、模板字符串、占位符),希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

字符串:编程时最重要的数据类型之一。

正则表达式:赋予开发者更多操作字符串的能力。

1、 Unicode和ASCII

1.1 概述

Unicode是ASCII字符编码的一个扩展,只不过在Windows中,用两个字节对其进行编码,也称为宽字符集(WideChars)。Unicode字符串有多种编码方式,常见的有UTF-8、UTF-16、UTF-32等,这些编码方式定义了如何将Unicode码点映射到字节序列。

1.2 Unicode和ASCII的关联

最开始,Internet上只有一种字符集----ANSI的ASCII字符集,它使用7bits来表示一个字符,总共表示128个字符,其中包括了英文字母、数字、标点符号等常用字符。

之后,进行了扩展,使用8bits表示一个字符,可以表示256个字符,主要在原来的7bits字符集的基础上加入了一些特殊符号。

再后来,各国语言的加入,ASCII已不能满足信息交流的需要,为了能够表示其他国家的文字,各国在ASCII的基础上制定了自己的字符集,即ANSI字符集(MBCS多字节字符系统),常见的GB-2312就是其中之一。

Unicode的诞生:不同ANSI编码之间互不兼容,为了统一所有文字的编码,Unicode应运而生。Unicode把所有语言都统一到一套编码里。

1.3 ASCII和Unicode的对比

(1)编码范围

  • ASCII : 最早定义了128个字符,用于表示基本的英文字符、数字和一些控制字符。
  • Unicode:是一个更大的字符集,旨在包含世界上几乎所有的书写系统的字符,以及许多其他符号和特殊符号。Unicode目前包含超过130,000个字符。

(2)表示方式

  • ASCII : 每个字符用一个字节(8位)表示。
  • Unicode:最初采用了两个字节(16位)的表示方式,但随后由于字符数量的增加,也引入了更多占用空间更大的表示方式,如UTF-8/UTF-16等。

(3)应用范围

  • ASCII : 主要用于英文字符,不支持其他语言的字符。
  • Unicode:旨在支持全球范围的字符,适用于多语言文本。

(4)兼容性

  • ASCII : 是Unicode的一个子集,ASCII字符的编码与Unicode编码相同。
  • Unicode:包含了ASCII字符,并为其他字符提供了更多的编码空间。

1.4 总结

Unicode是一个更为全面和通用的字符编码标准,允许表示世界上所有语言的字符。ASCII主要是用于英文,是Unicode的一个子集,Unicode的引入解决了多语言环境中字符编码的问题。

2、Unicode和UTF

(1)Unicode

  • Unicode是一个字符集,定义了每个字符的唯一编号,称为码点。这个编号是用十六进制表示的,例如U+0041表示字符‘A’。
  • Unicode提供了一个标准,让不同的系统和应用程序使用相同的编号来表示相同的字符,从而实现字符的统一。

 (2)UTF

  • UTF是以一种字符编码方案,它定义了如何将Unicode中的码点编码为字节序列以及如何从字节序列解码回码点。
  • UTF-8:使用1到4个字节来表示一个字符,是一种变长编码。
  • UTF-16:使用2到4个字节来表示一个字符,是一种变长编码。
  • UTF-32:使用4个字节来表示一个字符,是一种定长编码。

(3)总结

Unicode是一个字符集,而UTF是一种编码方式,用于在计算机系统中存储和传输Unicode字符。UTF编码方案将Unicode码点转换成实际的字节序列,以便在计算机中进行处理。Unicode提供了字符的标准,而UTF提供了一种在计算机中处理这些字符的方法。 

3、模板字面量

 模板字面量是用反引号(`)分割的字面量,允许多行字符串、带嵌入表达式的字符串插值和一种带标签的模板的特殊结构。

模板字面量有时也被称为模板字符串,因为它们最常用作字符串插值。

4、字符串占位符

在一个模板字面量中,你可以把任何合法的JavaScript表达式嵌入到占位符中,并将其作为字符串的一部分输出到结果中。

占位符由一个左侧的 ${  和右侧的 } 符号组成,中间可以包含任意的JavaScript表达式。

let name = "yff";
let message = `hello ${name}`;
console.log(message);//hello yff

这篇关于Unicode/ASCII/UTF的关系(模板字面量、模板字符串、占位符)的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/757797

相关文章

java中新生代和老生代的关系说明

《java中新生代和老生代的关系说明》:本文主要介绍java中新生代和老生代的关系说明,具有很好的参考价值,希望对大家有所帮助,如有错误或未考虑完全的地方,望不吝赐教... 目录一、内存区域划分新生代老年代二、对象生命周期与晋升流程三、新生代与老年代的协作机制1. 跨代引用处理2. 动态年龄判定3. 空间分

MySQL查询JSON数组字段包含特定字符串的方法

《MySQL查询JSON数组字段包含特定字符串的方法》在MySQL数据库中,当某个字段存储的是JSON数组,需要查询数组中包含特定字符串的记录时传统的LIKE语句无法直接使用,下面小编就为大家介绍两种... 目录问题背景解决方案对比1. 精确匹配方案(推荐)2. 模糊匹配方案参数化查询示例使用场景建议性能优

python删除xml中的w:ascii属性的步骤

《python删除xml中的w:ascii属性的步骤》使用xml.etree.ElementTree删除WordXML中w:ascii属性,需注册命名空间并定位rFonts元素,通过del操作删除属... 可以使用python的XML.etree.ElementTree模块通过以下步骤删除XML中的w:as

MySQL 获取字符串长度及注意事项

《MySQL获取字符串长度及注意事项》本文通过实例代码给大家介绍MySQL获取字符串长度及注意事项,本文通过实例代码给大家介绍的非常详细,对大家的学习或工作具有一定的参考借鉴价值,需要的朋友参考下吧... 目录mysql 获取字符串长度详解 核心长度函数对比⚠️ 六大关键注意事项1. 字符编码决定字节长度2

Springboot3+将ID转为JSON字符串的详细配置方案

《Springboot3+将ID转为JSON字符串的详细配置方案》:本文主要介绍纯后端实现Long/BigIntegerID转为JSON字符串的详细配置方案,s基于SpringBoot3+和Spr... 目录1. 添加依赖2. 全局 Jackson 配置3. 精准控制(可选)4. OpenAPI (Spri

使用Python实现base64字符串与图片互转的详细步骤

《使用Python实现base64字符串与图片互转的详细步骤》要将一个Base64编码的字符串转换为图片文件并保存下来,可以使用Python的base64模块来实现,这一过程包括解码Base64字符串... 目录1. 图片编码为 Base64 字符串2. Base64 字符串解码为图片文件3. 示例使用注意

golang float和科学计数法转字符串的实现方式

《golangfloat和科学计数法转字符串的实现方式》:本文主要介绍golangfloat和科学计数法转字符串的实现方式,具有很好的参考价值,希望对大家有所帮助,如有错误或未考虑完全的地方,望... 目录golang float和科学计数法转字符串需要对float转字符串做处理总结golang float

Python如何判断字符串中是否包含特殊字符并替换

《Python如何判断字符串中是否包含特殊字符并替换》这篇文章主要为大家详细介绍了如何使用Python实现判断字符串中是否包含特殊字符并使用空字符串替换掉,文中的示例代码讲解详细,感兴趣的小伙伴可以了... 目录python判断字符串中是否包含特殊字符方法一:使用正则表达式方法二:手动检查特定字符Pytho

MySQL 字符串截取函数及用法详解

《MySQL字符串截取函数及用法详解》在MySQL中,字符串截取是常见的操作,主要用于从字符串中提取特定部分,MySQL提供了多种函数来实现这一功能,包括LEFT()、RIGHT()、SUBST... 目录mysql 字符串截取函数详解RIGHT(str, length):从右侧截取指定长度的字符SUBST

Python将字符串转换为小写字母的几种常用方法

《Python将字符串转换为小写字母的几种常用方法》:本文主要介绍Python中将字符串大写字母转小写的四种方法:lower()方法简洁高效,手动ASCII转换灵活可控,str.translate... 目录一、使用内置方法 lower()(最简单)二、手动遍历 + ASCII 码转换三、使用 str.tr