Unicode/ASCII/UTF的关系(模板字面量、模板字符串、占位符)

2024-02-29 06:04

本文主要是介绍Unicode/ASCII/UTF的关系(模板字面量、模板字符串、占位符),希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

字符串:编程时最重要的数据类型之一。

正则表达式:赋予开发者更多操作字符串的能力。

1、 Unicode和ASCII

1.1 概述

Unicode是ASCII字符编码的一个扩展,只不过在Windows中,用两个字节对其进行编码,也称为宽字符集(WideChars)。Unicode字符串有多种编码方式,常见的有UTF-8、UTF-16、UTF-32等,这些编码方式定义了如何将Unicode码点映射到字节序列。

1.2 Unicode和ASCII的关联

最开始,Internet上只有一种字符集----ANSI的ASCII字符集,它使用7bits来表示一个字符,总共表示128个字符,其中包括了英文字母、数字、标点符号等常用字符。

之后,进行了扩展,使用8bits表示一个字符,可以表示256个字符,主要在原来的7bits字符集的基础上加入了一些特殊符号。

再后来,各国语言的加入,ASCII已不能满足信息交流的需要,为了能够表示其他国家的文字,各国在ASCII的基础上制定了自己的字符集,即ANSI字符集(MBCS多字节字符系统),常见的GB-2312就是其中之一。

Unicode的诞生:不同ANSI编码之间互不兼容,为了统一所有文字的编码,Unicode应运而生。Unicode把所有语言都统一到一套编码里。

1.3 ASCII和Unicode的对比

(1)编码范围

  • ASCII : 最早定义了128个字符,用于表示基本的英文字符、数字和一些控制字符。
  • Unicode:是一个更大的字符集,旨在包含世界上几乎所有的书写系统的字符,以及许多其他符号和特殊符号。Unicode目前包含超过130,000个字符。

(2)表示方式

  • ASCII : 每个字符用一个字节(8位)表示。
  • Unicode:最初采用了两个字节(16位)的表示方式,但随后由于字符数量的增加,也引入了更多占用空间更大的表示方式,如UTF-8/UTF-16等。

(3)应用范围

  • ASCII : 主要用于英文字符,不支持其他语言的字符。
  • Unicode:旨在支持全球范围的字符,适用于多语言文本。

(4)兼容性

  • ASCII : 是Unicode的一个子集,ASCII字符的编码与Unicode编码相同。
  • Unicode:包含了ASCII字符,并为其他字符提供了更多的编码空间。

1.4 总结

Unicode是一个更为全面和通用的字符编码标准,允许表示世界上所有语言的字符。ASCII主要是用于英文,是Unicode的一个子集,Unicode的引入解决了多语言环境中字符编码的问题。

2、Unicode和UTF

(1)Unicode

  • Unicode是一个字符集,定义了每个字符的唯一编号,称为码点。这个编号是用十六进制表示的,例如U+0041表示字符‘A’。
  • Unicode提供了一个标准,让不同的系统和应用程序使用相同的编号来表示相同的字符,从而实现字符的统一。

 (2)UTF

  • UTF是以一种字符编码方案,它定义了如何将Unicode中的码点编码为字节序列以及如何从字节序列解码回码点。
  • UTF-8:使用1到4个字节来表示一个字符,是一种变长编码。
  • UTF-16:使用2到4个字节来表示一个字符,是一种变长编码。
  • UTF-32:使用4个字节来表示一个字符,是一种定长编码。

(3)总结

Unicode是一个字符集,而UTF是一种编码方式,用于在计算机系统中存储和传输Unicode字符。UTF编码方案将Unicode码点转换成实际的字节序列,以便在计算机中进行处理。Unicode提供了字符的标准,而UTF提供了一种在计算机中处理这些字符的方法。 

3、模板字面量

 模板字面量是用反引号(`)分割的字面量,允许多行字符串、带嵌入表达式的字符串插值和一种带标签的模板的特殊结构。

模板字面量有时也被称为模板字符串,因为它们最常用作字符串插值。

4、字符串占位符

在一个模板字面量中,你可以把任何合法的JavaScript表达式嵌入到占位符中,并将其作为字符串的一部分输出到结果中。

占位符由一个左侧的 ${  和右侧的 } 符号组成,中间可以包含任意的JavaScript表达式。

let name = "yff";
let message = `hello ${name}`;
console.log(message);//hello yff

这篇关于Unicode/ASCII/UTF的关系(模板字面量、模板字符串、占位符)的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/757797

相关文章

JAVA中整型数组、字符串数组、整型数和字符串 的创建与转换的方法

《JAVA中整型数组、字符串数组、整型数和字符串的创建与转换的方法》本文介绍了Java中字符串、字符数组和整型数组的创建方法,以及它们之间的转换方法,还详细讲解了字符串中的一些常用方法,如index... 目录一、字符串、字符数组和整型数组的创建1、字符串的创建方法1.1 通过引用字符数组来创建字符串1.2

C#中字符串分割的多种方式

《C#中字符串分割的多种方式》在C#编程语言中,字符串处理是日常开发中不可或缺的一部分,字符串分割是处理文本数据时常用的操作,它允许我们将一个长字符串分解成多个子字符串,本文给大家介绍了C#中字符串分... 目录1. 使用 string.Split2. 使用正则表达式 (Regex.Split)3. 使用

Java中JSON字符串反序列化(动态泛型)

《Java中JSON字符串反序列化(动态泛型)》文章讨论了在定时任务中使用反射调用目标对象时处理动态参数的问题,通过将方法参数存储为JSON字符串并进行反序列化,可以实现动态调用,然而,这种方式容易导... 需求:定时任务扫描,反射调用目标对象,但是,方法的传参不是固定的。方案一:将方法参数存成jsON字

poj3468(线段树成段更新模板题)

题意:包括两个操作:1、将[a.b]上的数字加上v;2、查询区间[a,b]上的和 下面的介绍是下解题思路: 首先介绍  lazy-tag思想:用一个变量记录每一个线段树节点的变化值,当这部分线段的一致性被破坏我们就将这个变化值传递给子区间,大大增加了线段树的效率。 比如现在需要对[a,b]区间值进行加c操作,那么就从根节点[1,n]开始调用update函数进行操作,如果刚好执行到一个子节点,

C++11第三弹:lambda表达式 | 新的类功能 | 模板的可变参数

🌈个人主页: 南桥几晴秋 🌈C++专栏: 南桥谈C++ 🌈C语言专栏: C语言学习系列 🌈Linux学习专栏: 南桥谈Linux 🌈数据结构学习专栏: 数据结构杂谈 🌈数据库学习专栏: 南桥谈MySQL 🌈Qt学习专栏: 南桥谈Qt 🌈菜鸡代码练习: 练习随想记录 🌈git学习: 南桥谈Git 🌈🌈🌈🌈🌈🌈🌈🌈🌈🌈🌈🌈🌈�

poj 1258 Agri-Net(最小生成树模板代码)

感觉用这题来当模板更适合。 题意就是给你邻接矩阵求最小生成树啦。~ prim代码:效率很高。172k...0ms。 #include<stdio.h>#include<algorithm>using namespace std;const int MaxN = 101;const int INF = 0x3f3f3f3f;int g[MaxN][MaxN];int n

uva 1342 欧拉定理(计算几何模板)

题意: 给几个点,把这几个点用直线连起来,求这些直线把平面分成了几个。 解析: 欧拉定理: 顶点数 + 面数 - 边数= 2。 代码: #include <iostream>#include <cstdio>#include <cstdlib>#include <algorithm>#include <cstring>#include <cmath>#inc

uva 11178 计算集合模板题

题意: 求三角形行三个角三等分点射线交出的内三角形坐标。 代码: #include <iostream>#include <cstdio>#include <cstdlib>#include <algorithm>#include <cstring>#include <cmath>#include <stack>#include <vector>#include <

poj 2104 and hdu 2665 划分树模板入门题

题意: 给一个数组n(1e5)个数,给一个范围(fr, to, k),求这个范围中第k大的数。 解析: 划分树入门。 bing神的模板。 坑爹的地方是把-l 看成了-1........ 一直re。 代码: poj 2104: #include <iostream>#include <cstdio>#include <cstdlib>#include <al

最大流、 最小费用最大流终极版模板

最大流  const int inf = 1000000000 ;const int maxn = 20000 , maxm = 500000 ;struct Edge{int v , f ,next ;Edge(){}Edge(int _v , int _f , int _next):v(_v) ,f(_f),next(_next){}};int sourse , mee