【C++】POCO学习总结(十五):字符串操作

2023-12-14 01:28

本文主要是介绍【C++】POCO学习总结(十五):字符串操作,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

【C++】郭老二博文之:C++目录

1、简介

POCO提供一些函数来处理 std::string 和 std::wstring;
比如:

  • 去除空格
  • 大小写转换
  • 不区分大小写比较
  • 字符转换和子字符串替换
  • 连接

许多函数有两种变体:

  • 返回一个新字符串而不修改原字符串的函数;
  • 直接修改原始字符串的函数(函数名后面附加了inPlace);
  • 所有函数都在Poco命名空间中。

2、去除空格

2.1 说明

  • std::[w]string trimLeft(const std::[w]string& str):返回str副本,副本中前面的空格将被删除
  • std::[w]string& trimLeftInPlace(std::[w]string& str):从str中删除前面的空格并返回对它的引用
  • std::[w]string trimRight(const std::[w]string& str):返回str的副本,副本中末尾的空格将被删除
  • std::[w]string trimRightInPlace(std::[w]string& str):从str中删除末尾空格并返回对它的引用
  • Std::[w]string trim(const Std::[w]string& str):返回str的副本,副本中删除前后空格
  • std::[w]string trimInPlace(std::[w]string& str):从str中删除前后空格,并返回对它的引用

2.2 用法

#include <Poco/String.h>
using Poco::trim;
using Poco::trimLeft;
using Poco::trimRight;
using Poco::trimRightInPlace;
int main(int argc, char** argv)
{std::string hello(" Hello, world! ");std::string s1(trimLeft(hello)); // "Hello, world! "trimRightInPlace(s1); // "Hello, world!"std::string s2(trim(hello)); // "Hello, world!"return 0;
}

3、大小写转换

3.1 说明

  • std::[w]string toUpper(const std::[w]string& str):返回一个str的副本,其中所有字符都转换为大写
  • std::[w]string toLower(const std::[w]string& str):返回一个str的副本,其中所有字符都转换为小写
  • std::[w]string& toUpperInPlace(std::[w]string& str) :将str中所有字符都转换为大写,并返回对它的引用
  • std::[w]string& toLowerInPlace(std::[w]string& str):将str中所有字符都转换为小写,并返回对它的引用
  • int icompare(const std::[w]string& str1, const std::[w]string& str2):不区分大小写的比较
    警告:这些函数不适用于UTF-8字符串。

3.2 用法

#include "Poco/String.h"
using Poco::toUpper;
using Poco::toLower;
using Poco::toLowerInPlace;
using Poco::icompare;
int main(int argc, char** argv)
{std::string hello("Hello, world!");std::string s1(toUpper(hello)); // "HELLO, WORLD!"toLowerInPlace(s1); // "hello, world!"int rc = icompare(hello, s1); // 0rc = icompare(hello, "Hello, Universe!"); // 1return 0;
}

4、替换、拼接

4.1 说明

1)替换字符

  • std::::[w]string translate(const std::[w]string& str, const std::[w]string& from, const std::[w]string& to)
    返回str的副本,其中from中的所有字符替换为to中相应的(按位置)字符。如果to中没有对应的字符,则删除该字符。
  • std::[w]string& translateInPlace(std::[w]string& str, const std::[w]string& from, const std::[w]string& to)
    返回修改后的str,其中from中的所有字符替换为to中相应的(按位置)字符。如果to中没有对应的字符,则删除该字符。

2)子字符串替换

  • std::[w]string replace(const std::[w]string& str, const std::[w]string& from, const std::[w]string& to)
    返回str的副本,其中出现from中给出的子字符串的所有都替换为to中给出的字符串。
  • std::[w]string& replaceInPlace(std::[w]string& str, const std::[w]string& from, const std::[w]string& to)
    返回修改后str,其中出现from中给出的子字符串的所有都替换为to中给出的字符串。

3)拼接

  • std::[w]string cat(const std::[w]string& s1, const std::[w]string& s2 [, const std::[w]string& s3 [,…]])
    最多连接六个字符串并返回结果
  • template <class S, class It>
    S cat(const S& delimiter, const It& begin, const It& end)
    连接[It, end]范围内的所有字符串,中间添加delimiter分隔符

4.2 用法

#include "Poco/String.h"
#include <vector>using Poco::translateInPlace;
using Poco::replace;
using Poco::cat;int main(int argc, char** argv)
{std::string s1("Eiffel Tower");translateInPlace(s1, "Eelo", "3310"); // "3iff31 T0w3r"std::string s2("aabbcc");std::string r(replace(s2, "aa", "AA")); // "AAbbcc"r = replace(s2, "bb", "xxx"); // "aaxxxcc"r = replace(s2, "bbcc", ""); // "aa"std::vector<std::string> colors;colors.push_back("red");colors.push_back("green");colors.push_back("blue");std::string s3;s3 = cat(std::string(", "), colors.begin(), colors.end()); //"red, green, blue"return 0;
}

5、Poco::NumberFormatter 数字格式化为字符串

Poco::NumberFormatter提供静态方法将数字格式化为字符串,其内部为使用std::sprintf()来实现

  • std::string format(int value):格式化为一个十进制整数类型字符串
  • std::string format(int value, int width):格式化为一个十进制整数类型字符串,指定最小宽度width,不足时,右补空格
  • std::string format0(int value, int width):格式化为一个十进制整数类型字符串,指定最小宽度width,不足时,右补充
  • std::string formatHex(int value):格式化为一个十六进制的整数类型字符串
  • std::string formatHex(int value, int width):式化为一个十六进制整数类型字符串,指定最小宽度width,不足时,右补充
  • std::string format(const void* ptr):将指针ptr格式化为8位(32位系统)或16位(64系统)的字符串,十六进制形式
  • std::string format(double value):格式化为十进制浮点表示法格式化浮点字符串,精度为八位小数
  • std::string format(double value, int precision):格式化为十进制浮点数表示浮点字符串,带有精确的小数位数
  • std::string format(double value, int width, int precision):格式化为十进制浮点数形式的浮点字符串,在指定宽度的字段中右对齐,带有精确的小数位数
#include "Poco/NumberFormatter.h"
using Poco::NumberFormatter;
int main(int argc, char** argv)
{
std::string s;
s = NumberFormatter::format(123); // "123"
s = NumberFormatter::format(123, 5); // " 123"
s = NumberFormatter::format(-123, 5); // " -123"
s = NumberFormatter::format(12345, 3); // "12345"
s = NumberFormatter::format0(123, 5); // "00123"
s = NumberFormatter::formatHex(123); // "7B"
s = NumberFormatter::formatHex(123, 4); // "007B"
s = NumberFormatter::format(1.5); // "1.5"
s = NumberFormatter::format(1.5, 2); // "1.50"
s = NumberFormatter::format(1.5, 5, 2); // " 1.50"
s = NumberFormatter::format(&s); // "00235F7D"
return 0;
}

6、Poco::NumberParser 从字符串中提取数字

Poco::NumberParser类的静态成员函数可用于从字符串中解析数字。

  • Int parse(const std::string& str):从str中解析十进制形式的整数值,如果字符串不包含有效的数字,则抛出异常:SyntaxException。
  • bool tryParse(const std::string& str, int& value):从str中解析十进制的整数值,并将其存储在value中。如果数字有效则返回true。否则返回false;在这种情况下Value是未定义的。
  • unsigned parseUnsigned(const std::string& str):解析无符号的
  • bool tryParseUnsigned(const std::string& str, unsigned& value)
  • unsigned parseHex(const std::string& str):解析十六进制
  • bool tryParseHex(const std::string& str, unsigned& value)
  • Int64 parse64(const std::string& str):解析Int64
  • bool tryParse64(const std::string& str Int64& value)
  • UInt64 parseUnsigned64(const std::string& str):解析无符号的UInt64
  • bool tryParseUnsigned64(const std::string& str UInt64& value)
  • UInt64 parseHex64(const std::string& str):解析64位的十六进制
  • bool tryParseHex64(const std::string& str UInt64& value)
  • double parseFloat(const std::string& str):解析浮点型
  • bool tryParseFloat(const std::string& str, double& value)

7、Poco::StringTokenizer 拆分字符串

#include "Poco/StringTokenizer.h"
#include "Poco/String.h" // for cat
using Poco::StringTokenizer;
using Poco::cat;
int main(int argc, char** argv)
{StringTokenizer t1("red, green, blue", ",");// "red", " green", " blue" (note the whitespace)StringTokenizer t2("red,green,,blue", ",");// "red", "green", "", "blue"StringTokenizer t3("red; green, blue", ",;",StringTokenizer::TOK_TRIM);// "red", "green", "blue"StringTokenizer t4("red; green,, blue", ",;",StringTokenizer::TOK_TRIM | StringTokenizer::TOK_IGNORE_EMPTY);// "red", "green", "blue"std::string s(cat(std::string("; "), t4.begin(), t4.end()));// "red; green; blue"return 0;
}

8、Poco::RegularExpression 正则表达式

在POCO中使用 Poco::RegularExpression 来实现正则表达式
头文件: #include “Poco/ regulareexpression .h”
Poco:: RegularExpression 在内部使用PCRE库(Perl兼容正则表达式)。

用正则表达式匹配(match)、提取(extract)、分割(split)、替换子字符串(subst)

#include "Poco/RegularExpression.h"
#include <vector>
using Poco::RegularExpression;
int main(int argc, char** argv)
{RegularExpression re1("[0-9]+");bool match = re1.match("123"); // truematch = re1.match("abc"); // falsematch = re1.match("abc123", 3); // trueRegularExpression::Match pos;re1.match("123", 0, pos); // pos.offset == 0, pos.length == 3re1.match("ab12de", 0, pos); // pos.offset == 2, pos.length == 2re1.match("abcd", 0, pos); // pos.offset == std::string::nposRegularExpression re2("([0-9]+) ([0-9]+)");RegularExpression::MatchVec posVec;re2.match("123 456", 0, posVec);// posVec[0].offset == 0, posVec[0].length == 7// posVec[1].offset == 0, posVec[1].length == 3// posVec[2].offset == 4, posVec[2].length == 3std::string s;int n = re1.extract("123", s); // n == 1, s == "123"n = re1.extract("ab12de", 0, s); // n == 1, s == "12"n = re1.extract("abcd", 0, s); // n == 0, s == ""std::vector<std::string> vec;re2.split("123 456", 0, vec);// vec[0] == "123"// vec[1] == "456"s = "123";re1.subst(s, "ABC"); // s == "ABC"s = "123 456";re2.subst(s, "$2 $1"); // s == "456 123"RegularExpression re3("ABC");RegularExpression re4("ABC", RegularExpression::RE_CASELESS);match = re3.match("abc", 0); // falsematch = re4.match("abc", 0); // truereturn 0;
}

9、Poco::TextConverter 字符编码转换

Poco::TextConverter 实现在不同字符编码之间转换字符串

#include "Poco/TextConverter.h"
#include "Poco/Latin1Encoding.h"
#include "Poco/UTF8Encoding.h"
#include <iostream>
using Poco::TextConverter;
using Poco::Latin1Encoding;
using Poco::UTF8Encoding;
int main(int argc, char** argv)
{std::string latin1String("This is Latin-1 encoded text.");std::string utf8String;Latin1Encoding latin1;UTF8Encoding utf8;TextConverter converter(latin1, utf8);converter.convert(latin1String, utf8String);std::cout << utf8String << std::endl;return 0;
}

10、流中字符转换

  • Poco::OutputStreamConverter:作为一个过滤器,在将所有写入它的字符传递到另一个流之前,将它们转换为另一种编码。
  • Poco::InputStreamConverter:作为过滤器,从另一个流读取字符并将其转换为另一种编码,然后将它们传递给阅读器。
#include "Poco/StreamConverter.h"
#include "Poco/Latin1Encoding.h"
#include "Poco/UTF8Encoding.h"
#include <iostream>
using Poco::OutputStreamConverter;
using Poco::Latin1Encoding;
using Poco::UTF8Encoding;
int main(int argc, char** argv)
{std::string latin1String("This is Latin-1 encoded text.");Latin1Encoding latin1;UTF8Encoding utf8;OutputStreamConverter converter(std::cout, latin1, utf8);converter << latin1String << std::endl; // console output will be UTF-8return 0;
}

11、字符编码

Poco::Unicode:提供了对Unicode字符属性(字符类别、字符类型、脚本)的基本支持
Poco::UTF8:处理UTF-8编码的字符串

这篇关于【C++】POCO学习总结(十五):字符串操作的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/490654

相关文章

关于C++中的虚拟继承的一些总结(虚拟继承,覆盖,派生,隐藏)

1.为什么要引入虚拟继承 虚拟继承是多重继承中特有的概念。虚拟基类是为解决多重继承而出现的。如:类D继承自类B1、B2,而类B1、B2都继承自类A,因此在类D中两次出现类A中的变量和函数。为了节省内存空间,可以将B1、B2对A的继承定义为虚拟继承,而A就成了虚拟基类。实现的代码如下: class A class B1:public virtual A; class B2:pu

C++对象布局及多态实现探索之内存布局(整理的很多链接)

本文通过观察对象的内存布局,跟踪函数调用的汇编代码。分析了C++对象内存的布局情况,虚函数的执行方式,以及虚继承,等等 文章链接:http://dev.yesky.com/254/2191254.shtml      论C/C++函数间动态内存的传递 (2005-07-30)   当你涉及到C/C++的核心编程的时候,你会无止境地与内存管理打交道。 文章链接:http://dev.yesky

51单片机学习记录———定时器

文章目录 前言一、定时器介绍二、STC89C52定时器资源三、定时器框图四、定时器模式五、定时器相关寄存器六、定时器练习 前言 一个学习嵌入式的小白~ 有问题评论区或私信指出~ 提示:以下是本篇文章正文内容,下面案例可供参考 一、定时器介绍 定时器介绍:51单片机的定时器属于单片机的内部资源,其电路的连接和运转均在单片机内部完成。 定时器作用: 1.用于计数系统,可

C++的模板(八):子系统

平常所见的大部分模板代码,模板所传的参数类型,到了模板里面,或实例化为对象,或嵌入模板内部结构中,或在模板内又派生了子类。不管怎样,最终他们在模板内,直接或间接,都实例化成对象了。 但这不是唯一的用法。试想一下。如果在模板内限制调用参数类型的构造函数会发生什么?参数类的对象在模板内无法构造。他们只能从模板的成员函数传入。模板不保存这些对象或者只保存他们的指针。因为构造函数被分离,这些指针在模板外

问题:第一次世界大战的起止时间是 #其他#学习方法#微信

问题:第一次世界大战的起止时间是 A.1913 ~1918 年 B.1913 ~1918 年 C.1914 ~1918 年 D.1914 ~1919 年 参考答案如图所示

[word] word设置上标快捷键 #学习方法#其他#媒体

word设置上标快捷键 办公中,少不了使用word,这个是大家必备的软件,今天给大家分享word设置上标快捷键,希望在办公中能帮到您! 1、添加上标 在录入一些公式,或者是化学产品时,需要添加上标内容,按下快捷键Ctrl+shift++就能将需要的内容设置为上标符号。 word设置上标快捷键的方法就是以上内容了,需要的小伙伴都可以试一试呢!

AssetBundle学习笔记

AssetBundle是unity自定义的资源格式,通过调用引擎的资源打包接口对资源进行打包成.assetbundle格式的资源包。本文介绍了AssetBundle的生成,使用,加载,卸载以及Unity资源更新的一个基本步骤。 目录 1.定义: 2.AssetBundle的生成: 1)设置AssetBundle包的属性——通过编辑器界面 补充:分组策略 2)调用引擎接口API

C++工程编译链接错误汇总VisualStudio

目录 一些小的知识点 make工具 可以使用windows下的事件查看器崩溃的地方 dumpbin工具查看dll是32位还是64位的 _MSC_VER .cc 和.cpp 【VC++目录中的包含目录】 vs 【C/C++常规中的附加包含目录】——头文件所在目录如何怎么添加,添加了以后搜索头文件就会到这些个路径下搜索了 include<> 和 include"" WinMain 和

RedHat运维-Linux文本操作基础-AWK进阶

你不用整理,跟着敲一遍,有个印象,然后把它保存到本地,以后要用再去看,如果有了新东西,你自个再添加。这是我参考牛客上的shell编程专项题,只不过换成了问答的方式而已。不用背,就算是我自己亲自敲,我现在好多也记不住。 1. 输出nowcoder.txt文件第5行的内容 2. 输出nowcoder.txt文件第6行的内容 3. 输出nowcoder.txt文件第7行的内容 4. 输出nowcode

Javascript高级程序设计(第四版)--学习记录之变量、内存

原始值与引用值 原始值:简单的数据即基础数据类型,按值访问。 引用值:由多个值构成的对象即复杂数据类型,按引用访问。 动态属性 对于引用值而言,可以随时添加、修改和删除其属性和方法。 let person = new Object();person.name = 'Jason';person.age = 42;console.log(person.name,person.age);//'J