【C++】POCO学习总结(十五):字符串操作

2023-12-14 01:28

本文主要是介绍【C++】POCO学习总结(十五):字符串操作,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

【C++】郭老二博文之:C++目录

1、简介

POCO提供一些函数来处理 std::string 和 std::wstring;
比如:

  • 去除空格
  • 大小写转换
  • 不区分大小写比较
  • 字符转换和子字符串替换
  • 连接

许多函数有两种变体:

  • 返回一个新字符串而不修改原字符串的函数;
  • 直接修改原始字符串的函数(函数名后面附加了inPlace);
  • 所有函数都在Poco命名空间中。

2、去除空格

2.1 说明

  • std::[w]string trimLeft(const std::[w]string& str):返回str副本,副本中前面的空格将被删除
  • std::[w]string& trimLeftInPlace(std::[w]string& str):从str中删除前面的空格并返回对它的引用
  • std::[w]string trimRight(const std::[w]string& str):返回str的副本,副本中末尾的空格将被删除
  • std::[w]string trimRightInPlace(std::[w]string& str):从str中删除末尾空格并返回对它的引用
  • Std::[w]string trim(const Std::[w]string& str):返回str的副本,副本中删除前后空格
  • std::[w]string trimInPlace(std::[w]string& str):从str中删除前后空格,并返回对它的引用

2.2 用法

#include <Poco/String.h>
using Poco::trim;
using Poco::trimLeft;
using Poco::trimRight;
using Poco::trimRightInPlace;
int main(int argc, char** argv)
{std::string hello(" Hello, world! ");std::string s1(trimLeft(hello)); // "Hello, world! "trimRightInPlace(s1); // "Hello, world!"std::string s2(trim(hello)); // "Hello, world!"return 0;
}

3、大小写转换

3.1 说明

  • std::[w]string toUpper(const std::[w]string& str):返回一个str的副本,其中所有字符都转换为大写
  • std::[w]string toLower(const std::[w]string& str):返回一个str的副本,其中所有字符都转换为小写
  • std::[w]string& toUpperInPlace(std::[w]string& str) :将str中所有字符都转换为大写,并返回对它的引用
  • std::[w]string& toLowerInPlace(std::[w]string& str):将str中所有字符都转换为小写,并返回对它的引用
  • int icompare(const std::[w]string& str1, const std::[w]string& str2):不区分大小写的比较
    警告:这些函数不适用于UTF-8字符串。

3.2 用法

#include "Poco/String.h"
using Poco::toUpper;
using Poco::toLower;
using Poco::toLowerInPlace;
using Poco::icompare;
int main(int argc, char** argv)
{std::string hello("Hello, world!");std::string s1(toUpper(hello)); // "HELLO, WORLD!"toLowerInPlace(s1); // "hello, world!"int rc = icompare(hello, s1); // 0rc = icompare(hello, "Hello, Universe!"); // 1return 0;
}

4、替换、拼接

4.1 说明

1)替换字符

  • std::::[w]string translate(const std::[w]string& str, const std::[w]string& from, const std::[w]string& to)
    返回str的副本,其中from中的所有字符替换为to中相应的(按位置)字符。如果to中没有对应的字符,则删除该字符。
  • std::[w]string& translateInPlace(std::[w]string& str, const std::[w]string& from, const std::[w]string& to)
    返回修改后的str,其中from中的所有字符替换为to中相应的(按位置)字符。如果to中没有对应的字符,则删除该字符。

2)子字符串替换

  • std::[w]string replace(const std::[w]string& str, const std::[w]string& from, const std::[w]string& to)
    返回str的副本,其中出现from中给出的子字符串的所有都替换为to中给出的字符串。
  • std::[w]string& replaceInPlace(std::[w]string& str, const std::[w]string& from, const std::[w]string& to)
    返回修改后str,其中出现from中给出的子字符串的所有都替换为to中给出的字符串。

3)拼接

  • std::[w]string cat(const std::[w]string& s1, const std::[w]string& s2 [, const std::[w]string& s3 [,…]])
    最多连接六个字符串并返回结果
  • template <class S, class It>
    S cat(const S& delimiter, const It& begin, const It& end)
    连接[It, end]范围内的所有字符串,中间添加delimiter分隔符

4.2 用法

#include "Poco/String.h"
#include <vector>using Poco::translateInPlace;
using Poco::replace;
using Poco::cat;int main(int argc, char** argv)
{std::string s1("Eiffel Tower");translateInPlace(s1, "Eelo", "3310"); // "3iff31 T0w3r"std::string s2("aabbcc");std::string r(replace(s2, "aa", "AA")); // "AAbbcc"r = replace(s2, "bb", "xxx"); // "aaxxxcc"r = replace(s2, "bbcc", ""); // "aa"std::vector<std::string> colors;colors.push_back("red");colors.push_back("green");colors.push_back("blue");std::string s3;s3 = cat(std::string(", "), colors.begin(), colors.end()); //"red, green, blue"return 0;
}

5、Poco::NumberFormatter 数字格式化为字符串

Poco::NumberFormatter提供静态方法将数字格式化为字符串,其内部为使用std::sprintf()来实现

  • std::string format(int value):格式化为一个十进制整数类型字符串
  • std::string format(int value, int width):格式化为一个十进制整数类型字符串,指定最小宽度width,不足时,右补空格
  • std::string format0(int value, int width):格式化为一个十进制整数类型字符串,指定最小宽度width,不足时,右补充
  • std::string formatHex(int value):格式化为一个十六进制的整数类型字符串
  • std::string formatHex(int value, int width):式化为一个十六进制整数类型字符串,指定最小宽度width,不足时,右补充
  • std::string format(const void* ptr):将指针ptr格式化为8位(32位系统)或16位(64系统)的字符串,十六进制形式
  • std::string format(double value):格式化为十进制浮点表示法格式化浮点字符串,精度为八位小数
  • std::string format(double value, int precision):格式化为十进制浮点数表示浮点字符串,带有精确的小数位数
  • std::string format(double value, int width, int precision):格式化为十进制浮点数形式的浮点字符串,在指定宽度的字段中右对齐,带有精确的小数位数
#include "Poco/NumberFormatter.h"
using Poco::NumberFormatter;
int main(int argc, char** argv)
{
std::string s;
s = NumberFormatter::format(123); // "123"
s = NumberFormatter::format(123, 5); // " 123"
s = NumberFormatter::format(-123, 5); // " -123"
s = NumberFormatter::format(12345, 3); // "12345"
s = NumberFormatter::format0(123, 5); // "00123"
s = NumberFormatter::formatHex(123); // "7B"
s = NumberFormatter::formatHex(123, 4); // "007B"
s = NumberFormatter::format(1.5); // "1.5"
s = NumberFormatter::format(1.5, 2); // "1.50"
s = NumberFormatter::format(1.5, 5, 2); // " 1.50"
s = NumberFormatter::format(&s); // "00235F7D"
return 0;
}

6、Poco::NumberParser 从字符串中提取数字

Poco::NumberParser类的静态成员函数可用于从字符串中解析数字。

  • Int parse(const std::string& str):从str中解析十进制形式的整数值,如果字符串不包含有效的数字,则抛出异常:SyntaxException。
  • bool tryParse(const std::string& str, int& value):从str中解析十进制的整数值,并将其存储在value中。如果数字有效则返回true。否则返回false;在这种情况下Value是未定义的。
  • unsigned parseUnsigned(const std::string& str):解析无符号的
  • bool tryParseUnsigned(const std::string& str, unsigned& value)
  • unsigned parseHex(const std::string& str):解析十六进制
  • bool tryParseHex(const std::string& str, unsigned& value)
  • Int64 parse64(const std::string& str):解析Int64
  • bool tryParse64(const std::string& str Int64& value)
  • UInt64 parseUnsigned64(const std::string& str):解析无符号的UInt64
  • bool tryParseUnsigned64(const std::string& str UInt64& value)
  • UInt64 parseHex64(const std::string& str):解析64位的十六进制
  • bool tryParseHex64(const std::string& str UInt64& value)
  • double parseFloat(const std::string& str):解析浮点型
  • bool tryParseFloat(const std::string& str, double& value)

7、Poco::StringTokenizer 拆分字符串

#include "Poco/StringTokenizer.h"
#include "Poco/String.h" // for cat
using Poco::StringTokenizer;
using Poco::cat;
int main(int argc, char** argv)
{StringTokenizer t1("red, green, blue", ",");// "red", " green", " blue" (note the whitespace)StringTokenizer t2("red,green,,blue", ",");// "red", "green", "", "blue"StringTokenizer t3("red; green, blue", ",;",StringTokenizer::TOK_TRIM);// "red", "green", "blue"StringTokenizer t4("red; green,, blue", ",;",StringTokenizer::TOK_TRIM | StringTokenizer::TOK_IGNORE_EMPTY);// "red", "green", "blue"std::string s(cat(std::string("; "), t4.begin(), t4.end()));// "red; green; blue"return 0;
}

8、Poco::RegularExpression 正则表达式

在POCO中使用 Poco::RegularExpression 来实现正则表达式
头文件: #include “Poco/ regulareexpression .h”
Poco:: RegularExpression 在内部使用PCRE库(Perl兼容正则表达式)。

用正则表达式匹配(match)、提取(extract)、分割(split)、替换子字符串(subst)

#include "Poco/RegularExpression.h"
#include <vector>
using Poco::RegularExpression;
int main(int argc, char** argv)
{RegularExpression re1("[0-9]+");bool match = re1.match("123"); // truematch = re1.match("abc"); // falsematch = re1.match("abc123", 3); // trueRegularExpression::Match pos;re1.match("123", 0, pos); // pos.offset == 0, pos.length == 3re1.match("ab12de", 0, pos); // pos.offset == 2, pos.length == 2re1.match("abcd", 0, pos); // pos.offset == std::string::nposRegularExpression re2("([0-9]+) ([0-9]+)");RegularExpression::MatchVec posVec;re2.match("123 456", 0, posVec);// posVec[0].offset == 0, posVec[0].length == 7// posVec[1].offset == 0, posVec[1].length == 3// posVec[2].offset == 4, posVec[2].length == 3std::string s;int n = re1.extract("123", s); // n == 1, s == "123"n = re1.extract("ab12de", 0, s); // n == 1, s == "12"n = re1.extract("abcd", 0, s); // n == 0, s == ""std::vector<std::string> vec;re2.split("123 456", 0, vec);// vec[0] == "123"// vec[1] == "456"s = "123";re1.subst(s, "ABC"); // s == "ABC"s = "123 456";re2.subst(s, "$2 $1"); // s == "456 123"RegularExpression re3("ABC");RegularExpression re4("ABC", RegularExpression::RE_CASELESS);match = re3.match("abc", 0); // falsematch = re4.match("abc", 0); // truereturn 0;
}

9、Poco::TextConverter 字符编码转换

Poco::TextConverter 实现在不同字符编码之间转换字符串

#include "Poco/TextConverter.h"
#include "Poco/Latin1Encoding.h"
#include "Poco/UTF8Encoding.h"
#include <iostream>
using Poco::TextConverter;
using Poco::Latin1Encoding;
using Poco::UTF8Encoding;
int main(int argc, char** argv)
{std::string latin1String("This is Latin-1 encoded text.");std::string utf8String;Latin1Encoding latin1;UTF8Encoding utf8;TextConverter converter(latin1, utf8);converter.convert(latin1String, utf8String);std::cout << utf8String << std::endl;return 0;
}

10、流中字符转换

  • Poco::OutputStreamConverter:作为一个过滤器,在将所有写入它的字符传递到另一个流之前,将它们转换为另一种编码。
  • Poco::InputStreamConverter:作为过滤器,从另一个流读取字符并将其转换为另一种编码,然后将它们传递给阅读器。
#include "Poco/StreamConverter.h"
#include "Poco/Latin1Encoding.h"
#include "Poco/UTF8Encoding.h"
#include <iostream>
using Poco::OutputStreamConverter;
using Poco::Latin1Encoding;
using Poco::UTF8Encoding;
int main(int argc, char** argv)
{std::string latin1String("This is Latin-1 encoded text.");Latin1Encoding latin1;UTF8Encoding utf8;OutputStreamConverter converter(std::cout, latin1, utf8);converter << latin1String << std::endl; // console output will be UTF-8return 0;
}

11、字符编码

Poco::Unicode:提供了对Unicode字符属性(字符类别、字符类型、脚本)的基本支持
Poco::UTF8:处理UTF-8编码的字符串

这篇关于【C++】POCO学习总结(十五):字符串操作的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/490654

相关文章

Python实现对阿里云OSS对象存储的操作详解

《Python实现对阿里云OSS对象存储的操作详解》这篇文章主要为大家详细介绍了Python实现对阿里云OSS对象存储的操作相关知识,包括连接,上传,下载,列举等功能,感兴趣的小伙伴可以了解下... 目录一、直接使用代码二、详细使用1. 环境准备2. 初始化配置3. bucket配置创建4. 文件上传到os

MySQL查询JSON数组字段包含特定字符串的方法

《MySQL查询JSON数组字段包含特定字符串的方法》在MySQL数据库中,当某个字段存储的是JSON数组,需要查询数组中包含特定字符串的记录时传统的LIKE语句无法直接使用,下面小编就为大家介绍两种... 目录问题背景解决方案对比1. 精确匹配方案(推荐)2. 模糊匹配方案参数化查询示例使用场景建议性能优

mysql表操作与查询功能详解

《mysql表操作与查询功能详解》本文系统讲解MySQL表操作与查询,涵盖创建、修改、复制表语法,基本查询结构及WHERE、GROUPBY等子句,本文结合实例代码给大家介绍的非常详细,感兴趣的朋友跟随... 目录01.表的操作1.1表操作概览1.2创建表1.3修改表1.4复制表02.基本查询操作2.1 SE

JavaSE正则表达式用法总结大全

《JavaSE正则表达式用法总结大全》正则表达式就是由一些特定的字符组成,代表的是一个规则,:本文主要介绍JavaSE正则表达式用法的相关资料,文中通过代码介绍的非常详细,需要的朋友可以参考下... 目录常用的正则表达式匹配符正则表China编程达式常用的类Pattern类Matcher类PatternSynta

从入门到精通C++11 <chrono> 库特性

《从入门到精通C++11<chrono>库特性》chrono库是C++11中一个非常强大和实用的库,它为时间处理提供了丰富的功能和类型安全的接口,通过本文的介绍,我们了解了chrono库的基本概念... 目录一、引言1.1 为什么需要<chrono>库1.2<chrono>库的基本概念二、时间段(Durat

C++20管道运算符的实现示例

《C++20管道运算符的实现示例》本文简要介绍C++20管道运算符的使用与实现,文中通过示例代码介绍的非常详细,对大家的学习或者工作具有一定的参考学习价值,需要的朋友们下面随着小编来一起学习学习吧... 目录标准库的管道运算符使用自己实现类似的管道运算符我们不打算介绍太多,因为它实际属于c++20最为重要的

Visual Studio 2022 编译C++20代码的图文步骤

《VisualStudio2022编译C++20代码的图文步骤》在VisualStudio中启用C++20import功能,需设置语言标准为ISOC++20,开启扫描源查找模块依赖及实验性标... 默认创建Visual Studio桌面控制台项目代码包含C++20的import方法。右键项目的属性:

MySQL 获取字符串长度及注意事项

《MySQL获取字符串长度及注意事项》本文通过实例代码给大家介绍MySQL获取字符串长度及注意事项,本文通过实例代码给大家介绍的非常详细,对大家的学习或工作具有一定的参考借鉴价值,需要的朋友参考下吧... 目录mysql 获取字符串长度详解 核心长度函数对比⚠️ 六大关键注意事项1. 字符编码决定字节长度2

c++中的set容器介绍及操作大全

《c++中的set容器介绍及操作大全》:本文主要介绍c++中的set容器介绍及操作大全,本文通过实例代码给大家介绍的非常详细,对大家的学习或工作具有一定的参考借鉴价值,需要的朋友参考下吧... 目录​​一、核心特性​​️ ​​二、基本操作​​​​1. 初始化与赋值​​​​2. 增删查操作​​​​3. 遍历方

解析C++11 static_assert及与Boost库的关联从入门到精通

《解析C++11static_assert及与Boost库的关联从入门到精通》static_assert是C++中强大的编译时验证工具,它能够在编译阶段拦截不符合预期的类型或值,增强代码的健壮性,通... 目录一、背景知识:传统断言方法的局限性1.1 assert宏1.2 #error指令1.3 第三方解决