Pandas-数据操作-字符串型(二):常用方法【lower、upper、len、startswith、endswith、strip、lstrip、replace、split、rsplit】

本文主要是介绍Pandas-数据操作-字符串型(二):常用方法【lower、upper、len、startswith、endswith、strip、lstrip、replace、split、rsplit】,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

一、字符串常用方法:lower,upper,len,startswith,endswith

import numpy as np
import pandas as pds = pd.Series(['A', 'b', 'bbhello', '123', np.nan])
print("s = \n", s)
print('-' * 200)
print("lower小写: s.str.lower() = \n", s.str.lower())
print('-' * 200)
print("upper大写: s.str.upper() = \n", s.str.upper())
print('-' * 200)
print("len字符长度: s.str.len() = \n", s.str.len())
print('-' * 200)
print("判断起始是否为b: s.str.startswith('b') = \n", s.str.startswith('b'))
print('-' * 200)
print("判断结束是否为3: s.str.endswith('3') = \n", s.str.endswith('3'))

打印结果:

s = 
0          A
1          b
2    bbhello
3        123
4        NaN
dtype: object
--------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------
lower小写: s.str.lower() = 
0          a
1          b
2    bbhello
3        123
4        NaN
dtype: object
--------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------
upper大写: s.str.upper() = 0          A
1          B
2    BBHELLO
3        123
4        NaN
dtype: object
--------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------
len字符长度: s.str.len() = 
0    1.0
1    1.0
2    7.0
3    3.0
4    NaN
dtype: float64
--------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------
判断起始是否为b: s.str.startswith('b') = 
0    False
1     True
2     True
3    False
4      NaN
dtype: object
--------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------
判断结束是否为3: s.str.endswith('3') = 
0    False
1    False
2    False
3     True
4      NaN
dtype: objectProcess finished with exit code 0

二、字符串常用方法:strip

import numpy as np
import pandas as pd# 字符串常用方法(2) - strips = pd.Series([' jack', 'jill ', ' je sse ', 'frank'])
df = pd.DataFrame(np.random.randn(3, 2),columns=[' Column A ', ' Column B '],index=range(3))
print("s = \n", s)
print('-' * 200)
print("df = \n", df)
print('-' * 200)# 去除字符串左右的空格
print("去除字符串左右的空格: s.str.strip() = \n", s.str.strip())
# 去除字符串中的左空格
print("去除字符串中的左空格: s.str.lstrip() = \n", s.str.lstrip())
# 去除字符串中的右空格
print("去除字符串中的右空格: s.str.rstrip() = \n", s.str.rstrip())# 这里去掉了columns的前后空格,但没有去掉中间空格
df.columns = df.columns.str.strip()
print("df = \n", df)
print('-' * 200)

打印结果:

s = 
0        jack
1       jill 
2     je sse 
3       frank
dtype: object
--------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------
df = Column A    Column B 
0   -1.318646   -0.831649
1   -0.339870   -1.141231
2   -0.024364   -2.163961
--------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------
去除字符串左右的空格: s.str.strip() = 
0      jack
1      jill
2    je sse
3     frank
dtype: object
去除字符串中的左空格: s.str.lstrip() = 
0       jack
1      jill 
2    je sse 
3      frank
dtype: object
去除字符串中的右空格: s.str.rstrip() = 0       jack
1       jill
2     je sse
3      frank
dtype: object
df = Column A  Column B
0 -1.318646 -0.831649
1 -0.339870 -1.141231
2 -0.024364 -2.163961
--------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------Process finished with exit code 0

三、字符串常用方法:replace

import numpy as np
import pandas as pd# 字符串常用方法(3) - replacedf = pd.DataFrame(np.random.randn(3, 2),columns=[' Column A ', ' Column B '],index=range(3))
# 替换
df.columns = df.columns.str.replace(' ', '-')
print("df = \n", df)
print('-' * 200)# n:替换个数
df.columns = df.columns.str.replace('-', '*', n=1)
print("df = \n", df)

打印结果:

df = -Column-A-  -Column-B-
0    0.704728   -0.835929
1    1.478930   -2.708538
2    0.585825   -1.395908
--------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------
df = *Column-A-  *Column-B-
0    0.704728   -0.835929
1    1.478930   -2.708538
2    0.585825   -1.395908Process finished with exit code 0

四、字符串常用方法:split、rsplit

import numpy as np
import pandas as pd# 字符串常用方法(4) - split、rsplits = pd.Series(['a,b,c', '1,2,3', ['a,,,c'], np.nan])
print("s = \n", s)
print('-' * 200)# 类似字符串的split
data1 = s.str.split(',')
print("data1 = s.str.split(',') = \n{0} \ntype(data1) = {1}".format(data1, type(data1)))
print('-' * 100)# 直接索引得到一个list
data2 = data1[0]
print("data2 = data1[0] = s.str.split(',')[0] = \n{0} \ntype(data2) = {1}".format(data2, type(data2)))
print('-' * 100)# 可以使用get或[]符号访问拆分列表中的元素
data3 = s.str.split(',').str.get(1)
print("data3 = s.str.split(',').str.get(1) = \n{0} \ntype(data3) = {1}".format(data3, type(data3)))
print('-' * 200)# 可以使用expand可以轻松扩展此操作以返回DataFrame
# n参数限制分割数
# rsplit类似于split,反向工作,即从字符串的末尾到字符串的开头
data4 = s.str.split(',', expand=True)
print("data4 = s.str.split(',', expand=True) = \n{0} \ntype(data4) = {1}".format(data4, type(data4)))
print('-' * 100)
data5 = s.str.split(',', expand=True, n=1)
print("data5 = s.str.split(',', expand=True, n=1) = \n{0} \ntype(data5) = {1}".format(data5, type(data5)))
print('-' * 100)
data6 = s.str.rsplit(',', expand=True, n=1)
print("data6 = s.str.rsplit(',', expand=True, n=1) = \n{0} \ntype(data6) = {1}".format(data6, type(data6)))
print('-' * 200)# Dataframe使用split
df = pd.DataFrame({'key1': ['a,b,c', '1,2,3', [':,., ']],'key2': ['a-b-c', '1-2-3', [':-.- ']]})
print("df = \n", df)
print('-' * 100)
data7 = df['key2'].str.split('-')
print("data7 = df['key2'].str.split('-') = \n{0} \ntype(data7) = {1}".format(data7, type(data7)))
print('-' * 200)

打印结果:

s = 
0      a,b,c
1      1,2,3
2    [a,,,c]
3        NaN
dtype: object
--------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------
data1 = s.str.split(',') = 
0    [a, b, c]
1    [1, 2, 3]
2          NaN
3          NaN
dtype: object 
type(data1) = <class 'pandas.core.series.Series'>
----------------------------------------------------------------------------------------------------
data2 = data1[0] = s.str.split(',')[0] = 
['a', 'b', 'c'] 
type(data2) = <class 'list'>
----------------------------------------------------------------------------------------------------
data3 = s.str.split(',').str.get(1) = 
0      b
1      2
2    NaN
3    NaN
dtype: object 
type(data3) = <class 'pandas.core.series.Series'>
--------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------
data4 = s.str.split(',', expand=True) = 0    1    2
0    a    b    c
1    1    2    3
2  NaN  NaN  NaN
3  NaN  NaN  NaN 
type(data4) = <class 'pandas.core.frame.DataFrame'>
----------------------------------------------------------------------------------------------------
data5 = s.str.split(',', expand=True, n=1) = 0    1
0    a  b,c
1    1  2,3
2  NaN  NaN
3  NaN  NaN 
type(data5) = <class 'pandas.core.frame.DataFrame'>
----------------------------------------------------------------------------------------------------
data6 = s.str.rsplit(',', expand=True, n=1) = 0    1
0  a,b    c
1  1,2    3
2  NaN  NaN
3  NaN  NaN 
type(data6) = <class 'pandas.core.frame.DataFrame'>
--------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------
df = key1     key2
0    a,b,c    a-b-c
1    1,2,3    1-2-3
2  [:,., ]  [:-.- ]
----------------------------------------------------------------------------------------------------
data7 = df['key2'].str.split('-') = 
0    [a, b, c]
1    [1, 2, 3]
2          NaN
Name: key2, dtype: object 
type(data7) = <class 'pandas.core.series.Series'>
--------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------Process finished with exit code 0

这篇关于Pandas-数据操作-字符串型(二):常用方法【lower、upper、len、startswith、endswith、strip、lstrip、replace、split、rsplit】的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/1128681

相关文章

JavaScript中的reduce方法执行过程、使用场景及进阶用法

《JavaScript中的reduce方法执行过程、使用场景及进阶用法》:本文主要介绍JavaScript中的reduce方法执行过程、使用场景及进阶用法的相关资料,reduce是JavaScri... 目录1. 什么是reduce2. reduce语法2.1 语法2.2 参数说明3. reduce执行过程

C#中读取XML文件的四种常用方法

《C#中读取XML文件的四种常用方法》Xml是Internet环境中跨平台的,依赖于内容的技术,是当前处理结构化文档信息的有力工具,下面我们就来看看C#中读取XML文件的方法都有哪些吧... 目录XML简介格式C#读取XML文件方法使用XmlDocument使用XmlTextReader/XmlTextWr

python使用fastapi实现多语言国际化的操作指南

《python使用fastapi实现多语言国际化的操作指南》本文介绍了使用Python和FastAPI实现多语言国际化的操作指南,包括多语言架构技术栈、翻译管理、前端本地化、语言切换机制以及常见陷阱和... 目录多语言国际化实现指南项目多语言架构技术栈目录结构翻译工作流1. 翻译数据存储2. 翻译生成脚本

C++初始化数组的几种常见方法(简单易懂)

《C++初始化数组的几种常见方法(简单易懂)》本文介绍了C++中数组的初始化方法,包括一维数组和二维数组的初始化,以及用new动态初始化数组,在C++11及以上版本中,还提供了使用std::array... 目录1、初始化一维数组1.1、使用列表初始化(推荐方式)1.2、初始化部分列表1.3、使用std::

oracle DBMS_SQL.PARSE的使用方法和示例

《oracleDBMS_SQL.PARSE的使用方法和示例》DBMS_SQL是Oracle数据库中的一个强大包,用于动态构建和执行SQL语句,DBMS_SQL.PARSE过程解析SQL语句或PL/S... 目录语法示例注意事项DBMS_SQL 是 oracle 数据库中的一个强大包,它允许动态地构建和执行

0基础租个硬件玩deepseek,蓝耘元生代智算云|本地部署DeepSeek R1模型的操作流程

《0基础租个硬件玩deepseek,蓝耘元生代智算云|本地部署DeepSeekR1模型的操作流程》DeepSeekR1模型凭借其强大的自然语言处理能力,在未来具有广阔的应用前景,有望在多个领域发... 目录0基础租个硬件玩deepseek,蓝耘元生代智算云|本地部署DeepSeek R1模型,3步搞定一个应

Ubuntu固定虚拟机ip地址的方法教程

《Ubuntu固定虚拟机ip地址的方法教程》本文详细介绍了如何在Ubuntu虚拟机中固定IP地址,包括检查和编辑`/etc/apt/sources.list`文件、更新网络配置文件以及使用Networ... 1、由于虚拟机网络是桥接,所以ip地址会不停地变化,接下来我们就讲述ip如何固定 2、如果apt安

Go路由注册方法详解

《Go路由注册方法详解》Go语言中,http.NewServeMux()和http.HandleFunc()是两种不同的路由注册方式,前者创建独立的ServeMux实例,适合模块化和分层路由,灵活性高... 目录Go路由注册方法1. 路由注册的方式2. 路由器的独立性3. 灵活性4. 启动服务器的方式5.

在不同系统间迁移Python程序的方法与教程

《在不同系统间迁移Python程序的方法与教程》本文介绍了几种将Windows上编写的Python程序迁移到Linux服务器上的方法,包括使用虚拟环境和依赖冻结、容器化技术(如Docker)、使用An... 目录使用虚拟环境和依赖冻结1. 创建虚拟环境2. 冻结依赖使用容器化技术(如 docker)1. 创

Spring排序机制之接口与注解的使用方法

《Spring排序机制之接口与注解的使用方法》本文介绍了Spring中多种排序机制,包括Ordered接口、PriorityOrdered接口、@Order注解和@Priority注解,提供了详细示例... 目录一、Spring 排序的需求场景二、Spring 中的排序机制1、Ordered 接口2、Pri