Python分割单词和转换命名法的实现
作者:梦未 发布时间:2023-11-24 00:06:16
分割单词
将一个标识符分割成若干单词存进列表,便于后续命名法的转换
先引入正则表达式包
import re
至于如何分割单词看个人喜好,如以常见分隔符 “ ”、“_”、“-”、“/”、“\” 去分割
re.split('[ _\-/\\\\]+', name)
还可以范围再广一点,拿除了数字和字母以外的所有字符去分割
re.split('[^0-9a-zA-Z]', name)
那对于字母内部怎么分割呢?
综合考虑驼峰命名法、连续大写的缩写单词等,笔者根据经验一般会采用这种策略,连续比较三个字符,满足以下条件之一就分割:“小|大无”、“有|大小”、“小|大有”
是尾字符,是大写,倒数第二个字符是小写,在尾字符前分割,比如 'getA' 分割成 ['get','A']
是非首位的中间字符,是大写,前后至少有一个是小写,在该字符前分割,比如 'getJSONString' 分割成 ['get','JSON','String']
对于字母和数字结合的标识符,就比较难处理了
因为有的数字可以作为单词开头(比如 '3D'),有的又可以作为结尾(比如 'HTML5'),还有的字母数字交错(比如 'm3u8'),暂未想到通用的分割的好办法,根据个人需求实现就行了
综合以上几者的分割函数如下
def to_words(name):
words = [] # 用于存储单词的列表
word = '' # 用于存储正在构建的单词
if(len(name) <= 1):
words.append(name)
return words
# 按照常见分隔符进行分割
# name_parts = re.split('[ _\-/\\\\]+', name)
# 按照非数字字母字符进行分割
name_parts = re.split('[^0-9a-zA-Z]', name)
for part in name_parts:
part_len = len(part) # 字符串的长度
word = ''
# 如果子串为空,继续循环
if not part:
continue
for index, char in enumerate(part):
# “小|大无”
if(index == part_len - 1):
if(char.isupper() and part[index-1].islower()):
if(word): words.append(word)
words.append(char)
word = ''
continue
# “有|大小”或“小|大有”
elif(index != 0 and char.isupper()):
if((part[index-1].islower() and part[index+1].isalpha()) or (part[index-1].isalpha() and part[index+1].islower())):
if(word): words.append(word)
word = ''
word += char
if(len(word) > 0): words.append(word)
# 去除空单词
return [word for word in words if word != '']
测试用例如下
print(to_words('IDCard')) # ['ID', 'Card']
print(to_words('getJSONObject')) # ['get', 'JSON', 'Object']
print(to_words('aaa@bbb.com')) # ['aaa', 'bbb', 'com']
print(to_words('D://documents/data.txt')) # ['D', 'documents', 'data', 'txt']
分割成全小写单词
def to_lower_words(name):
words = to_words(name)
return [word.lower() for word in words]
分割成全大写单词
def to_upper_words(name):
words = to_words(name)
return [word.upper() for word in words]
分割成首大写、其余小写单词
def to_capital_words(name):
words = to_words(name)
return [word.capitalize() for word in words]
转中划线命名法
中划线命名法,也叫烤肉串命名法(kebab case),如 'kebab-case'
字母全小写
连字符连接
def to_kebab_case(name):
words = to_lower_words(name)
to_kebab_case = '-'.join(words)
return to_kebab_case
转小蛇式命名法
小蛇式命名法,其实就是小写下划线命名法,也叫蛇式命名法(snake case),如 'snake_case'
字母全小写
下划线连接
def to_snake_case(name):
words = to_lower_words(name)
snake_case_name = '_'.join(words)
return snake_case_name
转大蛇式命名法
大蛇式命名法,其实就是大写下划线命名法,也叫宏命名法(macro case),如 'MACRO_CASE'
字母全大写
下划线连接
def to_macro_case(name):
words = to_upper_words(name)
snake_case_name = '_'.join(words)
return snake_case_name
转小驼峰命名法
小驼峰命名法,也叫驼峰命名法(camel case) ,如 'camelCase'
首单词首字母小写,后每个单词首字母大写
不使用连接符
def to_camel_case(name):
words = to_words(name)
camel_case_words = []
for word in words:
if len(word) <= 1:
camel_case_words.append(word.upper())
else:
camel_case_words.append(word[0].upper() + word[1:])
camel_case = ''.join(camel_case_words)
if len(camel_case) <= 1:
camel_case = camel_case.lower()
else:
camel_case = ''.join(camel_case[0].lower() + camel_case[1:])
return camel_case
转大驼峰命名法
大驼峰命名法,也叫帕斯卡命名法(pascal case) ,如 'PascalCase'
每个单词首字母大写
不使用连接符
def to_pascal_case(name):
words = to_words(name)
pascal_case_words = []
for word in words:
if len(word) <= 1:
pascal_case_words.append(word.upper())
else:
pascal_case_words.append(word[0].upper() + word[1:])
pascal_case = ''.join(pascal_case_words)
return pascal_case
来源:https://blog.csdn.net/weixin_42077074/article/details/129543001


猜你喜欢
- 今天笔者带大家,梳理几个常见的基于文本终端的 UI 框架,一睹为快!Curses首先出场的是 Curses。Curses 是一个能提供基于文
- ipad上可以运行python么?ipad上是可以运行python的。1、在我们的ipad上百度搜索Python,点击进去。2、进去网站之后
- 如何让animate在显示图片的过程保持窗口的标题不变animate -title "My Image Sequence"
- 如下所示:# x = ['c b a',"e d f"]# y = []# for i in x:# f
- 需求:在刷word题库的时候,答案就在题目下方,干扰复习效果,将答案字体变成白色,查看答案的时候只需要将答案背景刷黑转换需求:在word中找
- python将数据换为txt的方法有很多,可以用xlrd库实现。本人比较懒,不想按太多用的少的插件,利用已有库pandas将excel文件转
- 索引类型聚簇索引: 叶子节点存储的是行记录,每个表必须要有至少一个聚簇索引。使用聚簇索引查询会很快,因为可以直接定位到行记录普通索引:二级索
- 上一篇内容,已经学会了使用简单的语句对网页进行抓取。接下来,详细看下urlopen的两个重要参数url和data,学习如何发送数据data一
- 一、gfile模块是什么 gfile模块定义在tensorflow/python/platform/gfile.py,但其源代码实现主要位于
- python发邮件需要掌握两个模块的用法,smtplib和email,这俩模块是python自带的,只需import即可使用。smtplib
- PyQt的使用与pycharm的结合环境安装pip install pyqt5 -i https://pypi.tuna.tsinghua.
- 如何在ADSI中查询用户属性?看看下面这个返回用户可用属性的代码实例,基本上返回了大部分可用的用户属性:<%Dim x&nb
- 本文实例讲述了Python基于回溯法子集树模板解决数字组合问题。分享给大家供大家参考,具体如下:问题找出从自然数1、2、3、...、n中任取
- 前两天简单认识了一下PyQt5,通过练习开发了一款在Window下自定义关机的小工具,代码如下:import os,sys,timefrom
- Laravel框架简介:Laravel是一套简洁、优雅的PHP Web开发框架(PHP Web Framework)。它可以让你从面条一样杂
- docs = [‘icassp improved human face identification using frequency dom
- 使用SQLSERVER的应该经常遇到“Unable to read local eventlog (reason:事件日志文件已在读取时间更
- 引言首先来一段简单的代码逻辑热身,下面的代码大家觉得应该会打印什么呢?type OKR struct { id
- 1、一些准备工作 安装djangopip install django创建django项目进入项目代码存放目录执行命令:djang
- layui的table的自定义模板需要用到{{}},但是和Django的{{}}冲突了,layui的{{}}失效了解决方法:从Django