[转]标准C++字符串string以及MFC6.0字符串CString的tokenize和split函数
标准字符串的方法:
/******************************************** the tokenize function for std::string *********************************************/
#include <string>
#include <vector>
#include <iostream>
using namespace std; typedef basic_string<char>::size_type S_T;
static const S_T npos = -; ////trim指示是否保留空串,默认为保留。
vector<string> tokenize(const string& src, string tok, bool trim=false, string null_subst="")
{
if( src.empty() || tok.empty() ) throw "tokenize: empty string\0"; vector<string> v;
S_T pre_index = , index = , len = ;
while( (index = src.find_first_of(tok, pre_index)) != npos )
{
if( (len = index-pre_index)!= )
v.push_back(src.substr(pre_index, len));
else if(trim==false)
v.push_back(null_subst);
pre_index = index+;
}
string endstr = src.substr(pre_index);
if( trim==false ) v.push_back( endstr.empty()? null_subst:endstr );
else if( !endstr.empty() ) v.push_back(endstr);
return v;
} ////使用一个完整的串delimit(而不是其中的某个字符)来分割src串,没有trim选项,即严格分割。
vector<string> split(const string& src, string delimit, string null_subst="")
{
if( src.empty() || delimit.empty() ) throw "split: empty string\0"; vector<string> v;
S_T deli_len = delimit.size();
long index = npos, last_search_position = ;
while( (index=src.find(delimit, last_search_position))!=npos )
{
if(index==last_search_position)
v.push_back(null_subst);
else
v.push_back( src.substr(last_search_position, index-last_search_position) );
last_search_position = index + deli_len;
}
string last_one = src.substr(last_search_position);
v.push_back( last_one.empty()? null_subst:last_one );
return v;
} // test
int main(void)
{
string src = ",ab,cde;,,fg,," ;
string tok = ",;" ; vector<string> v1 = tokenize(src, tok ,true);
vector<string> v2 = tokenize(src, tok ,false, "<null>"); cout<<"-------------v1:"<<endl;
for(int i=; i<v1.size();i++)
{
cout<<v1[i].c_str()<<endl;
} cout<<"-------------v2:"<<endl;
for(int j=; j<v2.size();j++)
{
cout<<v2[j].c_str()<<endl;
} try{ string s = "######123#4###56########789###";
string del = "";//"###";
vector<string> v3 = split(s, del, "<null>");
cout<<"-------------v3:"<<endl;
for(int k=; k<v3.size();k++)
{
cout<<v3[k].c_str()<<endl;
}
}
catch (char *s) {
cout<<s<<endl;
} return ;
}
CString的方法:
#include <stdio.h>
#include <afx.h> /*
* 该函数用delimits里的字符拆分s,传出一个CStringList指针pList,
* 若trim为真,则不保留分割后的空串(注意不是空白字符)。比如:
* Tokenize( "a,bc;,d,", ",;", &out_list, TRUE)
* 会返回3个串:a、bc、d。
* 若trim为FALSE,则用nullSubst用来替代分割后的空串,比如:
* Tokenize( "a,bc;,d;", ",;", &out_list, FALSE,"[null]" )
* 会返回5个串:a、bc、[null]、d、[null]。
* trim默认为FALSE,nullSubst默认为空串。
*/
void Tokenize(CString s, CString delimits, CStringList* pList, BOOL trim=FALSE, CString nullSubst="")
{
ASSERT( !s.IsEmpty() && !delimits.IsEmpty() ); s += delimits[];
for( long index=-; (index=s.FindOneOf((LPCTSTR)delimits))!=-; )
{
if(index != ) pList->AddTail( s.Left(index) );
else if(!trim) pList->AddTail(nullSubst);
s = s.Right(s.GetLength()-index-);
}
} /*
* 类似java字符串的split()方法。
* 使用一个完整的串delimit(而不是其中的某个字符)来分割src串,没有trim选项,
* 即严格分割。num用来确定最多分割为多少个串,如果是0(默认),则按照delimit
* 分割,若为1,则返回源串。
*/
void Split(const CString& src, CString delimit, CStringList* pOutList, int num=, CString nullSubst="")
{
ASSERT( !src.IsEmpty() && !delimit.IsEmpty() );
if(num==)
{
pOutList->AddTail(src);
return;
} int deliLen = delimit.GetLength();
long index = -, lastSearchPosition = , cnt = ; while( (index=src.Find(delimit, lastSearchPosition))!=- )
{
if(index==lastSearchPosition)
pOutList->AddTail(nullSubst);
else
pOutList->AddTail(src.Mid(lastSearchPosition, index-lastSearchPosition));
lastSearchPosition = index + deliLen; if(num)
{
++cnt;
if(cnt+==num) break;
}
}
CString lastOne = src.Mid(lastSearchPosition);
pOutList->AddTail( lastOne.IsEmpty()? nullSubst:lastOne);
} // test
int main(void)
{
CString s = ",ab;cde,f,,;gh,,";
CString sub = ",;";
CStringList list1,list2; Tokenize(s,sub,&list1,TRUE,"no use"); // <-----
printf("-------[Tokenize_trim]-------\n");
POSITION pos1 = list1.GetHeadPosition();
while( pos1!= NULL )
{
printf( list1.GetNext(pos1) );
printf("\n");
}
Tokenize(s,sub,&list2,FALSE,"[null]"); // <-----
printf("------[Tokenize_no_trim]-----\n");
POSITION pos2 = list2.GetHeadPosition();
while( pos2!= NULL )
{
printf( list2.GetNext(pos2) );
printf("\n");
} CStringList list3;
s = "###0123###567######89###1000###";
sub = "###";
Split(s,sub,&list3, , "<null>"); // <-----
printf("------[Split]-----\n");
POSITION pos3 = list3.GetHeadPosition();
while( pos3!= NULL )
{
printf( list3.GetNext(pos3) );
printf("\n");
}
return ;
}
[转]标准C++字符串string以及MFC6.0字符串CString的tokenize和split函数的更多相关文章
- 为什么字符串String是不可变字符串&&"".equals(str)与str.equals("")的区别
为什么字符串String是不可变字符串 实际上String类的实现是char类型的数组 虽然说源码中设置的是private final char[] value; final关键词表示不可变动 但是只 ...
- VK Cup 2012 Qualification Round 2 C. String Manipulation 1.0 字符串模拟
C. String Manipulation 1.0 Time Limit: 20 Sec Memory Limit: 256 MB 题目连接 codeforces.com/problemset/pr ...
- Java 中的字符串(String)与C# 中字符串(string)的异同
1. C# 中比较两个字符串字面量是否相等,可以使用 “==”比较运算符,是因为string 类型重写(override)了“==” 和 “!=” 运算符,在使用“==” 和 “!=” 进行字符串比较 ...
- lua中 string.find(查找获取字符串) string.gsub(查找替换字符串) string.sub(截取字符串)
> aaa='/p/v2/api/winapi/adapter/lgj'> print(string.find(aaa, "^/.+/adapter/(.*)"))1 ...
- Java基础——数组应用之字符串String类
字符串String的使用 Java字符串就是Unicode字符序列,例如串“Java”就是4个Unicode字符J,a,v,a组成的. Java中没有内置的字符串类型,而是在标准Java类库中提供了一 ...
- 自定义实现字符串string的接口
用char*管理String类的内存,new动态分配,在析构函数中delete char*指向的new出来的内存,一个string类需要实现那些接口可参考标准库里的string: http://ww ...
- Swift 3.0 字符串、数组、字典的使用
1.字符串 string func stringTest() -> Void { // 字符串 let str1 = "yiyi" let str2 = "2222 ...
- C#解析"a=1&b=2&c=3"字符串,微信支付返回字符串,替换<br>为&
原文来自: http://www.mzwu.com/article.asp?id=2802 C#可用: 若该字符串是使用Http Get发送,url?a=1&b=2&c=3,使用下边代 ...
- js使用split函数按照多个字符对字符串进行分割的方法
这篇文章主要介绍了js使用split函数按照多个字符对字符串进行分割的方法,实例分析了split函数的使用技巧,非常具有实用价值,需要的朋友可以参考下 本文实例讲述了js使用split函数按照多个 ...
随机推荐
- Virtual Environments
virtualenv 再另一篇随笔中已经提到过virtualenv.如果我们有好几个不同的项目,他们需要的第三方包版本不同,那怎么办呢.这时候就需要virtualenv创建一个虚拟环境,里面包含了一个 ...
- ORACLE11G常用函数
1 单值函数 1.1 日期函数 1.1.1 Round [舍入到最接近的日期](day:舍入到最接近的星期日) select sysdate S1, round(sysdate) S2 , round ...
- Mysql 建表时,日期时间类型选择
mysql(5.5)所支持的日期时间类型有:DATETIME. TIMESTAMP.DATE.TIME.YEAR. 几种类型比较如下: 日期时间类型 占用空间 日期格式 最小值 最大值 零值表示 D ...
- [Head First Python]6. summary
1- 字典-内置数据结构,数据值与键值关联 键-字典中查找部分 值-字典中数据部分 使用dict()工厂函数或者只用{}可以创建一个空字典 >>> list = {} >> ...
- python运维开发(二十一)----文件上传和验证码+session
内容目录: 文件上传 验证码+session 文件和图片的上传功能 HTML Form表单提交,实例展示 views 代码 HTML ajax提交 原生ajax提交,XMLHttpRequest方式上 ...
- python运维开发(十七)----jQuery续(示例)web框架django
内容目录: jQuery示例 前端插件 web框架 Django框架 jQuery示例 dom事件绑定,dom绑定在form表单提交按钮地方都会绑定一个onclick事件,所有查看网站的人都能看到代码 ...
- 更有效率的使用 Visual Studio - 快捷键
工欲善其事,必先利其器.虽然说Vim和Emacs是神器,但是对于使用Visual Studio的程序员来说,我们也可以通过一些快捷键和潜在的一些功能实现脱离鼠标写代码,提高工作效率,像使用Vim一样使 ...
- python操作redis-为元素排序
#!/usr/bin/python #!coding:utf-8 import time import redis if __name__ == "__main__": try: ...
- c#以文件流的形式输出xml(可以解决内存溢出)-XmlTextWriter
1.XmlTextWriter 表示提供快速.非缓存.只进方法的编写器,该方法生成包含 XML 数据(这些数据符合 W3C 可扩展标记语言 (XML) 1.0 和“XML 中的命名空间”建议)的流或文 ...
- [TYVJ] P1006 ISBN
ISBN 背景 Background NOIP2008年普及组第一题 描述 Description 每一本正式出版的图书都有一个ISBN号码与之对应,ISBN码包括9位数字.1位识别码和3位 ...