技术背景

用惯了python，对其他语言就比较的生疏。但是python很多时候在性能上比较受局限，这里尝试通过C++来实现一个文件IO的功能，看看是否能够比python的表现更好一些。关于python的类似功能的实现，可以参考这一篇博客。

C++读取文件

首先我们构造一个txt文件用于测试，比如以下这个名为mindspore.txt的文件（之所以取这个名字，是因为最近在研究mindspore，因此最方便拿到的数据就是mindspore的借口api文档）：

MindSpore Python API

MindSpore Python API

mindspore

mindspore.common.initializer

mindspore.communication

mindspore.compression

mindspore.context

mindspore.dataset

mindspore.dataset.config

mindspore.dataset.text

mindspore.dataset.transforms

mindspore.dataset.vision

mindspore.explainer

mindspore.mindrecord

mindspore.nn

mindspore.numpy

mindspore.nn.probability

mindspore.ops

mindspore.profiler

mindspore.train

MindArmour Python API

mindarmour

mindarmour.adv_robustness.attacks

mindarmour.adv_robustness.defenses

mindarmour.adv_robustness.detectors

mindarmour.adv_robustness.evaluations

mindarmour.fuzz_testing

mindarmour.privacy.diff_privacy

mindarmour.privacy.evaluation

mindarmour.privacy.sup_privacy

mindarmour.utils

MindSpore Hub Python API

mindspore_hub

MindSpore Serving Python API

mindspore_serving

MindQuantum Python API

mindquantum

然后构造一个C++代码用于逐行读取这个文件，通过getline函数，将获取到的行字符串保存到strline中，并且每次读取一行都在屏幕上输出出来。由于这里使用的是while循环，因此采用index的方案设置了一个跳出循环的条件，只读取特定的行范围：

// iofile.cpp

#include <iostream>

#include <fstream>

#include <string>

int main()

{

    using namespace std;

    string filename="mindspore.txt";

    ifstream fin(filename.c_str());

    int index = 0;

    string strline;

    while (getline(fin, strline) && index < 20)

    {

        cout << strline << endl;

        index ++;

    }

    fin.close();

    cout << "Done!\n";

    return 0;

}

在读取完毕后，记得使用close()将文件关闭。上述代码的执行结果如下：

dechin@ubuntu2004:~/projects/gitlab/dechin/$ g++ iofile.cpp

dechin@ubuntu2004:~/projects/gitlab/dechin/$ ./a.out

MindSpore Python API

MindSpore Python API

mindspore

mindspore.common.initializer

mindspore.communication

mindspore.compression

mindspore.context

mindspore.dataset

mindspore.dataset.config

mindspore.dataset.text

mindspore.dataset.transforms

mindspore.dataset.vision

mindspore.explainer

mindspore.mindrecord

mindspore.nn

mindspore.numpy

mindspore.nn.probability

mindspore.ops

mindspore.profiler

mindspore.train

Done!

这里我们使用的g++版本为9.3.0：

dechin@ubuntu2004:~/projects/gitlab/dechin/$ g++ --version

g++ (Ubuntu 9.3.0-17ubuntu1~20.04) 9.3.0

Copyright (C) 2019 Free Software Foundation, Inc.

This is free software; see the source for copying conditions.  There is NO

warranty; not even for MERCHANTABILITY or FITNESS FOR A PARTICULAR PURPOSE.

因为上述案例读取的是前20行的内容，那么在Linux下我们还可以通过head来查看前20行的文件内容：

dechin@ubuntu2004:~/projects/gitlab/dechin/$ head -n 20 mindspore.txt

MindSpore Python API

MindSpore Python API

mindspore

mindspore.common.initializer

mindspore.communication

mindspore.compression

mindspore.context

mindspore.dataset

mindspore.dataset.config

mindspore.dataset.text

mindspore.dataset.transforms

mindspore.dataset.vision

mindspore.explainer

mindspore.mindrecord

mindspore.nn

mindspore.numpy

mindspore.nn.probability

mindspore.ops

mindspore.profiler

mindspore.train

经过对比发现两个结果是一致的。

C++字符串匹配

我们假象一个这样的测试案例，在上述的txt文本中，我们想把带有字符context的那一行标记出来，使其跟其他的行不一样。这时候就需要使用到C++的字符串匹配功能，其格式为string.find("context")，返回的是一个识别码，用于标记是否存在或者是存在的位置，如果字符不存在，则返回结果等价于string::npos。按照这个思路，我们定义一个布尔值，在检索过程中如果遇到context字符就输出1，否则输出0，具体的代码实现如下：

// iofile.cpp

#include <iostream>

#include <fstream>

#include <string>

int main()

{

    using namespace std;

    string filename="mindspore.txt";

    ifstream fin(filename.c_str());

    int index = 0;

    string strline;

    while (getline(fin, strline) && index < 20)

    {

        bool exists = strline.find("context") == string::npos;

        cout << strline << '\t' << !exists << endl;

        index ++;

    }

    fin.close();

    cout << "Done!\n";

    return 0;

}

上述代码的执行结果如下所示：

dechin@ubuntu2004:~/projects/gitlab/dechin/$ g++ iofile.cpp && ./a.out

MindSpore Python API    0

MindSpore Python API    0

mindspore       0

mindspore.common.initializer    0

mindspore.communication 0

mindspore.compression   0

mindspore.context       1

mindspore.dataset       0

mindspore.dataset.config        0

mindspore.dataset.text  0

mindspore.dataset.transforms    0

mindspore.dataset.vision        0

mindspore.explainer     0

mindspore.mindrecord    0

mindspore.nn    0

mindspore.numpy 0

mindspore.nn.probability        0

mindspore.ops   0

mindspore.profiler      0

mindspore.train 0

Done!

我们可以注意到，在含有context的那一行的行末输出了一个1，其他行的行末输出的都是0.

C++运行时间统计

在python中我们常用的一个功能是导入time.time()来记录时间，然后计算两次时间之间的差值，就可以得到一个程序的精确运行时间。C++中有一个比较类似的用法是clock_t，这里为了方便测试，我们把上述用到的代码封装到一个reader函数内，然后在main函数中调用以及统计运行时间：

// iofile.cpp

#include <iostream>

#include <fstream>

#include <string>

#include <time.h>

using namespace std;

int reader()

{

    string filename="mindspore.txt";

    ifstream fin(filename.c_str());

    int index = 0;

    string strline;

    while (getline(fin, strline) && index < 20)

    {

        bool exists = strline.find("context") == string::npos;

        cout << strline << '\t' << !exists << endl;

        index ++;

    }

    fin.close();

    cout << "Done!\n";

    return 0;

}

int main()

{

    clock_t start, end;

    start = clock();

    reader();

    end = clock();

    cout << "The time cost is: " << double(end-start)/CLOCKS_PER_SEC << "s" << endl;

}

上述代码的执行结果如下所示：

dechin@ubuntu2004:~/projects/gitlab/dechin/$ g++ iofile.cpp && ./a.out

MindSpore Python API    0

MindSpore Python API    0

mindspore       0

mindspore.common.initializer    0

mindspore.communication 0

mindspore.compression   0

mindspore.context       1

mindspore.dataset       0

mindspore.dataset.config        0

mindspore.dataset.text  0

mindspore.dataset.transforms    0

mindspore.dataset.vision        0

mindspore.explainer     0

mindspore.mindrecord    0

mindspore.nn    0

mindspore.numpy 0

mindspore.nn.probability        0

mindspore.ops   0

mindspore.profiler      0

mindspore.train 0

Done!

The time cost is: 0.000245s

输出的时间表示这个函数运行时间共计0.2ms。

总结概要

本文简单的介绍了C++中的三种基础操作：逐行读取文件内容、字符串匹配以及运行时间的统计，并且通过一个简单的范例来实现了这三种基本的功能。相比于python而言，C++的代码编写量肯定要多一些，但是考虑到C++可能带来的效率增益，我们也应当了解其基本的用法以及功能实现。

版权声明

本文首发链接为：https://www.cnblogs.com/dechinphy/p/cppio.html

作者ID：DechinPhy

更多原著文章请参考：https://www.cnblogs.com/dechinphy/

C++基础——文件逐行读取与字符匹配的更多相关文章

go从文件中读取json字符串并转换
go从文件中读取json字符串并转换将要读取的文件的一部分 [ { "children": [ { "children": [ { "code&qu ...
python文件逐行读取四种方法
下面是四种Python逐行读取文件内容的方法, 并分析了各种方法的优缺点及应用场景,以下代码在python3中测试通过, python2中运行部分代码已注释,稍加修改即可. 方法一:readline函 ...
bat文件逐行读取txt
From_Ip='192.138.60.16'@echo offfor /f "tokens=1,2 delims='" %%a in (D:\ETL\bat\config.txt ...
有关fgetc配合feof逐行读取文件最后一行读取两遍的错觉？
最近在做一个wifiap设置的接口,用户首先获取到当前wifi 热点的ssid 和pwd,然后修改,保存. 获取信息的时候是fopen对应的hostapd.conf文件,逐行读取,查找匹配的参数. 修 ...
PHP 文件打开/读取
PHP Open File - fopen() 打开文件的更好的方法是通过 fopen() 函数.此函数为您提供比 readfile() 函数更多的选项. 在课程中,我们将使用文本文件 "w ...
NodeJS学习笔记 (25)逐行读取-readline(ok)
模块概览 readline是个非常实用的模块.如名字所示,主要用来实现逐行读取,比如读取用户输入,或者读取文件内容.常见使用场景有下面几种,本文会逐一举例说明. 文件逐行读取:比如说进行日志分析. 自 ...
Day2-Python3基础-文件操作
1. 字符编码与转码需知: 1.在python3默认编码是unicode 2.unicode 分为 utf-32(占4个字节),utf-16(占两个字节),utf-8(占1-4个字节), so ut ...
Linux C/C++基础——文件(上)
1.文件指针 FILE* fp=NULL; fp指针,只调用了fopen(),在堆区分配空间,把地址返回给fp fp指针不是指向文件,fp指针和文件关联,fp内部成员保存在文件的状态操作fp指针,不 ...
Python从文件中读取字符串，用正则表达式匹配中文字符的问题
2013-07-27 21:01:37| 在Windows下,用Python从.txt文件中读取字符串,并用正则表达式匹配中文,在网上看了方法,用的时候发现中文没有被匹配. ...

随机推荐

OpenCV图像处理中“投影技术”的使用
本文区分"问题引出"."概念抽象"."算法实现"三个部分由表及里具体讲解OpenCV图像处理中"投影技术" ...
安装并配置Docker（基于Ubuntu）
安装并配置Docker(基于Ubuntu) 目录安装并配置Docker(基于Ubuntu) 一.安装Docker 二.验证Docker是否安装成功三.配置Docker加速器 3.1 创建daemo ...
关于生产环境改用G1垃圾收集器的思考
背景由于我们的业务量非常大,响应延迟要求高.目前沿用的老的ParNew+CMS已经不能支撑业务的需求.平均一台机器在1个月内有1次秒级别的stop the world.对系统来说是个巨大的隐患.所以 ...
[状压DP]炮兵阵地
炮兵阵地炮兵阵地炮兵阵地题目描述司令部的将军们打算在 N ∗ M N*M N∗M的网格地图上部署他们的炮兵部队.一个 N ∗ M N*M N∗M的地图由 N N N行 M M M列组成, ...
[图论]剑鱼行动:kruskal
剑鱼行动目录剑鱼行动 Description Input Output Sample Input Sample Output 解析难点代码 Description 给出N个点的坐标,对它们建立 ...
OO_Unit2 关于性能优化与测试的那些事
OO_Unit2 关于性能优化与测试的那些事 OO的第2单元到本周也就正式完结了.尽管这个单元的主旋律是多线程,但"面向对象"的基本思想仍然是我们一切架构与优化的出发点与前提.因此 ...
OO_Unit2总结
OO_Unit2总结 (1) 多线程协同控制设计策略总体信号通讯策略本单元作业,我采用的是生产者-消费者模式加类观察者模式. 通过分析指导书给出的需求,我将最终我要实现的程序简化为了"输 ...
005-Java中的控制语句
目录一.控制语句一.作用二.分类二.选择语句(分支语句) 一.if 语句二.switch语句三.循环语句一.for循环二.while循环(while循环的循环次数是:0~n次) 三.d ...
【死磕ibatis】SqlMapClient 基本操作示例
前言:想要学习ibatis,我这里写了一些关于SqlMapClient 的具体例子,希望对你有帮助.话不多说,直接看例子. 例 1: 数据写入操作(insert, update, delete): s ...
Django--虚拟环境、项目和应用的创建
第一点:官方手册 -- https://yiyibooks.cn/ 第二点:运行环境 -- django项目采用虚拟运行环境之前我们pip install都是在Python的安装目录(底层)上安装的 ...

C++基础——文件逐行读取与字符匹配