本文链接:http://www.orlion.ml/236/

下面以php命令行程序为例解释PHP脚本是怎么被执行的。例如如下脚本:

<?php
$str = 'hello world';
echo $str;
?>

假设这段代码保存在hello.php文件中,在命令行中执行:

$ php ./hello.php

会输出hello world,那么在执行脚本的时候PHP/Zend都做了什么呢?

一、程序的执行

  上例中,传递给php程序需要执行的文件,php程序完成基本的准备工作后启动PHP及Zend引擎,加载注册的扩展模块。

  初始化后读取脚本文件,Zend引擎对脚本文件进行词法分析,语法分析。然后编译成opcode执行。如安装了apc之类的opcode缓存,编译环节可能会被跳过而直接从缓存中读取opcode执行

  1、脚本的编译执行

  php在读入到脚本文件后首先对代码进行词法分析,php的词法分析器是通过lex生成的,词法规则文件在$PHP_SRC/Zend/Zend_language_scanner.l,这一阶段lex会会将源代码按照词法规则切分一个一个的标记(token).PHP中提供了一个函数token_get_all()函数,该函数接收一个字符串参数,返回一个按照词法规则切分好的数组。例如将上边的php代码作为参数传递给这个函数:

<?php
$code = <<<PHP_CODE
<?php
$str = 'hello world';
echo $str;
PHP_CODE;
var_dump(token_get_all($code));
?>

运行上边的代码结果:

array (size=10)
0 =>
array (size=3)
0 => int 374 // 脚本开始标记
1 => string '<?php // 匹配到的字符串
' (length=6)
2 => int 1
1 =>
array (size=3)
0 => int 377
1 => string ' ' (length=1)
2 => int 2
2 => string '=' (length=1)
3 =>
array (size=3)
0 => int 377
1 => string ' ' (length=1)
2 => int 2
4 =>
array (size=3)
0 => int 316
1 => string ''hello world'' (length=13)
2 => int 2
5 => string ';' (length=1)
6 =>
array (size=3)
0 => int 377
1 => string '
' (length=1)
2 => int 2
7 =>
array (size=3)
0 => int 317
1 => string 'echo' (length=4)
2 => int 3
8 =>
array (size=3)
0 => int 377
1 => string ' ' (length=1)
2 => int 3
9 => string ';' (length=1)

这也是Zend引擎词法分析做的事情,将代码切分为一个个的标记,然后使用语法分析器(PHP使用bison生成语法分析器,规则见$PHP_SRC/Zend/zend_language_parser.y)bison根据规则进行相应的处理,如果代码找不到匹配的规则,也就是语法错误时Zend引擎会停止,并输出错误信息。匹配到相应的语法规则后,Zend引擎还会进行编译,将代码编译为opcode,完成后Zend引擎会执行这些opcode,在执行过程中还有可能会继续重复进行编译-执行。例如执行eval,include,require等语句。

  例如上例中的echo语句会编译成为一条ZEND_ECHO指令,执行过程中,该指令由C函数zend_print_variable(zval *z)执行,将传递的字符串打印出来。

  

  2、词法分析和语法分析

  3、opcode

在PHP实现内部,opcode由如下的结构体表示:

struct _zend_op {
opcode_handler_t handler; // 执行该opcode时调用的处理函数
znode result;
znode op1;
znode op2;
ulong extended_value;
uint lineno;
zend_uchar opcode; // opcode代码
};

和CPU指令类似,有一个标示指令的opcode字段,以及这个opcode所操作的操作数,PHP不像汇编那么底层,在脚本实际执行的时候可能还需要其他更多的信息,extend_value字段就保存了这类信息,其中result域则是保存该指令执行完成后的结果。

例如如下代码就是在编译器遇到print语句的时候进行编译的函数:

void zend_do_print(znode *resultconst znode *arg TSRMLS_DC)
{
zend_op *opline = get_next_op(CG(active_op_array) TSRMLS_CC); opline->result.op_type = IS_TMP_VAR;
opline->result.u.var = get_temporary_variable(CG(active_op_array));
opline->opcode = ZEND_PRINT;
opline->op1 = *arg;
SET_UNUSED(opline->op2);
*result = opline->result;
}

这个函数新创建一条zend_op,将返回值的类型设置为临时变量(IS_TMP_VAR),并为临时变量申请空间,随后执行opcode为ZEND_PRINT,并将传递进来的参数复制给这条opcode的第一个操作数。这样在最终执行这条opcode的时候,Zend引擎能获取到足够的信息以便输出内容。

PHP脚本编译为opcode保存在op_array中,其内部存储的结构如下:

struct _zend_op_array {
/* Common elements */
zend_uchar type;
char *function_name; // 如果是用户定义的函数则这里将保存函数的名字
zend_class_entry *scope;
zend_uint fn_flags;
union _zend_function *prototype;
zend_uint num_args;
zend_uint required_num_args;
zend_arg_info *arg_info;
zend_bool pass_rest_by_reference;
unsigned char return_reference;
/* END of common elements */ zend_bool done_pass_two; zend_uint *refcount; zend_op *opcodes; // opcode数组 zend_uint lastsize; zend_compiled_variable *vars;
 
  int last_varsize_var;
  // ...
}

如上边的注释,opcode保存在这里,在执行的时候有下面的execute函数执行:

ZEND_API void execute(zend_op_array *op_array TSRMLS_DC)
{
// 循环执行op_array中的opcode或者执行其他op_array中的opcode
}

深入理解PHP内核(四)概览-PHP脚本的执行的更多相关文章

  1. 深入理解PHP内核(二)概览-PHP生命周期与Zend引擎

    本文参考自<深入理解PHP内核>,地址:https://github.com/reeze/tipi 本文链接:http://www.orlion.ml/232/ 1.SAPI接口 SAPI ...

  2. 深入理解PHP内核(三)概览-SAPI概述

    本文链接:http://www.orlion.ml/234/ 1.在PHP生命周期的各个阶段,一些与服务相关的操作都是通过SAPI接口实现.这些内置实现的物理位置在PHP源码的SAPI目录.这个目录存 ...

  3. 深入理解PHP内核(九)变量及数据类型-静态变量

    原文链接:http://www.orlion.ga/251/ 通常静态变量是静态分配的,他们的生命周期和程序的生命周期一样长,只有在程序退出后才结束生命周期,这和局部变量相反,有的语言中全局变量也是静 ...

  4. 深入理解php内核 编写扩展 I:介绍PHP和Zend

    内容: 编写扩展I -  PHP和Zend起步 原文:http://devzone.zend.com/public/view/tag/Extension Part I: Introduction to ...

  5. 读书笔记之Linux系统编程与深入理解Linux内核

    前言 本人再看深入理解Linux内核的时候发现比较难懂,看了Linux系统编程一说后,觉得Linux系统编程还是简单易懂些,并且两本书都是讲Linux比较底层的东西,只不过侧重点不同,本文就以Linu ...

  6. 《深入理解Android内核设计思想》

    <深入理解Android内核设计思想> 基本信息 作者: 林学森 出版社:人民邮电出版社 ISBN:9787115348418 上架时间:2014-4-25 出版日期:2014 年5月 开 ...

  7. 内核启动文件系统后第一个执行的文件(inittab启动脚本分析)

    Linux 开机脚本启动顺序: 第一步:启动内核 第二步:执行init (配置文件/etc/inittab) 第三步:启动相应的脚本,执行inittab脚本,并且执行里面的脚本/etc/init.d ...

  8. linux内核makefile概览

    linux内核makefile概览 本博客参照内核官方英文文档 linux的内核makefile主要用于编译整个内核源码,按照用户的需求生成各种目标文件,对于用户来说,编译内核时非常简单的,只需要几个 ...

  9. 深入理解NIO(四)—— epoll的实现原理

    深入理解NIO(四)—— epoll的实现原理 本文链接:https://www.cnblogs.com/fatmanhappycode/p/12362423.html 终于来到最后了,万里长征只差最 ...

随机推荐

  1. webapi版本升级管理

    由于近期公司人员流动,本人临时客串webapi开发,针对开发过程中碰到一些问题做一些改进 1.当前做法 项目webapi项目是居于asp.net框架开发的,每个功能模块新建一个api控制器,比如Use ...

  2. LIS最长上升子序列O(n^2)与O(nlogn)的算法

    动态规划 最长上升子序列问题(LIS).给定n个整数,按从左到右的顺序选出尽量多的整数,组成一个上升子序列(子序列可以理解为:删除0个或多个数,其他数的顺序不变).例如序列1, 6, 2, 3, 7, ...

  3. HDU 1284 钱币兑换问题

    动态转移方程:dp[i] = dp[i - 1] + dp[i - 2] + dp[i - 3] 即要想兑够 i,有三种方法: 1.从 i - 1 再增加一个1分的: 2.从 i - 2 再增加一个2 ...

  4. angularjs 表单验证(不完整版)

    针对项目实践表单验证总结: angular 的 form表单验证:form内需要novalidate取消默认验证,用ng自己的验证,form的名字是非常必要的 栗子:以注册为栗子,下面是注册的部分: ...

  5. mysql5.7中文乱码问题的解决,将编码统一改成utf8的方法

    修改配置文件my.ini 将其改为:(路径根据自己mysql的安装路径进行适当调整,与字符编码无关,不必改动) [mysqld] basedir=C:\MYSQL57datadir=C:\MYSQL5 ...

  6. Cookie与Session的区别-总结很好的文章

    Cookie与Session的区别-总结很好的文章 本文分别对Cookie与Session做一个介绍和总结,并分别对两个知识点进行对比分析,让大家对Cookie和Session有一个更深入的了解,并对 ...

  7. oracle表空间不足时的处理方法

    由于数据文件路径下的空间不足或表空间不足时,需要更换或扩展或新增表空间时,以下简单介绍下几种处理方式(数据文件/opt/oracle/oradata/testdb.dbf,原大小为100M) 一.扩大 ...

  8. windows management instrumentation服务未启动-解决脚本

    桌面新建.txt文件 将以下代码放入 保存为.bat文件 执行即可 @echo on cd /d c:\temp if not exist %windir%\system32\wbem goto Tr ...

  9. SQL Saturday活动再起

    SQL Saturday活动再起 时间:2015年05月09日(星期六) 地点:上海徐汇区港汇2座10楼(10.073) 我们相约港汇2座10楼(10.073),SQL PASS上海分会的SQLSat ...

  10. 【转】yahoo前端优化军规

    雅虎给出了前端优化的34条法则(包括Yslow规则22条) 详细说明,下载转发 ponytail 的译文(来自帕兰映像). Minimize HTTP Requests 减少http请求 图片.css ...