这里有一篇写的不错的:http://www.jianshu.com/p/1840035cb510

自己的“格式化”后的内容备忘下:

  我们总在说c10k的问题, 也做了不少优化, 然后优化总是不够的。

  其中的一个瓶颈就是一些耗时的操作(网络请求/文件操作--含耗时的数据库操作)。

  如果我们不关心他们的返回值,则可以将其做成异步任务,保证执行成功即可。

  

  开始阐述之前约定一些概念:

    1. web请求处理进程(简称:消息生产者,记做P), 这是我们c10k问题注意的焦点

    2. 消息的处理者(简称:消费者,记做C), 在成功“男人”后面默默无闻工作的“女人”  

    3. 消息存放的地方(简称: 消息队列, 记做Q)

    4. 消息/任务, 记做T

基本处理过程:

    1. P将T保存到Q

    2. C从Q中取出一个T实例, 处理, 若处理失败则将T示例退回到Q(务必保证T得到成功处理)。

  

  最简单的实现方案:

    redis 消息队列(利用redis list类型)的lpush/rpop(brpop)来处理。python代码如下:

    TaskServer.py

  1. # -*- coding:utf-8 -*-
  2. import traceback
  3. import simplejson
  4. import redis
  5. import uuid
  6. from functools import wraps
  7.  
  8. class TaskExecutor(object):
  9. def __init__(self, task_name , *args, **kwargs):
  10. self.queue = redis.StrictRedis()#host='localhost', port=6378, db=0, password='xxx_tasks')
  11. self.task_name = task_name
  12.  
  13. def _publish_task(self, task_id , func, *args, **kwargs):
  14. self.queue.lpush(self.task_name,
  15. simplejson.dumps({'id':task_id, 'func':func, 'args':args, 'kwargs':kwargs})
  16. )
  17.  
  18. def task(self, func):#decorator
  19. setattr(func,'delay',lambda *args, **kwargs:self._publish_task(uuid.uuid4().hex, func.__name__, *args, **kwargs))
  20. @wraps(func)
  21. def _w(*args, **kwargs):
  22. return func(*args, **kwargs)
  23. return _w
  24.  
  25. def run(self):
  26. print 'waiting for tasks...'
  27. while True:
  28. if self.queue.llen(self.task_name):
  29. msg_data = simplejson.loads( self.queue.rpop(self.task_name))#这里可以用StrictRedis实例的brpop改善,去掉llen轮询。
  30.  
  31. print 'handling task(id:{0})...'.format(msg_data['id'])
  32. try:
  33. if msg_data.get('func',None):
  34. func = eval(msg_data.get('func'))
  35. if callable(func):
  36. #print msg_data['args'], msg_data['kwargs']
  37. ret = func(*msg_data['args'], **msg_data['kwargs'])
  38. msg_data.update({'result':ret})
  39. self.queue.lpush(self.task_name+'.response.success', simplejson.dumps(msg_data) )
  40. except:
  41. msg_data.update({'failed_times':msg_data.get('failed_times',0)+1, 'failed_reason':traceback.format_exc()})
  42. if msg_data.get('failed_times',0)<10:#最多失败10次,避免死循环
  43. self.queue.rpush(self.task_name,simplejson.dumps(msg_data))
  44. else:
  45. self.queue.lpush(self.task_name+'.response.failure', simplejson.dumps(msg_data) )
  46. print traceback.format_exc()
  47.  
  48. PingTask = TaskExecutor('PingTask')
  49.  
  50. @PingTask.task
  51. def ping_url(url):
  52. import os
  53. os.system('ping -c 2 '+url)
  54.  
  55. if __name__=='__main__':
  56. PingTask.run()

运行服务:python TaskServer.py  

ps:

    1. TaskExecutor类是一个轻量级的celery.Celery实现。提供了 task修饰器。对被修饰的函数添加delay 方法(将原任务方法名/参数保存到redis的list中--FIFO--实际上celery也是类似的处理

    2. 客户端只要定义自己的TaskExecutor实例以及用此实例的task修饰对应的任务处理函数func。并在代码中待用 func.delay(...)实现异步调用(为了保证成功,最多调用10次); 成功的记录会保存在 redis的 "任务名.response.success" 队列中, 超过10次仍然失败的保存在 “任务名.response.failure"队列中。

    3. 待改进的地方是很多的, 比如多线程, 负载均衡。(尚未阅读celery源码)

  TaskClient.py

  1. # -*- coding:utf-8 -*-
  2. import sys
  3. sys.path.append('./')
  4. from my_tasks import ping_url
  5. ping_url.delay('www.baidu.com')

ps: 客户端和服务器文件在统一linux目录下。

 celery

  试验证明, celery目测大体上跟上面的“基本处理过程”基本一致。即:

  P将T保存在Q中。

  C从Q中取出T处理(保证成功--会不会死循环?执行一个注定失败的任务--就没有验证了)。

  celery的运用比较简单:

    1.安装celery   

    2.编写需要异步执行的任务函数,并用celery实例的task修饰器修饰

    3.调用异步任务时, 用函数名.delay(参数)形式调用为异步调用。 函数名(参数)方式为同步调用。

    4.执行celery监听服务

demo 这里有:http://www.jianshu.com/p/1840035cb510。 再来一个极简的:

    tasks.py   

  1. # -*- coding:utf-8 -*-
  2. from celery import Celery
  3. brokers = 'redis://127.0.0.1:6379/5'
  4. backend = 'redis://127.0.0.1:6379/6'
  5.  
  6. import time
  7.  
  8. app = Celery('tasks', backend=backend, broker=brokers)
  9.  
  10. @app.task
  11. def add(x,y):
  12. time.sleep(10)
  13. return x+y

运行celery监听服务:celery -A tasks worker -l error

    

顺便附上测试代码:tasks_test.py(跟tasks.py同一路径,linux环境)

  1. # -*- coding:utf-8 -*-
  2. import sys
  3. sys.path.append('./')
  4. def test():
  5. from tasks import add
  6. for i in range(1000):
  7. add.delay(i,i+1)
  8.  
  9. if __name__=='__main__':
  10. test()

执行之 : python tasks_test.py

(可以1秒内跑完, 证明的确异步处理了)

顺便查看了下进程,发现celery自动开了一个主进程, 与cpu核数相同的子线程。看了下官方文档,有web监控用的插件(flower)。

安装: sudo pip install flower

运行之(跟tasks.py先同目录): celery -A tasks flower --port=5555

效果图如下(木有发现失败任务--"Failed tasks"---很遗憾):

 flower的基本原理推测是直接查询Q, 并基于结果输出图表等。

ref: https://abhishek-tiwari.com/post/amqp-rabbitmq-and-celery-a-visual-guide-for-dummies

  转载请注明来源:http://www.cnblogs.com/Tommy-Yu/p/5955294.html

  谢谢!

  

celery 原理理解的更多相关文章

  1. JUC回顾之-ConcurrentHashMap源码解读及原理理解

    ConcurrentHashMap结构图如下: ConcurrentHashMap实现类图如下: segment的结构图如下: package concurrentMy.juc_collections ...

  2. POJ1523(割点所确定的连用分量数目,tarjan算法原理理解)

    SPF Time Limit: 1000MS   Memory Limit: 10000K Total Submissions: 7406   Accepted: 3363 Description C ...

  3. java的classLoader原理理解和分析

    java的classLoader原理理解和分析 学习了:http://blog.csdn.net/tangkund3218/article/details/50088249 ClassNotFound ...

  4. js 闭包原理理解

    问题?什么是js(JavaScript)的闭包原理,有什么作用? 一.定义 官方解释:闭包是一个拥有许多变量和绑定了这些变量的环境的表达式(通常是一个函数),因而这些变量也是该表达式的一部分. 很显然 ...

  5. kalman filter卡尔曼滤波器- 数学推导和原理理解-----网上讲的比较好的kalman filter和整理、将预测值和观测值融和

    = 参考/转自: 1 ---https://blog.csdn.net/u010720661/article/details/63253509 2----http://www.bzarg.com/p/ ...

  6. debug 调试原理理解

    引言: 昨天,看了一篇文章,很受启发,记得之前听别的人远程调试过代码,觉得很神奇,在自己程序里打断点,连接远程服务器,开启调试后可以调用远程方法来看数据的输入和输出,不需要查找问题,重新部署,测试问题 ...

  7. shiro的原理理解

    1.shiro原理图如下: 框架解释: subject:主体,可以是用户也可以是程序,主体要访问系统,系统需要对主体进行认证.授权. securityManager:安全管理器,主体进行认证和授权都 ...

  8. celery简单理解和使用

    解决同步阻塞的问题 将耗时任务放到后台异步执行,不影响用户其他操作. 实现原理 任务队列是一种跨线程,跨机器的机制. 任务队列中包含称作任务的工作单元.有专门的进程持续不断的监视任务队列,并从中得到新 ...

  9. JAVA 1.7并发之LinkedTransferQueue原理理解

    昨天刚看完BlockingQueue觉得好高级啊,今天扫到1.7就发现了升级版.... 如果对内容觉得不够充分,可以去看http://www.cs.rochester.edu/u/scott/pape ...

随机推荐

  1. iOS: lame框架将PCM录音转成MP3格式

    lame框架将PCM录音转成MP3格式 1.lame下载地址:https://github.com/rbrito/lame,它是一个不可执行的文件,需要借助build-lame.sh脚本将其编译成.a ...

  2. 解密gzip压缩的网页数据流(转)

    因为采集某个网页遇到问题,一直无法获取页面数据. 经过一番排查,发现该网站会检查客户端的Header信息,如果遇到不明确的Header信息就直接否定,返回0数据. 如果Header信息正确,就会返回经 ...

  3. SSH框架搭建详细图文教程(转)

    这篇文章看的我醍醐灌顶的感觉,比之前本科时候学习的SSH架构 要清晰数倍  非常感觉这篇博主的文章 文章链接为:http://blog.sina.com.cn/s/blog_a6a6b3cd01017 ...

  4. angularjs 动态表单, 原生事件中调用angular方法

    1. 原生事件中调用angular方法, 比如 input的onChange事件想调用angular里面定义的方法 - onChange="angular.element(this).sco ...

  5. ANTLR flex/bison

    https://stackoverflow.com/questions/29971097/how-to-create-ast-with-antlr4 这个很值得仔细看 https://github.c ...

  6. javascript arguments介绍

    来源于: https://developer.mozilla.org/zh-CN/docs/Web/JavaScript/Reference/Functions/arguments https://g ...

  7. hihocoder第238周:杨氏矩阵的个数

    题目链接 问题描述 给定一个N行M列的矩阵,往里面填入$1-N\times M$个数字,使得这个矩阵每行.每列都满足递增.问:有多少种填法? 问题分析 这个问题很难,如果能够直接想到,那就是天才了. ...

  8. C#通过DSOFile读取与修改文件的属性

    搜了一圈用C#读取与修改文件属性的文章,结果几乎找不到- -: 偶然间看到一个DSOFile工具,然后找到了对该工具进行详细讲解的一篇文章:<DSOfile,一个修改windows系统文件摘要的 ...

  9. ASP.NET中TimeSpan的用法

    一.TimeSpan常量.字段 TimeSpan.MaxValue; // 10675199.02:48:05.4775807TimeSpan.MinValue; //-10675199.02:48: ...

  10. 使用VisualSVN Server搭建SVNserver (Windows环境为例)

    使用 VisualSVN Server来实现主要的 SVN功能则要比使用原始的 SVN和Apache相配合来实现源代码的 SVN管理简单的多,下面就看看详细的说明. VisualSVN Server的 ...