摘要:闲着没事用多模态评测API做了一个测评英语口语的互动小游戏,居然成了一场10万人参与的刷屏级活动。

上一期故事说到,我成为了公司技术委员会副主席,上任后的第一件事是建立了一个云容器化的研发资料库,把每个研发硬盘里那点“好东西”都复用出来。(详情查看:《无法想象!大龄码农的硬盘里有这么多宝藏》)

自此以后,老大交给我的撸代码的活越来越少,让我专心把技术委员会做起来。人一闲下来吧,就容易生事儿,这不么,闲着没事做了一个互动小游戏,运营妹子从公众号上推了张海报,居然成了一场10万人参与的刷屏级活动。

咋回事呢?大概是7月25号,我看到一条新闻,北京2021年高考要增加英语口语考试。妈耶,这也太突然了,这不跟产品经理突然提需求、微博的运维赶上明星突然宣布结婚/分手一样让人猝不及防么。

很快,有孩子正上高中的家长都在朋友圈转发了这条消息,这事的关注度这么高啊?总听说运营擅长抓热点,那我是不是也可以做点什么抓住这次热点呢?

对于这个政策,家长和学生最关注最需要的是什么?考口语,首先得知道自己的口语水平怎么样,知道短板在哪才能有针对性地补习提高。那就是说需要口语测评!

我想起之前在华为云官网上看到过一个“多模态评测”API,能够根据朗读视频数据和试题文本,给朗读者的口语评测分数。我可以利用这个API做一个测评类的H5小游戏。

按照我的习惯,实现功能的过程会同步梳理成文档,便于后浪们学习。

《多模态英语口语评测》

内容来源

多模态口语现在还在公测阶段,所以我提前在华为云上申请了公测,当天就公测通过了~(公测链接:https://activity.huaweicloud.com/AI_free0.html?ggw_hd )

步骤一:数据准备

l 支持的video类型包括avi/mp4/webm/mkv/flv等封装格式,视频清晰度不低于240p,帧率不低于25fps,大小限制在10M

l 支持语言:英式英语

l 评测模式:单词评测、句子评测

l 需要把视频转化为对应的base64编码上传

转化举例(Python)

  1. #!/usr/bin/env python
  2. # encoding: utf-
  3.  
  4. import base64
  5. def ToBase64(file, txt):
  6. with open(file, 'rb') as fileObj:
  7. image_data = fileObj.read()
  8. base64_data = base64.b64encode(image_data)
  9. fout = open(txt, 'w')
  10. fout.write(base64_data.decode())
  11. fout.close()
  12. ToBase64("./test.wav",'2.txt') # 音频文件转换为base64

步骤二:构建请求

华为云语音交互服务的通用请求方式如下图所示。

备注:

l 多模态评测API目前处于公测阶段,在华为-北京四可以调用,其Endpoint为“sis-ext.cn-north-4.myhuaweicloud.com”。

l 需要确认个人专有华为云项目ID和Token(身份认证)

项目ID获取方法Token查询方法

获取了身份认证后,就可以填写请求了。假设我现在有一个avi格式的文件,想用单词模式去判断口语质量,我要学习的口语是“sit down”。

请求示例是:

  1. POST https://{endpoint}/v1/{project_id}/assessment/video
  2.  
  3. Request Header:
  4. Content-Type: application/json
  5. X-Auth-Token: MIINRwYJKoZIhvcNAQcCoIINODCCDTQCAQExDTALBglghkgBZQMEAgEwgguVBgkqhkiG...
  6.  
  7. Request Body:
  8. {
  9. "config":{
  10. "video_format": "avi",
  11. "language": "en_gb",
  12. "mode": "word"
  13. },
  14. "video_data": "/+MgxAAUeHpMAUkQAANhuRAC...",
  15. "ref_text": "sit down"
  16. }

步骤三:返回结果

  1. {
  2. "fluency": {
  3. "score": 75.02139,
  4. "rhythm": 50.042786,
  5. "cohesion": 100.0
  6. },
  7. "pronunciation": {
  8. "score": 36.817684,
  9. "gop": 36.817684
  10. },
  11. "score": 22.09061,
  12. "completeness": 0.0,
  13. "duration": 2.46,
  14. "words": [此后为音素、音标评价结果,其返回结果见下方]

从返回的结果可以看到:

(1)从流利度看:流利度评分75.02;连贯性是满分;韵律弱一点,只有50.04分

(2)从发音看:我的发音质量综合打分(score)是36.82分;发音好坏打分是36.82分

(3)最后的综合评分:22.09分…

哎,还挺准确,我从小英语口语就差…

还能进行英语口语练习,从发音嘴型、发音效果纠正口语。通过具体的单一单词、音素、音标打分,就能知道需要对哪个单词、音标加强练习了。

以“sit”发音评测为例,反馈结果如下:

  1. "words": [
  2. {
  3. "fluency": {
  4. "score": 68.29714,
  5. "rhythm": 68.29714
  6. },
  7. "pronunciation": {
  8. "score": 24.714167,
  9. "gop": 24.714167
  10. },
  11. "out_of_vocabulary": false,
  12. "text": "sit",
  13. "text_original": "sit",
  14. "text_normalised": [
  15. "sit"
  16. ],
  17. "score": 46.505653,
  18. "start_time": 1.03,
  19. "end_time": 1.06,
  20. "phonemes": [
  21. {
  22. "fluency": {
  23. "score": 31.643274,
  24. "rhythm": 31.643274
  25. },
  26. "pronunciation": {
  27. "score": 16.471563,
  28. "gop": 16.471563
  29. },
  30. "start_time": 1.03,
  31. "end_time": 1.04,
  32. "arpa": "S",
  33. "ipa": "s"
  34. },
  35. {
  36. "fluency": {
  37. "score": 87.00653,
  38. "rhythm": 87.00653
  39. },
  40. "pronunciation": {
  41. "score": 28.179922,
  42. "gop": 28.179922
  43. },
  44. "start_time": 1.04,
  45. "end_time": 1.05,
  46. "arpa": "IH",
  47. "ipa": "i"
  48. },
  49. {
  50. "fluency": {
  51. "score": 86.241615,
  52. "rhythm": 86.241615
  53. },
  54. "pronunciation": {
  55. "score": 29.491013,
  56. "gop": 29.491013
  57. },
  58. "start_time": 1.05,
  59. "end_time": 1.06,
  60. "arpa": "T",
  61. "ipa": "t"
  62. }
  63. ]
  64. },
  65. ],
  66. }

很快我就把小游戏做完了,以口语能力测评为核心玩法,加入了邀请好友再玩一次的分享引导机制,没想到只是从公司公众号上推了一下,朋友圈里居然刷了屏,上线3天,游戏人数就超过了10万人!一次由研发主导的10W+刷屏活动就这样诞生了,谁说研发不懂运营?

据了解,目前API Explorer平台已开放EI企业智能、计算、应用服务、网络、软件开发平台、视频等70+云服务,共上线2000+个API、6000+个错误码。在前期试运行期间,华为云API Explorer平台上的API接口也已被多家企业成功接入。

点击查看详情:《华为云一站式API解决方案平台API Explorer上线》

华为云API Explorer平台在未来几个月会实现更多功能,比如支持SDK示例代码、CLI等特性,同时也会开放更多的云服务API接口,连接更多开发者实现创新、拓宽创新边界。

点击关注,第一时间了解华为云新鲜技术~

【API进阶之路】高考要考口语?我用多模态评测API做了一场10w+刷屏活动的更多相关文章

  1. 【API进阶之路】API带来的微创新,打动投资人鼓励我创业

    摘要:怎么帮助创作者提高视频的推荐量呢?我发现了:视频的封面图非常重要. 上回说到,老板一拍脑门,交代了一个新项目:小成本开发一款短视频剪辑工具([<[API进阶之路]人少钱少需求多的新项目该怎 ...

  2. 【API进阶之路】帮公司省下20万调研费!如何巧用情感分析API实现用户偏好调研

    摘要:自从学习API后,仿佛解锁了新技能,可别小看了一个小小的API接口,用好了都是能力无穷.这不,用情感分析API来做用户偏好调研,没想到这么一个小创意给公司省了20万调研费用. 上次借着高考热点整 ...

  3. 【API进阶之路】破圈,用一个API代替10人内容团队

    摘要:我用一个API代替10人内容团队,一年帮老板省了一百万. 自从学习API以后,我用技术手段相继帮助业务部.市场部解决了不少难题,算是从纯研发破圈发展到了业务端.老板召开业务讨论会的时候也会带上我 ...

  4. 【API进阶之路】无法想象!大龄码农的硬盘里有这么多宝藏

    摘要:通过把所需建立的工具库做成云容器化应用,用CCE引擎,通过API网关调用云容器引擎中的容器应用.不仅顺应了云原生的发展趋势,还能随时弹性扩容,满足公司规模化发展的需求. 公司开完年中会后,大家的 ...

  5. 【API进阶之路6】一个技术盲点,差点让整个项目翻车

    上次教了实习生一个方案之后,这小子跟运营妹子的关系是越走越近,时不时地撒把狗粮,在我司真正实现了研发运营一家亲~(上回你没看?戳上文剧情回顾:万万没想到,一个技术方案帮实习生追到了运营妹子) 这回想跟 ...

  6. 【API进阶之路】老板给我涨薪30%!如何通过SDK接口搞定千万级流量直播

    摘要:看我如何通过API Explorer 的SDK接口搞定千万级流量直播. 最近几个月,我的变化其实还蛮大的,从一个被实习生“无视”的“前浪”,转变成了不仅能够解决技术问题还能解决业务问题(顺手还能 ...

  7. 【API进阶之路】逆袭!用关键词抽取API搞定用户需求洞察

    摘要: 老大说,我这份用关键词抽取API搞定的用户需求洞察报告,简直比比市场调研的科班人士做得还好. 最近这半个月的午饭,那可是相当不错,市场老大天天请吃饭,不是外面下馆子,就是从家带饺子.说是感谢我 ...

  8. 【API进阶之路】用API打造一条自动化内容生产流水线

    摘要:搞定了内容审核之后,我又把抓取工具.内容审核API.文本摘要生成API串联在一起,从抓到审再到编,建立了一条自动化的内容生产流水线,编辑团队只需要做优质内容的推荐就可以了. 上周,运营部将官网上 ...

  9. 【API进阶之路】研发需求突增3倍,测试团队集体闹离职

    摘要:最近研发的需求量涨了3倍,开发团队拼命赶进度,可苦了测试团队. 本以为从一线研发转管理后会清闲一些,但是没想到,我还要充当救火队员的角色. 到了第四季度,各业务部门都在憋着劲儿冲业绩,毕竟这跟年 ...

随机推荐

  1. [C#]正则表达式的基本用法

    C#正则表达式的基本用法 正则表达式(regular expression)描述了一种字符串匹配的模式(pattern),可以用来检查一个串是否含有某种子串.将匹配的子串替换或者从某个串中取出符合某个 ...

  2. Java中的大数值使用

    在Java中,偶尔会遇到超大数值,超出了已有的int,double,float等等你已知的整数.浮点数范围,那么可以使用java.math包中的两个类:BigInteger和BigDecimal. 这 ...

  3. Problem C: 计算机类

    Description 定义一个Computer类,有两个属性: 1. 字符串属性name,用于表示计算机的名字. 2. 静态整型属性cnt,用于记录产生的计算机对象的个数. 至少有如下成员函数: 1 ...

  4. 关于git的一些简单命令

    git简介 1 Git是什么? Git is a free and open source distributed version control system designed to handle ...

  5. Redis系列(九):Redis的事务机制

    提到事务,相信大家都不陌生,事务的ACID四大特性,也是面试时经常问的,不过一般情况下,我们可能想到的是传统关系型数据库的事务,其实,Redis也是提供了事务机制的,本篇博客就来讲解下Redis的事务 ...

  6. 第二部分_Mac技巧

    原文是"池建强"的微信文章,公众号为"MacTalk" 第五十一天 mdfind是一个非常灵活的全局搜索命令,类似Spotlight的命令行模式,可以在任何目录 ...

  7. 一分钟玩转 Spring IoC!

    前言 「上一篇文章」我们对 Spring 有了初步的认识,而 Spring 全家桶中几乎所有组件都是依赖于 IoC 的. 刚开始听到 IoC,会觉得特别高大上,但其实掰开了很简单. 跟着我的脚步,一文 ...

  8. PHP 5 echo 和 print 语句

    PHP 5 echo 和 print 语句 在 PHP 中有两个基本的输出方式: echo 和 print. 本章节中我们会详细讨论两个语句的用法,并在实例中演示如何使用 echo 和 print. ...

  9. PHP fgetcsv() 函数

    定义和用法 fgetcsv() 函数从打开的文件中解析一行,校验 CSV 字段. fgetcsv() 函数会在到达指定长度或读到文件末尾(EOF)时(以先到者为准),停止返回一个新行. 该函数如果成功 ...

  10. PHP strtolower() 函数

    实例 把所有字符转换为小写: <?php高佣联盟 www.cgewang.comecho strtolower("Hello WORLD.");?> 定义和用法 str ...