CODEVS 2542单词__fail树
2542 单词
2013年省队选拔赛天津市队选拔赛
小张最近在忙毕业,所以一直在读论文。一篇论文是由许多单词组成的。
但小张发现一个单词会在论文中出现很多次,他想知道每个单词分别在论文中出现了多少次。
第一行一个整数N,表示有N个单词,接下来N行,每行一个单词,每个单词都由小写字母组成(N<=200)
输出N个整数,第i行的数表示第i个单词在文章中出现了多少次。
3
a
aa
aaa
6
3
1
30%的数据 单词总长度不超过10^3
100%的数据 单词总长度不超过10^6
————————————————————————————————————————————————————————————————————————————————
一看是AC自动机是没有问题的,但是建完AC自动机后该如何做呢?
当然可以直接用AC自动机的fail指针向前跳,但是这样要枚举单词内的每个位置,严重超时。
这里要用到一个很有用的工具——fail树。
当AC自动机建完以后,我们发现每一个节点都只有一个失败指针(根节点的可以忽略),且沿着失败指针最终能走到根节点。
这样我们将失败指针反向就可以变成一棵树。
这棵树的有些重要的性质:
1、以x节点为根的子树中每个节点代表的字符串都以x点所代表的字符串为后缀。
2、节点x代表的字符串的最大后缀为父节点代表的字符串。
这样我们在插入字符串是把经过的每个节点的val值都加1,就相当于统计的对应前缀出现的次数。
然后通过dfs将val变为val加它所有子树的val和。也就是以(s)为前缀的字符串个数+以(*+s)为前缀的字符串的个数+以(**+s)为前缀的个数+。。。。。
这样s出现的次数就是s串尾对应的val值。
比较难想,但是fail树真的很有用。
————————————————————————————————————————————————————————————————————————————————
1 #include<bits/stdc++.h>
2 using namespace std;
3 const int maxn=1e6+3;
4 const int maxs=26;
5 struct edge{
6 int u,v,next;
7 }e[maxn];
8 int head[maxn],js=0;
9 void addage(int u,int v)
10 {
11 e[++js].u=u;e[js].v=v;
12 e[js].next=head[u];head[u]=js;
13 }
14 struct AC{
15 int ch[maxn][maxs];
16 int val[maxn],f[maxn];
17 int sz;
18 AC(){
19 memset(ch[0],0,sizeof(ch[0]));
20 val[0]=0;
21 sz=1;
22 }
23 int idx(char c){
24 return c-'a';
25 }
26 int insert(char *s){
27 int n=strlen(s),cur=0;
28 for(int i=0,c;i<n;i++){
29 c=idx(s[i]);
30 if(!ch[cur][c]){
31 memset(ch[sz],0,sizeof(sz));
32 val[sz]=0;
33 ch[cur][c]=sz++;
34 }
35 cur=ch[cur][c];
36 val[cur]++;
37 }
38 return cur;
39 }
40 void getfail(){
41 queue<int>q;
42 f[0]=0;
43 for(int c=0;c<maxs;c++){
44 int v=ch[0][c];
45 if(v){
46 f[v]=0;
47 q.push(v);
48 addage(0,v);
49 }
50 }
51 while(!q.empty()){
52 int u=q.front();q.pop();
53 for(int c=0;c<maxs;++c){
54 int v=ch[u][c];
55 if(v){
56 q.push(v);
57 int r=f[u];
58 while(r && !ch[r][c])r=f[r];
59 f[v]=ch[r][c];
60 addage(f[v],v);
61 }
62 }
63 }
64 }
65 }ac;
66 int n;
67 int wz[201];
68 char s[maxn];
69 void dfs(int u,int f)
70 {
71 for(int i=head[u];i;i=e[i].next){
72 int u=e[i].u,v=e[i].v;
73 if(v==f)continue;
74 dfs(v,u);
75 ac.val[u]+=ac.val[v];
76 }
77 }
78 int main()
79 {
80 scanf("%d",&n);
81 for(int i=0;i<n;++i){
82 scanf("%s",s);
83 wz[i]=ac.insert(s);
84 }
85 ac.getfail();
86 dfs(0,-1);
87 for(int i=0;i<n;i++)
88 printf("%d\n",ac.val[wz[i]]);
89 return 0;
90 }
CODEVS 2542单词__fail树的更多相关文章
- codevs 1729 单词查找树
二次联通门 : codevs 1729 单词查找树 /* codevs 1729 单词查找树 Trie树 统计节点个数 建一棵Trie树 插入单词时每新开一个节点就计数器加1 */ #include ...
- 【NOI2000】 单词查找树
问题描述 在进行文法分析的时候,通常需要检测一个单词是否在我们的单词列表里.为了提高查找和定位的速度,通常都画出与单词列表所对应的单词查找树,其特点如下: 根结点不包含字母,除根结点外每一个结点都仅包 ...
- K:单词查找树(Trie)
单词查找树,又称前缀树或字典树,是一种有序树,用于保存关联数组,其中的键通常是字符串.Trie可以看作是一个确定有限状态自动机(DFA).与二叉查找树不同,键不是直接保存在节点中,而是由节点在树中 ...
- COGS 293.[NOI2000] 单词查找树
★ 输入文件:trie.in 输出文件:trie.out 简单对比 时间限制:1 s 内存限制:128 MB 在进行文法分析的时候,通常需要检测一个单词是否在我们的单词列表里.为了提高 ...
- 1729 单词查找树 2000年NOI全国竞赛
1729 单词查找树 2000年NOI全国竞赛 时间限制: 2 s 空间限制: 128000 KB 题目等级 : 大师 Master 题目描述 Description 在进行文法分析的 ...
- Trie树,又称单词查找树、字典
在百度或淘宝搜索时,每输入字符都会出现搜索建议,比如输入“北京”,搜索框下面会以北京为前缀,展示“北京爱情故事”.“北京公交”.“北京医院”等等搜索词.实现这类技术后台所采用的数据结构是什么?[中国某 ...
- [NOI2000] 单词查找树
★★ 输入文件:trie.in 输出文件:trie.out 简单对比 时间限制:1 s 内存限制:128 MB 在进行文法分析的时候,通常需要检测一个单词是否在我们的单词列表里.为了提 ...
- 293. [NOI2000] 单词查找树——COGS
293. [NOI2000] 单词查找树 ★★ 输入文件:trie.in 输出文件:trie.out 简单对比时间限制:1 s 内存限制:128 MB 在进行文法分析的时候,通常需要检 ...
- cogs 293. [NOI 2000] 单词查找树 Trie树字典树
293. [NOI 2000] 单词查找树 ★★☆ 输入文件:trie.in 输出文件:trie.out 简单对比时间限制:1 s 内存限制:128 MB 在进行文法分析的时候,通常需 ...
随机推荐
- Java将List中的实体按照某个字段进行分组的算法
public void test() { List<User> list = new ArrayList<>(); //User 实体 测试用 String id,name; ...
- 【Mongodb】后台主键_id自增(Java版本)
ObjectId的选择 创建MongoDB文档时,如果没有赋值ID,系统会自动帮你创建一个,通常会在客户端由驱动程序完成.得到的ObjectId类似于这种 ObjectId使用12字节的存储空间, ...
- Qt学习笔记-Qtcreator的webkit和qt4.7.0的版本有关
之前下载了一个最新的是qtcreator,是通过ubuntu的是apt-get下载的.可是里面没有webkit控件.网上的网友说是最新的没有了.要用老版的,于是下载了一个2.5.2的就正常了. 用老版 ...
- udp聊天室--简易
package 聊天; /*一切随便消逝吧*/ import java.net.DatagramSocket; import java.net.SocketException; public clas ...
- TCP实现网络通讯
Tcp server的流程:1.创建套接字:2.bind绑定ip和port3.listen使套接字变为可以被动链接:4.accept等待客户端的链接(返回为服务器分配的客户端的句柄和地址)5.reci ...
- 知乎上看到的一篇讲解Epoll的文章,较形象生动
作者:蓝形参链接:https://www.zhihu.com/question/20122137/answer/14049112来源:知乎著作权归作者所有.商业转载请联系作者获得授权,非商业转载请注明 ...
- TurtleBot3 Waffle (tx2版华夫)(7)底盘测试
说明:opencr本身带有自测底盘功能,通过按opencr的sw1和sw2来自检底盘是否正确安装和运行: 7.1.前进测试 1)测试前,先把小车架空,轮子不要着地: 2)接好电源后,打开opencr的 ...
- ASP.NET Core路由中间件[2]: 路由模式
一个Web应用本质上体现为一组终结点的集合.终结点则体现为一个暴露在网络中可供外界采用HTTP协议调用的服务,路由的作用就是建立一个请求URL模式与对应终结点之间的映射关系.借助这个映射关系,客户端可 ...
- Java内存模型精讲
1.JAVA 的并发模型 共享内存模型 在共享内存的并发模型里面,线程之间共享程序的公共状态,线程之间通过读写内存中公共状态来进行隐式通信 该内存指的是主内存,实际上是物理内存的一小部分 2.JAVA ...
- Vue 组件内滚动条 滚到到底部
因为在vue中,某个组件内 使用scrollTop赋值 滚动条没有变化 使用scrollTo 也不行(window.scorllTo 或者dom.scrollTo) 所以可以考虑使用投机取巧的办法: ...