【spoj705】 Distinct Substrings

【题目描述】

给定一个字符串，计算其不同的子串个数。

【输入格式】

一行一个仅包含大写字母的字符串，长度<=50000

【输出格式】

一行一个正整数，即不同的子串个数。

【样例输入】

ABABA

【样例输出】

9

【思路】
　　一看就知道是后缀数组题啦～但是我不会写QAQ。。只好现学现用啦～
　　在字符串最后补上一个'$',不因为别的只因为它比‘A’还要小。。不然你补ascII码是0的也可以。。
　　申请rank数组和sa数组，rank[i]=j代表后缀i排第j位，sa[i]=j代表排名第i的是后缀j。也就是说rank和sa是相反的运算。
　　首先将sa数组按照单字母的顺序排个序，更新rank数组，不过记得字母相同的排名也要相同，也就是如果str[sa[i]]==str[sa[i-1]]的话rank[sa[i]]=rank[sa[i-1]];else rank[sa[i]]=rank[sa[i-1]]+1;
　　然后将k从0开始枚举，每次继续对sa进行排序，但是是以rank[sa[i]]为第一关键字，rank[sa[i]+2^k]为第二关键字排序。
　　在Trank中（其实就是tmpRank）更新好新的rank值，一样记得如果rank[sa[i]]==rank[sa[i-1]]&&rank[sa[i]+2^k]==rank[sa[i-1]+2^k]的话排名不要上升。
　　重复这一步，直到2^k>=n或者所有后缀的排名都不同。
　　然后正常情况下k增加logN次，每次如果用计数排序只要O(N),一共O(NlogN)。
　　但是不会写计数排序啊QAQ。。所以用快排好了。。多加一个log，一般不会被卡的吧。。
　　计算出来sa和rank之后还要计算height数组，height[i]代表sa[i]和sa[i-1]的最长公共前缀，如果按照1——n的顺序计算的话是O(N²)的，显然不够优秀，于是我们按照一种奇怪的顺序计算。
　　先算height[rank[1]]，然后是height[rank[2]]……
　　这样的话就会有一个性质：height[rank[i]]>=height[rank[i-1]]-1
　　我也不知道为什么但是就是这样的。。
　　然后就没有然后了。。
　　我们知道任何一个子串都是某一个后缀的一个前缀
　　对于后缀i来说，有length-i个前缀，其中有height[i]个和前一个后缀相同
　　所以答案就是Σlength-i-height[i]

 #include <iostream>

 #include <cstring>

 #include <string>

 #include <cstdio>

 #include <cstdlib>

 #include <cmath>

 #include <algorithm>

 #include <queue>

 #include <stack>

 #include <map>

 #include <set>

 #include <list>

 #include <vector>

 #include <ctime>

 #include <functional>

 #define pritnf printf

 #define scafn scanf

 #define sacnf scanf

 #define For(i,j,k) for(int i=(j);i<=(k);(i)++)

 #define Clear(a) memset(a,0,sizeof(a))

 using namespace std;

 typedef unsigned int Uint;

 const int INF=0x3fffffff;

 const double eps=1e-;

 ///==============struct declaration==============

 ///==============var declaration=================

 const int MAXN=;

 int n,k;

 int sa[MAXN],rank[MAXN],h[MAXN],trank[MAXN],height[MAXN];

 char str[MAXN];

 ///==============function declaration============

 bool cmp(int a,int b){return rank[a]==rank[b]?rank[a+(<<k)]<rank[b+(<<k)]:rank[a]<rank[b];}

 bool cmp1(int a,int b){return str[a]<str[b];}

 ///==============main code=======================

 int main()

 {

     scanf("%s",str+);

     n=strlen(str+);str[n+]='$';n++;

     for(int i=;i<=n;i++)

         sa[i]=i;

     sort(sa+,sa++n,cmp1);

     rank[sa[]]=;

     for(int i=;i<=n;i++)

         if (str[sa[i]]!=str[sa[i-]])

             rank[sa[i]]=rank[sa[i-]]+;

         else

             rank[sa[i]]=rank[sa[i-]];

     for(k=;(<<k)<=n;k++){

         sort(sa+,sa++n,cmp);

         trank[sa[]]=;

         for(int i=;i<=n;i++){

             if (rank[sa[i]]!=rank[sa[i-]]||rank[sa[i]+(<<k)]!=rank[sa[i-]+(<<k)])

                 trank[sa[i]]=trank[sa[i-]]+;

             else

                 trank[sa[i]]=trank[sa[i-]];

         }

         for(int i=;i<=n;i++)

             rank[i]=trank[i];

         if (rank[sa[n]]==n) break;

     }

     for(int i=;i<=n;i++)

         rank[sa[i]]=i;

     ///height[i]表示sa[rank[i]]和sa[rank[i-1]]的最长前缀

     height[rank[]]=;

     for(int i=;i<=n;i++){

         height[rank[i]]=max(height[rank[i-]]-,);

         int p=i,q=sa[rank[i]-];

         while (str[p+height[rank[i]]]==str[q+height[rank[i]]])

             height[rank[i]]++;

     }

     long long ans=;

     for(int i=;i<=n;i++)

         ans+=n-sa[i]-height[i];

       printf("%lld\n",ans);

    return ;

 }

 ///================fuction code====================

Spoj 705

　　　尽量多做后缀数组的题目吧，熟能生巧，现在只是刚刚学会了后缀数组，还要多多加油才是。

【spoj705】 Distinct Substrings的更多相关文章

【SPOJ】Distinct Substrings（后缀自动机）
[SPOJ]Distinct Substrings(后缀自动机) 题面 Vjudge 题意:求一个串的不同子串的数量题解对于这个串构建后缀自动机之后我们知道每个串出现的次数就是\(right/e ...
【SPOJ】Distinct Substrings/New Distinct Substrings（后缀数组）
[SPOJ]Distinct Substrings/New Distinct Substrings(后缀数组) 题面 Vjudge1 Vjudge2 题解要求的是串的不同的子串个数两道一模一样的题 ...
【SPOJ】Distinct Substrings
[SPOJ]Distinct Substrings 求不同子串数量统计每个点有效的字符串数量(第一次出现的) \(\sum\limits_{now=1}^{nod}now.longest-paren ...
【SPOJ694】Distinct Substrings （SA）
求不相同子串个数该问题等价于求所有后缀间不相同前缀的个数..也就是对于每个后缀suffix(sa[i]),将贡献出n-sa[i]+1个,但同时,要减去那些重复的,即为height[i],故答案 ...
【CF316G3】Good Substrings 后缀自动机
[CF316G3]Good Substrings 题意:给出n个限制(p,l,r),我们称一个字符串满足一个限制当且仅当这个字符串在p中的出现次数在[l,r]之间.现在想问你S的所有本质不同的子串中, ...
【SPOJ 694】Distinct Substrings (更直接的求法)
[链接]h在这里写链接 [题意] 接上一篇文章 [题解] 一个字符串所有不同的子串的个数=∑(len-sa[i]-height[i]) [错的次数] 0 [反思] 在这了写反思 [代码] #inclu ...
【SPOJ 694】Distinct Substrings
[链接]h在这里写链接 [题意] 给你一个长度最多为1000的字符串让你求出一个数x,这个x=这个字符串的不同子串个数; [题解] 后缀数组题. 把原串复制一份,加在 ...
【UVA10829】 L-Gap Substrings （后缀数组）
Description If a string is in the form UVU, where U is not empty, and V has exactly L characters, we ...
【POJ3415】 Common Substrings（后缀数组|SAM）
Common Substrings Description A substring of a string T is defined as: T(i, k)=TiTi+1...Ti+k-1, 1≤i≤ ...

随机推荐

C语言学习第十次作业总结
同学们终于学到最有意思的东西:指针了.有人说指针是C语言的灵魂.虽然有点夸大,但是事实的确是如此.很多的时候,使用指针,会让过程变得简洁和精巧.这个在以后同学们深入学习使用C语言进行编程的时候就可以理 ...
php代码小实例
php多图上传 <html> <meta http-equiv="Content-Type" content="text/html; charset=u ...
Android公共技术收集
UML类图详解详解Android主流框架不可或缺的基石(ClassLoader,泛型,反射,注解) 公共技术点之 Java注解Annotation 公共技术点之 Java反射Reflection ...
C#事务
看了很多关于事务的概念,还是觉得维基百科上说的最好: 数据库事务(简称:事务)是数据库管理系统执行过程中的一个逻辑单位,由一个有限的数据库操作序列构成. 一个数据库事务通常包含了一个序列的对数据库的读 ...
Oracle 性能优化
(1) 选择最有效率的表名顺序(只在基于规则的优化器中有效):ORACLE的解析器按照从右到左的顺序处理FROM子句中的表名,FROM子句中写在最后的表(基础表 driving table) ...
validate表单验证插件
1.引入validate.js包 <script src="xx/xx/jquery.validate.min.js"></script> 2.表单验证 / ...
MAC上安装 HLA(High Level Assembly）
1.安装HLA 最新版的hla汇编器可在这里下载,支持MacOs,Linux,Windows平台 2.安装步骤将下载好的hla程序包放在Mac根目录下最重要的一步是设置好环境变量,打开Mac根目录 ...
深入研究HTTP协议以及部分应用
引言工作了一段时间,都是在开发网页,自然和http打交道打得最多了,投身工作之后原来理解的东西又变得模糊,所以有必要深入探讨一下http协议的细节,也借此总结一下学习的成果. HTTP相关认识对H ...
第一章 Part 1/2 Git 一览
虽然这个系列的文章主要关注的是Github,然而首先了解下Git的基本概念和名词也是非常有帮助的. 工作目录(Working Directory) 工作目录是你个人计算机上的一个目录.在该目录下,每一 ...
R语言批量规划求解
昨天读到一个项目,是关于优化求解的. 约束条件如下: 公司里有很多客户,客户之所以不继续用我们的产品了,是因为他账户余额是负的,所以,为了重新赢回这些客户,公司决定发放优惠券cover掉客户账户的负余 ...

【spoj705】 Distinct Substrings

【题目描述】

【输入格式】

【输出格式】

【样例输入】

【样例输出】

【spoj705】 Distinct Substrings的更多相关文章

随机推荐

热门专题