P2473 [SCOI2008]奖励关

题目背景

08四川NOI省选

题目描述

你正在玩你最喜欢的电子游戏，并且刚刚进入一个奖励关。在这个奖励关里，系统将依次随机抛出k次宝物，每次你都可以选择吃或者不吃（必须在抛出下一个宝物之前做出选择，且现在决定不吃的宝物以后也不能再吃）。

宝物一共有n种，系统每次抛出这n种宝物的概率都相同且相互独立。也就是说，即使前k-1 次系统都抛出宝物1（这种情况是有可能出现的，尽管概率非常小），第k次抛出各个宝物的概率依然均为1/n。

获取第 i 种宝物将得到Pi分，但并不是每种宝物都是可以随意获取的。第i种宝物有一个前提宝物集合Si。只有当Si中所有宝物都至少吃过一次，才能吃第i 种宝物（如果系统抛出了一个目前不能吃的宝物，相当于白白的损失了一次机会）。注意，Pi 可以是负数，但如果它是很多高分宝物的前提，损失短期利益而吃掉这个负分宝物将获得更大的长期利益。

假设你采取最优策略，平均情况你一共能在奖励关得到多少分值？

输入输出格式

输入格式：

第一行为两个正整数k 和n，即宝物的数量和种类。以下n行分别描述一种

宝物，其中第一个整数代表分值，随后的整数依次代表该宝物的各个前提宝物（各

宝物编号为1到n），以0结尾。

输出格式：

输出一个实数，保留六位小数，即在最优策略下平均情况的得分。

输入输出样例

输入样例#1：复制

输出样例#1：复制

1.500000

输入样例#2：复制

6 6

12 2 3 4 5 0

15 5 0

-2 2 4 5 0

-11 2 5 0

5 0

1 2 4 5 0

输出样例#2：复制

10.023470

说明

1 <= k <= 100, 1 <= n <= 15，分值为[-106,106]内的整数。

Solution

果然老李给的是期望专题....

这道题状态比较好想，数据暗示状压。定义$dp[i][j]$表示当前到了第$i$轮，状态为$j$时获得的期望值。从前到后不好转移，有些状态无法到达。

所以考虑倒推，从后面能到达的状态转移回来，最后答案就是$dp[1][0]$。

Code

#include<bits/stdc++.h>

using namespace std;

int n, k, w[], s[( << ) + ];

double dp[][( << ) + ];

int main() {

    scanf("%d%d", &k, &n);

    for(int i = ; i <= n; i ++) {

        scanf("%d", &w[i]);

        int a;

        while(scanf("%d", &a) == ) {

            if(a == )    break;

            s[i] |= ( << (a - ));

        }

    }

    for(int i = k; i >= ; i --)

        for(int j = ; j < ( << n); j ++) {

            for(int p = ; p <= n; p ++)

                if((j & s[p]) == s[p])

                    dp[i][j] += max(dp[i + ][j], dp[i + ][j | ( << (p - ))] + 1.0 * w[p]);

                else dp[i][j] += dp[i + ][j];

            dp[i][j] /= n;

        }

    printf("%.6lf", dp[][]);

    return ;

}

【洛谷】2473：[SCOI2008]奖励关【期望DP（倒推）】的更多相关文章

洛谷 P2473 [SCOI2008]奖励关 ( 期望DP )
题目链接题意 : 中文题.点链接分析 : 第一道有关概率期望的DP 有个大部分情况下通用的结论概率正推.期望反推原因不明.其实是没有查到较好的解释这题由于有一些取物品的先决条件在这里而且观 ...
BZOJ.1076.[SCOI2008]奖励关(概率DP 倒推)
题目链接 BZOJ 洛谷真的题意不明啊.. $Description$ 你有k次选择的机会,每次将从n种物品中随机一件给你,你可以选择选或不选.选择它会获得这种物品的价值:选择一件物品前需要先选 ...
洛谷2473(SCOI2008)奖励关
题目:https://www.luogu.org/problemnew/show/P2473 因为可不可选此物与之前选过什么物品有关,所以状态可以记录成前面已经选过什么物品. 因为选不选此物与它带来的 ...
洛谷 P2473 [SCOI2008]奖励关解题报告
P2473 [SCOI2008]奖励关题目描述你正在玩你最喜欢的电子游戏,并且刚刚进入一个奖励关.在这个奖励关里,系统将依次随机抛出$k$次宝物,每次你都可以选择吃或者不吃(必须在抛出下一个宝 ...
bzoj1076: [SCOI2008]奖励关(期望dp+状压dp)
1076: [SCOI2008]奖励关 Time Limit: 10 Sec Memory Limit: 128 MBSubmit: 2989 Solved: 1557[Submit][Statu ...
洛谷P2473 [SCOI2008]奖励关（期望+状压）
传送门我数学期望还是太差了…… 先考虑状压模型,设$dp[i][S]$表示第$i$轮,当前宝物状态为$S$,能获得的最大期望分数然而这个模型有一个问题,第$i$轮不一定能达到状态$S$ 那么考虑转 ...
【bzoj1076】[SCOI2008]奖励关期望dp+状态压缩dp
题目描述你正在玩你最喜欢的电子游戏,并且刚刚进入一个奖励关.在这个奖励关里,系统将依次随机抛出k次宝物,每次你都可以选择吃或者不吃(必须在抛出下一个宝物之前做出选择,且现在决定不吃的宝物以后也不能再 ...
【BZOJ】1076 [SCOI2008]奖励关期望DP+状压DP
[题意]n种宝物,k关游戏,每关游戏给出一种宝物,可捡可不捡.每种宝物有一个价值(有负数).每个宝物有前提宝物列表,必须在前面的关卡取得列表宝物才能捡起这个宝物,求期望收益.k<=100,n&l ...
洛谷 P2473 [SCOI2008]奖励关(状压dp+期望)
题面 luogu 题解 $n \leq 15$ 状压 $f[i][S]$表示第$i$轮,吃过的集合为$S$ 正着转移好像有点复杂考虑逆推转移(正着转移应该也行) \(f[i][S]\ ...
洛谷P2507 [SCOI2008]配对题解（dp+贪心）
洛谷P2507 [SCOI2008]配对题解(dp+贪心) 标签:题解阅读体验:https://zybuluo.com/Junlier/note/1299251 链接题目地址:洛谷P2507 [S ...

随机推荐

【codeforces】【比赛题解】#851 CF Round #432 (Div.2)
cf真的难…… 点我浏览丧题. [A]Arpa和她对墨西哥人浪的研究 Arpa正在对墨西哥人浪进行研究. 有n个人站成一排,从1到n编号,他们从时刻0开始墨西哥人浪. 在时刻1,第一个人站起来.在时刻 ...
go 匿名函数和闭包
匿名函数 1. 函数也是一种类型,因此可以定义作为一个函数类型的变量 package main import "fmt" // 函数作为参数 func add(a, b int) ...
aarch64_g5
gtkmm24-devel-2.24.5-2.fc26.aarch64.rpm 2017-02-11 18:17 620K fedora Mirroring Project gtkmm24-docs- ...
python网络编程--线程event
一:线程event作用 Python提供了Event对象用于线程间通信,它是线程设置的信号标志,如果信号标志位真,则其他线程等待直到信号结束. Event对象实现了简单的线程通信机制,它提供了设置信号 ...
2018JAVA复习摘要
由于公司内部原因,2018年感觉自己可能会换个新环境:虽然时间尚未确定,但还是得提前做好防范,毕竟面试复习是需要时间好好准备才能拿到自己理想的offer.打算从清明节之后开始好复习基本知识要点,先整理 ...
Effective STL 学习笔记： Thread Safety and STL Container
Table of Contents 1. STL, Thread and SGI 2. STL and Lock 2.1. RAII 2.2. Use Lock in STL 1 STL, Threa ...
旁门左道通过JS与纯CSS实现显示隐藏层
想必大家在开发前端页面时,肯定少不了显示隐藏层这一技术点.那么我简单粗暴地总结了以下两个小demo. 要实现该截图的功能:鼠标移动到我的好友这个选项卡时,灰色的隐藏层就会出现.
GUC-8 小练习
import java.util.concurrent.locks.Condition; import java.util.concurrent.locks.Lock; import java.uti ...
JSON解析代码
/** * 解析有数据头的纯数组 */ private void parseHaveHeaderJArray() { //拿到本地JSON 并转成String String strByJson = J ...
LoadRunner中的IP欺骗的设置以及误区
LoadRunner中的IP欺骗的设置以及误区最近在忙着部署web性能测试的环境后,对IP欺骗进行设置,特地做个笔记,给自己的学习历程留下点足迹. 一. 什么是IP欺骗? 做什么事首先要问个为什么, ...

【洛谷】2473：[SCOI2008]奖励关【期望DP（倒推）】