最“全”面的算法介绍：寻根究底探讨策略梯度

2018-06-05 13:39:36 AI中國

本文旨在为强化学习——策略梯度中最重要的一类控制算法提供简明而全面的介绍。作者将逐步讨论这些算法，从基础得出众所周知的结果。本文针对的是希望学习强化学习中任何主题的读者。

介绍

强化学习（RL）指的是学习问题和机器学习的子领域，近来由于很多原因，这一领域备受大家关注。（比如说，基于RL的系统打败了Go的世界冠军、RL掌握了各种各样的Atari游戏等等。）科研人员更是直言它富有极大的发展潜力。现在让我们更进一步的走进它。

强化学习是对学习问题的最一般的描述，其目的是使长期目标最大化。系统描述由一个代理组成，该代理通过其在离散时间步骤中的操作与环境交互获得奖励。

典型代理——环境反馈回路如下图所示。

强化学习的特征与人类如何有效地行动惊人地相似：体验世界、积累知识并利用所学来处理新情况。像许多人一样，这一吸引人的"天性"（尽管是一个更加棘手的表述）让作者兴奋，希望你也是如此。

背景和定义

RL背后的大量理论存在于"奖励假设"的假设之下，该假设概括地指出，代理人的所有目标都可以用一个叫做奖励的单一标量来解释。这点的确存在争议，但目前还很难反驳。更正式地说，奖励假设如下：

奖励假设即所有我们所说的目标和目的都可以被认为是所接收标量信号（称为奖励）的累积和的期望值的最大化。

作为一名RL从业者和研究人员，一个人的工作就是为一个给定的问题寻找一套正确的奖励，这个问题称为奖励塑造。

代理人必须通过一个称为马尔可夫决策过程的理论框架来进行正式工作，该过程由在每个状态下要做出的决策（要采取何种行动？）组成。这就产生了一系列的状态。这其中，行动和奖励被称为轨迹，

目标是使这套奖励最大化。更正式地说，我们看看马尔可夫决策过程框架：

马尔可夫决策过程：（折扣）马尔可夫决策过程（MDP）是一个元组（S，A，R，p，γ），例如

其中S_t，S_（t + 1）∈S（状态空间）、A_（t + 1）∈A（动作空间）、R_（t + 1）、R_t∈R（奖励空间）流程、G_t是折扣收益。

简而言之，MDP定义了转换到新状态的概率，在给定当前状态和执行操作的情况下获得一些奖励。这个框架在数学上是令人满意的，因为它是一阶马尔可夫。这是一种奇特的说法，即接下来发生的任何事情都只依赖于现在而不是过去。这个框架的另一个重要部分是折扣因子γ。它总结随着时间的推移而获得的奖励，对未来的奖励具有不同程度的重要性，得出折扣奖励的概念。正如人们所预期的那样，更高的γ会导致未来奖励的更高敏感度。然而，在γ= 0的极端情况下不考虑未来的奖励。

环境p的动态不在代理人的控制之下。为了内化这一点，可以想象站在一个有风的环境中的场地，并每秒都在四个方向中的一个方向迈出一步。风太大了，你很难朝着与北、东、西、南完全一致的方向移动。风场的动力学p给出了下一秒进入到新状态的概率。这当然不在你的（代理人）控制之下。

但是，如果你以某种方式了解了环境的动态，并朝着除北、东、西或南以外的方向移动呢？马尔可夫策略是代理人控制的。当代理人遵循策略π时，它会产生称为轨迹的状态、行为和奖励顺序。

策略：策略被定义为给定状态的行为的概率分布

考虑到所有这些定义，让我们看看RL问题是如何形式化的。

策略梯度

强化学习代理的目标是在遵循策略π时最大化"预期"奖励。像任何机器学习设置一样，我们定义一组参数θ（例如复数多项式的系数或者神经网络中单位的权重和偏差）。用参数表示这个策略π_θ（为简洁起见也写成π）。如果我们将给定轨迹τ的总奖励表示为r（τ），我们可以得出以下定义。

强化学习目标：根据参数化策略最大化"预期"的奖励

所有有限的MDP至少有一个最优策略（可以给出最大的奖励），在所有的最优策略中至少有一个是固定的和具有确定性的。

像任何其他机器学习问题一样，如果我们可以找到最大化J的参数θ，我们就能解决这个问题。在机器学习文献中解决这个最大化问题的标准方法是使用梯度上升（或下降）。在梯度上升中，我们使用以下规则继续浏览参数

挑战来了，我们如何找到包含期望的目标梯度？积分在计算环境中总是很糟糕。我们需要找到解决方法。第一步是从预期的扩展开始重新开始梯度（略有滥用符号）。

策略梯度定理：期望奖励的导数是策略π_θ对数的奖励和梯度乘积的期望值

现在，让我们扩展π_θ（τ）的定义。

为了理解这个计算，让我们分解它 P代表在某些状态s_0中开始的遍历分布。从那时起，我们应用概率乘积法则，因为每个新的行动概率都与前一个概率无关。在每个步骤中，我们使用策略π_θ和环境动力学采取一些行动决定要转换过渡到新状态。乘以T用步长表示轨迹的长度。等同地，取log：

这个结果本身很美，因为这告诉我们，我们并不需要知道状态P的遍历分布和环境动力学p。这是至关重要的，因为对于大多数实际目的来说，很难对这两个变量进行建模。因此，所有使用此结果的算法都被称为"无模型算法"，因为我们不会"模拟"环境。

"期望"（或者相当于一个积分项）仍然存在。一个简单而有效的方法是对大量轨迹进行采样并将其平均。这是一个近似值，但也是一个没有偏差的值，类似于近似在连续空间上的一个积分，其中有一组离散的点。这种技术在形式上被称为马尔可夫链蒙特卡罗（MCMC），广泛用于概率图形模型和贝叶斯网络来近似参数概率分布。

我们以上处理中未触及的一个术语是对轨迹r（τ）的奖励。即使参数化策略的梯度不依赖于奖励，该术语也会在MCMC采样中增加很多方差。实际上，每个R_t都有T个方差来源。然而，我们可以使用奖励G_t，因为从优化RL目标的角度来看，过去的奖励没有任何贡献。因此，如果用折现奖励G_t代替r（τ），我们得到称为REINFORCE的经典算法策略梯度算法。随着我们进一步讨论，这并不能完全解决这个问题。

增强（基线）

重申一下，REINFORCE算法计算策略梯度为

增强梯度

我们仍然没有解决采样轨迹中的方差问题。解决此问题的一种方法是重新设计上面定义的RL目标，即最大似然估计（Maximum Likelihood Estimate）。在MLE设置中，简单地说，无论初始估计多么糟糕，在数据极限内，模型都会收敛到真实参数。然而，在数据样本具有高方差的情况下，稳定模型参数可能是非常困难的。在我们的情况下，任何不稳定的轨迹都可能导致策略分配出现次优变化。奖励的规模加剧了这个问题。

因此，我们试着通过引入另一个称为基线b的变量来优化奖励的差异。为了保持梯度估计无偏差，基线独立于策略参数。

基线增强

我们必须证明梯度与附加术语（轻微滥用符号）保持不变。

在理论和实践中使用基线可以减少方差，同时保持梯度仍然无偏差。基线可以使用状态值的当前状态。

状态值：状态值被定义为在策略π_θ之后给定状态的预期奖励。

Actor—Critic方法

找到一个好的基线本身就是一个挑战，而计算它又是另一个挑战。相反，让我们使用参数ω近似得到V ^ω_（s）。所有使用可学习的V ^ω_（s）来引导梯度的算法被称为Actor-Critic算法，因为这个值函数估计像"演员"（代理人的策略）的"批评者"（好的v / s坏值）。然而这一次，我们必须计算演员和批评者的梯度。

一步引导奖励：单步引导奖励获取即时奖励，并通过使用轨迹中下一状态的引导值估计来估计奖励。

Actor—Critic策略梯度

不言而喻，我们还需要更新评论者的参数ω。这里的目标通常被认为是均方损失（或较不严重的Huber损失）并且使用随机梯度下降来更新参数。

批评者的目标

确定性策略梯度

通常，在机器人技术中，可控制策略是可用的，但这些操作不是随机的。在这样的环境下，很难像前面看到的那样建立随机策略。一种方法是将噪声注入控制器中。更重要的是，随着控制器维数的增加，先前看到的算法开始变得不适用。由于这种情况，我们不应该直接学习大量的概率分布，而是直接了解给定状态的确定性行为。因此，以最简单的形式，得到最大化目标就是我们所需要的。

确定性行为

然而，对于大多数实际目的而言，这种最大化操作在计算上是不可行的。相反，我们希望做的是构建一个函数近似器来近似这个argmax，因此称其为确定性策略梯度（DPG）。

我们用下面的等式来总结这一点。

DPG目标

确定性策略梯度

这个数值变成了我们可以用MCMC抽样再次估计的另一个期望值。

通用强化学习框架

现在我们可以得出一个通用的算法，以查看我们学到的所有东西是如何结合在一起的。所有新算法通常都是下面给出的算法的变体

代码

对于熟悉Python的读者来说，这些代码片段旨在成为上述理论思想的更具体的表示。这些已经都是从实际代码的学习循环中取出来的。

策略梯度（同步Actor—Critic）

深层确定性策略梯度

完整的实现

可以在atactivatedgeek / torchrl上查看完整管道的完整模块化实施。

分享到:

閱讀更多 AI中國 的文章

關鍵字: 数学梯度技术

商汤提出基于空间修剪的 NAS 算法

Learning To Rank 算法 RankNet

【算法】排序算法之基数排序

【算法】排序算法之桶排序

【算法】排序算法之计数排序

【算法】排序算法之堆排序

数据结构与算法：算法

【算法】位运算与经典八皇后问题

什么是算力？算法？一文看懂算法学习拓扑图

查找-hash 算法

争取能让大家都能看懂的 DFA 算法

视频分析与对象跟踪-CamShift 算法

史上最全GAN综述2020版：算法、理论及应用

人工智能的灵魂——算法

深入理解 React diff 算法

03.03 史上最全GAN综述2020版：算法、理论及应用

图像分割实战-分水岭分割方法和GrabCut 算法

03.02 分布式系统ID的生成方法之UUID、数据库、算法、Redis、Leaf方案

梯度，散度，旋度的重要基础：对向量场的诠释

Python 算法 10 -- 广度优先搜索（BFS）

一文读懂 MD5 算法

Python 算法 09 -- 散列表

Python 算法 08 -- 快速排序

浅显介绍“二进制枚举”算法

分布式系统ID的生成方法之UUID、数据库、算法、Redis、Leaf方案

01.20 Python 算法 08 -- 冒泡排序及其优化

01.17 Python 算法 06 --“又爱又恨”的递归算法

01.16 Python 算法 05 -- 3+4*5-6=？在栈中的调用

Python 算法 01--二分查找

C++基础知识-算法

palindrome(回文)算法

12.07 面试又被问到一致性 Hash 算法？这样回答秒杀面试官

算法--我的红黑树学习过程

用讲故事的办法帮你理解 SMO 算法

漫画说什么是 LRU 算法？

算法--平衡二叉树AVL原理分析以及代码实现

算法-二叉查找树BST

10.12 CPK的“另类”算法

「分布式」看完这个动画秒懂 Raft 算法

消失的梯度问题：问题，原因，意义及其解决对策

贝叶斯个性化排序(BPR)算法

01.10 路径规划之 A* 算法

算法：加权轮询算法

算法：分治算法

06.29 「算法」如何判断链表有环

06.19 算法——初级排序算法

刚刚工作的毕业生，一个月只有2000多，是不是太少了？

刚刚:刚刚工作的毕业生，一个月只有2000多，是不是太少了？根据你城市消费水平来看啊，还有你从事的工作，假如你在二三线城市做一份事业单位或者是编制类的工作，薪资水平是随着你工作年限逐年增长的，而且在年终也有很多福利补贴待遇等等，算下来收入也是可观的，再举一个例:-毕业生 2000

为什么只有edg赚钱？

电竞行业作为一个新兴产业，这几年发展势头越来越好，IG战队，FPX战队先后夺得了s8-s9世界赛的冠军，据俱乐部知情人士透露，除了国内的几家豪门俱乐部之外，其他俱乐部基本都是亏钱在做的，当然EDG也是:-edg 赚钱:为什么只有edg赚钱？

网上罗马仕充电宝20000毫安的，参数怎么很多样？哪个是真的？

20000:网上罗马仕充电宝20000毫安的，参数怎么很多样？哪个是真的？天猫旗舰店，或者淘宝旗舰店，或者京东旗舰店肯定包真，质量好，再说可以官方验证啊，不能图那十块五块的便宜，毕竟一个充电宝要用好久呢，一两年没问题的。:-罗马仕马仕毫安

我们买的新商品房还没有拿到房产证，怎么转卖最好？

没有取得房抄产证的房子可以转让。但如果确定无法取得房产证的，房产转让不受法律保袭护。一般情况下，只有取得房产证的房屋才能确定房屋产权人，才具有转让的条件。但如果房屋是合法取得的，以百后可以依法办理度房:-转卖房产证商品房拿到:我们买的新商品房还没有拿到房产证，怎么转卖最好？

为什么突厥人可以成功复国？是大唐的刀不锋利了么？

锋利突厥人你这样说只能说明你对历史非常不了解，我先用一句话概括突厥被大唐雄兵打的有多惨：三次灭国，背井离乡，远赴西亚，打不过，俺躲着你还不行吗？突厥的意思是中间怂起的头盔。其来历已经不可靠，可能有着匈奴、鲜卑或:-复国大唐:为什么突厥人可以成功复国？是大唐的刀不锋利了么？

小高层16层高楼间距60米哪一层比较好？

小高层 60:小高层16层高楼间距60米哪一层比较好？首先需要明白，选择层数居住与楼间距毫无关系，住在哪一层，肉眼看对面楼的距离，是相差不大的。设定楼间距60米，纯粹是混淆视听。其实，一幢楼的楼层总数确定的情况下，到底哪一层最佳？很简单，取总层数乘以黄金:-楼间距层高

金银花盆栽好养吗？怎么养？

金银花可以盆栽，很好养的！金银花，是忍冬科的常绿缠绕灌木，枝条柔韧修长，多攀爬或匍匐生长。金银花生性强健，在我国的很多南方省份野外很多地区都能看到它的身影，叶子常年翠绿，到夏季开花，飘香四溢。所以，有:-金银花盆栽:金银花盆栽好养吗？怎么养？

长城对于抵御古代匈奴和蒙古人起到了多大作用？

长城真的无用吗？在今天许多人认为长城无用，古代国家举国之力建造的长城不过只是文物，就连康熙都曾作诗讽刺，原文如下：万里经营到海涯，纷纷调发逐浮夸。当时用尽生民力，天下何曾属尔家。-康熙但真的如此吗？小:-匈奴抵御长城:长城对于抵御古代匈奴和蒙古人起到了多大作用？蒙古人

什么树可以嫁接腊梅？

腊梅只能嫁接在不同品种的腊梅上，其他的树种不行！腊梅的繁殖可以用播种，压条，嫁接，分株等繁殖方法。播种法因不易保持花卉的原有优良特性，且播种的优点是在于大量繁殖，而腊梅大都只需培植少量几株，故一般都不:-腊梅嫁接:什么树可以嫁接腊梅？

行情堪忧，还有多少教育机构的老师们五一假期有课上的？课时量多不多？

堪忧五一假期:行情堪忧，还有多少教育机构的老师们五一假期有课上的？课时量多不多？事实上，因为教育培训都是预收费用的模式。但凡有一点点规模的培训机构老师。在上半年，带课量是可以得到保证。:-课时量

在农村“立夏节”都有哪些民间习俗？

民间习俗农村:在农村“立夏节”都有哪些民间习俗？在农村“立夏节”都有哪些民间习俗一、农村立夏常见的习俗风俗活动：1、吃鸡蛋“立夏吃蛋”习俗由来已久，俗话说“立夏吃了蛋，夏天不疰夏”。据说立夏开始天气越来越热，村里小孩儿会有身体疲劳四肢无力的感觉，吃:-立夏节

男朋友失望分手，但对我还有感觉，答应我两个月之后可以在一起，我应该怎么做，才能改变之前他对我的看法？

失望分手看法:男朋友失望分手，但对我还有感觉，答应我两个月之后可以在一起，我应该怎么做，才能改变之前他对我的看法？你的这个问题特别的有趣，我觉得你先不要看你要怎么做才让他才能让他对你的印象有所改变，你要去看为什么是两个月之后可以在一起，这两个月他会用来做什么，为什么会有这两个月？例如他的身体碰到了什么样的问题吗？:-答应我

工程分包乙方人员伤残谁承担？

承担:工程分包乙方人员伤残谁承担？分包乙方分包致人伤残责任谁承担？严格来说，需要了解更多伤残原因才能区分的，作为非专业人士，自己发表一点浅见供题主参考：1、如果甲方是央企的话，他们合同中的责任、义务等条款内已经将自己的责任全部撇开了，更会:-乙方伤残

有哪些看起来毫不相关的两个历史人物实际上有过联系？

实际上:有哪些看起来毫不相关的两个历史人物实际上有过联系？历史人物联系这个词貌似太宽泛了，就好像有一个调皮的答案说的，胡亥和溥仪相隔2000多年，牵强的找，也有联系：都是亡国之君不是。我想题主的意思是两个看起来应该风马牛不相及的人物，在历史上居然是熟悉或是一个时代的:-毫不相关

13年雪铁龙世嘉自动挡7万多公里，没有水泡事故，多少钱能买？

法系车不保值，如果准备常开可以入手，性价比高，价格应该在二至三万之间，二手车一车一况，一况一价，居体价格看车况。:-钱能水泡:13年雪铁龙世嘉自动挡7万多公里，没有水泡事故，多少钱能买？世嘉自动挡

22+吃土少女17年就有驾驶证了，今年才开始开车，想买个二手昂克赛拉，或者有什么好建议吗？

17年驾驶证二手:22+吃土少女17年就有驾驶证了，今年才开始开车，想买个二手昂克赛拉，或者有什么好建议吗？建议买日系二手车，开顺了卖了，买新车，昂克赛拉无法再次出手时获得好价格，而且也不省油，开完日系车直接换德系:-昂克赛拉

如何骑车去台湾骑行？

骑车在台湾没有回归内地前，最好不要去台湾，一是国内政策不允许你去台湾，因为已停止了台湾个人游。二是你偷着去台湾旅游，安全没有保障，偷渡客在哪里也没有安全保障的。以后内地政策允许个人去台湾旅游了，建议那时再:-骑行台湾:如何骑车去台湾骑行？

本人预算5万左右，想买一辆二手法系车！求推荐？

预算:本人预算5万左右，想买一辆二手法系车！求推荐？ 5万预算5万元左右，想买一辆二手法系车？推荐东风标致老款308车型。1 5万元可以买标致308车况好的，没大事故呢，年限15年左右，公里数3万左右，手动档车型。2 标致308车型，底盘调教扎实，跑高速稳定:-法系二手

14年进口马自达5PK进口10年道奇酷威买哪个划算？

道奇你好，好高兴回答你的问题！14年进口马自达5和10年月道奇酷威个人感觉马自达5比较划算。新车价马5报价29.99万，酷威19.38万两款车都是原装进口，马5属于日系，酷威属于美系。两款车不属于同类车型:-酷威马自达 14年:14年进口马自达5PK进口10年道奇酷威买哪个划算？

2020年，河南教育行业国务院特殊津贴推荐，河南大学并列第三，大家怎么看？

特殊津贴高校人才就要重视，河南省高校人才更要重视，这个人才不是评出了的，而是推荐出来的，没有推荐，连参评的资格都没有。国务院特殊津贴人员推荐，不推荐是百分百没希望，推荐了希望就非常，那么是什么是国务院特殊津贴:-河南大学并列 2020年:2020年，河南教育行业国务院特殊津贴推荐，河南大学并列第三，大家怎么看？

本田CRV2019款1.5T舒适版油耗高吗？

李老猫说车为你非专业解答各种选车用车问题本田crv定位于一款紧凑级suv产品，主要对飚丰田荣放，日产奇骏，这款车整体市场表现非常突出，2019年全年累计销量为18.44万台，平均月销1.5万以上，其深:-舒适版本田油耗:本田CRV2019款1.5T舒适版油耗高吗？

国外疫情如果没有得到有效控制，世界会发生什么事情？头脑风暴？

1.世界经济遭到重创疫情影响之下，各行各业基本属于停工停产的状态，在世界经济趋于一体化的今天，停工停产势必会造成一系列的连锁反应，最后导致的结果可能会引发金融危机。2.世界格局可能发生改变美国仍是世界:-头脑风暴控制:国外疫情如果没有得到有效控制，世界会发生什么事情？头脑风暴？疫情国外

本田XRV这款车的整体表现怎么样？我想买1.5T自动豪华版，全款多少钱？

如果有15万元的预算，让你选择一台空间和动力都很不错的小型SUV，我觉得很多的读者都会想到本田XRV这款车型。因为本田XRV确实太出色了，和同级别的其他盒子SUV车型相比，这款车在空间和动力上都有优势:-xrv 自动:本田XRV这款车的整体表现怎么样？我想买1.5T自动豪华版，全款多少钱？本田豪华版

现在存款有14万，借了5万还没收回来，该做什么好？

何去何从:现在存款有14万，借了5万还没收回来，该做什么好？续租存款利息率较低，可以投资较高收益的项目，比如投资基金，一般情况下可获得6%一10%的回报。如果行情好可达到50%以上收益，去年不少基金超过这目标。目前受疫情影响，股市在低位震荡，也是基金投资的机会。一:-存款 2300

2070super和5700xt买哪个比较好？

如果是玩游戏毫无疑问选择n卡，也就是2070 suep。如果追求性价比可以选择a卡，也就是5700xt. 为什么游戏选n卡呢？首先游戏厂商针对n卡优化比较多，然后就是功耗小，然后N卡架构执行效率极高，:-:2070super和5700xt买哪个比较好？

生完二胎后，感觉自己有点抑郁，总是想发火，特别烦躁，怎么办？

二胎我是两个孩子的妈妈，曾经的我和你一样，生完宝宝我也抑郁了，我知道抑郁症真的很痛苦，产后的那段日子我整天都不开心，做什么事也没积极性，谁也不想搭理，别人给我说话我就觉得很烦。忍不住冲家人发脾气。每当一个:-生完抑郁:生完二胎后，感觉自己有点抑郁，总是想发火，特别烦躁，怎么办？发火

人这一生遇到的人和事为什么感觉都像是必然的经历？

感觉:人这一生遇到的人和事为什么感觉都像是必然的经历？正所谓有因必有果，所以你今天的因，就会产生明天的果。所以这一切你就会觉得是必然的。生活中大部分是普通人大家的生活规律，生活方式，大致相同。当你看到别人家庭的果，自己家也产生同样的果，你就会觉得这一切是:-人和经历

现在校内校外到底教的是美式英语还是英式英语还是混搭英语？

校内:现在校内校外到底教的是美式英语还是英式英语还是混搭英语？校外英式答案肯定是不唯一的！美式英语现在是主流，少量英式发音也个别存在！但对于孩子来说，肯定是混搭英语，因为孩子肯定不是一直一位老师教下去，肯定会换老师！而老师的发音肯定是既有英式的，也有美式的！就连一些英语:-美式英语

上有老下有小，我们真的跳不出这个人生循环了吗？

上有老魔咒:上有老下有小，我们真的跳不出这个人生循环了吗？的确如此，尽管现在不结婚，晚婚的人很多，但是从人类繁洐生息的历史和大多数人来看，成家立业，生儿育女，家庭仍是主流，一个人的生理，心理和生存需求決定了生存状态，生儿育女，瞻养父母即是义务责任，也是生活动:-下有小

如果外面正在下小雨，你会突然想起了谁？

想起:如果外面正在下小雨，你会突然想起了谁？我最不忘，还是秋日的雨夜，天又凉了几分，已经需要披上一件薄薄的外套了。临窗而望，眼见窗台上的几株小植物，叶片上沾了几滴小雨珠，我总喜欢，用小手电去照它们，这样的小水滴看起来晶莹晶莹的，有一种清清凉凉的:-小雨

初中同学许久未见大学期间突然联系请吃饭，态度还良好，我给推了，会不会让人很烦？

初中同学:初中同学许久未见大学期间突然联系请吃饭，态度还良好，我给推了，会不会让人很烦？吃饭许久未见，意思就是交情不怎么样，无功不受禄，人家凭什么那么热情，难道真的是多年一来忘不了咱们之间的同学情谊，倍感想念了吗，不是请帮忙、做业务、就是借钱，十有八九十借钱。我建议还是不要去的好，大家都很忙:-许久未见

现在我觉得认真对某个人说我喜欢你什么的这种话好恶心，我爱你更说不出口，好恶心，是什么心理？

出口心理:现在我觉得认真对某个人说我喜欢你什么的这种话好恶心，我爱你更说不出口，好恶心，是什么心理？爱你更多的是心里问题，可能对方还没有优秀到你满意的程度，更没有到那种离不开的地步！爱情最终还是要回归生活，而生活离不开两个人的相处，父母终究会老，孩子终究会飞，所以选择自己的伴侣尤为重要，你现在觉得恶心更:-喜欢你

剧版的《何以笙箫默》和《再见王沥川》哪一个更好看呢？

再见王沥川好看:剧版的《何以笙箫默》和《再见王沥川》哪一个更好看呢？《遇见王沥川》吧，高以翔的王沥川太招人稀罕了。长相，身材，家世，人品，才能样样好，简直完美，挑不出任何毛病，实在要说一个缺点的话，那就是太tm完美，天妒英才、才让他饱受病魔折磨。偶像剧、深情帅气的男主:-何以笙箫默

计算机专业本科能够进入字节跳动、华为这些公司做开发吗？是否还需要继续读研？

学历是求职必备条件。有了工作不能停止对知识的探索。更高的学历，可以让你有更专业的技术能力和学习能力，可以让你拓展自己的交际圈，可以让你更知名。总之，活到老，学到老，学习对人总是有好处的，技多不压身嘛！:-字节跳动:计算机专业本科能够进入字节跳动、华为这些公司做开发吗？是否还需要继续读研？读研计算机专业

生完二胎的你们，现在有什么感想？

二胎家庭日常是什么样的？是不是觉得家里多了一个小人儿，温馨多了？不存在的！生二胎根本是妈妈们的渡劫磨砺！以前周末睡到自然醒，现在全年无休，时刻警醒着，能睡一次懒觉跟过年似的，黑眼圈不说，头发呼啦啦地掉:-生完二胎感想:生完二胎的你们，现在有什么感想？

华北适合种植蚕豆吗？

华北适合种植蚕豆，种蚕豆的面积大，在西北，华北，都在种植蚕豆，蚕豆茎秆根部有根瘤菌是种植其它农作物的好茬地，特别是土壤培养和防病虫害起到作用。:-蚕豆种植适合:华北适合种植蚕豆吗？华北

华为手机更新EMUI10.1系统后效果咋样？

大家知道现在智能手机的性能不仅仅跟智能手机的硬件有关，还跟智能手机的系统软件息息相关，在国产智能手机操作系统里，小米的MIUI系统跟华为的EMUI系统都是比较优秀的操作系统。最近小米推出了小米MIUI:-咋样华为华为手机更新:华为手机更新EMUI10.1系统后效果咋样？

大热天蜜蜂老是爬到箱外结群正常吗？

蜜蜂爬到:大热天蜜蜂老是爬到箱外结群正常吗？盗蜂现在正是夏季，很多地方蜜源稀少，蜂群中可能缺蜜，也是胡蜂猖獗的时间，所以蜂群中是非常容易发生盗蜂的。在蜂群中发生盗蜂的时候，蜂群守卫蜂会增多，但是这种情况引发的蜜蜂在蜂箱外一般不会结团，只是蜜蜂来:-大热天

辣椒正是生长最佳期，偏偏有的辣椒苗蔫，不是病虫害是咋回事？

最佳期雾都山客来回答您的问题。最近山客家乡的村民正在进行辣椒移栽，确实有像题主提到的情形，辣椒苗移栽前长势葱葱，嫩绿喜人，但是移栽后几天内就出现萎蔫现象，细心观察也不是被病虫害危害。那究竟是什么原因导致辣椒:-苗蔫辣椒咋回事:辣椒正是生长最佳期，偏偏有的辣椒苗蔫，不是病虫害是咋回事？

手机相机发展的最终形态会是怎样的？

最近这几年手机在电子产品行业里可谓是发展速度非常快，苹果和华为两大公司可以说也是，明争暗斗，产品一次比一次有卖点，前一段时间华为和苹果还都推出了手机新品，两家都在大力宣传强调着拍照功能，像iPhone:-形态相机手机最终:手机相机发展的最终形态会是怎样的？

华为为什么不出一款5寸全面屏手机呢？我想应该会有很多人支持吧？

5寸手机支持:华为为什么不出一款5寸全面屏手机呢？我想应该会有很多人支持吧？很高兴回答你的问题，刷头条刷出来的问题，看到很多人回答，感觉还有一些观点没有写出，所以我来回答一下。首先，华为为什么不出小尺寸全面屏手机？其实并不只有华为一家没有出小屏手机，放眼近期各大手机厂商发布的:-华为

生吃山芋，生吃胡萝卜，还有哪些蔬菜可以生吃呢？

胡萝卜蔬菜:生吃山芋，生吃胡萝卜，还有哪些蔬菜可以生吃呢？第一种，黄瓜。这个瓜，可不是菜市场中堆放满满的青瓜。各位可要睁大眼睛看清楚了，这个黄瓜，青中带黄，品种属以前乡下农户少量种植的，形态上面来看这种瓜矮、短、圆，表面覆盖有比较淡的细毛，经水轻轻冲洗之后整:-山芋

为什么马铃薯不宜过早过迟播种？

不宜:为什么马铃薯不宜过早过迟播种？播种过早为什么马铃薯不宜过早过迟播种？马铃薯的种植主要是由于气候条件的限制，过早出苗后容易遇到低温被冻死，种植晚了容易遇到干旱和高温，影响产量。马铃薯种植时间的早晚必须根据种植地方的气候条件来确定。马铃薯生长:-马铃薯

疫情愈发严重，原油为何反而大涨？

原油愈发:疫情愈发严重，原油为何反而大涨？疫情愈发严重和原油大涨没有必然关系。但是资金总是从高处流向低处，原油价格跌的越多，投资价值越明显，相对于其他产业更有投资价值。举个例子：深圳南山房价均价大约6万左右，宝安均价5万左右，如果南山房价涨到:-疫情

生菜球很好吃，怎么种植才能高产呢？

种植:生菜球很好吃，怎么种植才能高产呢？高产对环境条件的要求、1.温度生菜球为喜冷凉、忌高温作物，种子在4度以上可发芽、以15～20度为发芽适温。幼苗能耐较低温度，日平均温度12度时生长壮健，叶球生长最适温度为13～16度。不过目前有些结球生菜:-生菜

装修高手来帮忙看下144平，套内122平，怎么三房改四房？？

看下这个户型三房改四房，改一个小房间，应该没有问题。△原户型图这个户型改四房，能改的方案比较多，但是修改以后是否好用，是一件值得考虑的事情。一、主卧室变为两个卧室可以将主卧室改为两个卧室，但是这样的改动占:-房改 122:装修高手来帮忙看下144平，套内122平，怎么三房改四房？？ 144

大家帮忙看看这个房子如果要砸墙的话，怎么改比较好？

房子:大家帮忙看看这个房子如果要砸墙的话，怎么改比较好？这个户型砸墙，当然可以砸墙，但是在砸墙之前，要搞清楚为什么要砸墙，砸墙以后有什么优劣。△原户型原户型图上的白色墙体部分不是承重墙，理论上说否可以砸掉。但是外墙和与旁边户型或者是公共区域的共用墙体和图上:-帮忙

意蜂夏季喝什么水降温？

降温意蜂夏季喝什么水降温？气温高，蜂巢温度高的情况下，蜜蜂是通过采水的办法挂在蜂箱的四壁来蒸发带走热量，降低蜂巢温度同时也能帮助蜂群维持正常的湿度。在平常的情况下，蜜蜂是在室外采自然水的。夏季消耗的水量:-意蜂夏季:意蜂夏季喝什么水降温？

黄瓜种子催芽后种植需要打底水吗？

黄瓜种子:黄瓜种子催芽后种植需要打底水吗？你好很高兴回答这个问题。答案：不用。1-2天可出芽。黄瓜种子催芽：选用饱满的种子，用30℃水浸泡4小时后催芽。也可用100倍福尔马林溶液浸泡种子10-20分钟，洗净后清水浸种3-4小时，然后于25-3:-催芽黄瓜打底

书友们展示一下自我感觉发挥较好的作品，一起学习？

自我较好这幅作品是参赛的，色彩的搭配，纸张的拼接都是自己设计完成的，一如既往的清新淡雅感觉。书体用的魏碑中楷书，增加了书写的趣味性。:-书友展示:书友们展示一下自我感觉发挥较好的作品，一起学习？