-
工程笔记:贝叶斯优化
若随机变量 $X$ 服从一个均值为 $\mu$ ,方差为 $\sigma^2$ 的高斯分布,则记为:
-
工程笔记:马尔可夫决策过程
本文为 《强化学习系列》 文章 本文内容主要参考自: 1.《强化学习》 1 2. CS234: Reinforcement Learning 2…
-
「多臂赌博机」:先定义再动手
一个赌徒,要去摇老虎机,走进赌场一看,一排老虎机,外表一模一样,但是每个老虎机吐钱的概率可不一样,他不知道每个老虎机吐钱的概率分布是什么,那么每…
-
强化学习入门:从多臂赌博机走到策略
强化学习 (Reinforcement Learning,RL)是机器学习中的一个领域,是学习“做什么(即如何把当前的情景映射成动作)才能使得数…
-
把「在群晖 NAS 上编译安装 tmux」写成可执行的一页
sudo mkdir /toolkit sudo chown -R username:users /toolkit 其中 username 为使…
-
「隐马尔可夫,条件随机场和序列标注」:先定义再动手
隐马尔可夫模型(Hidden Markov Model,HMM)是一个描述包含隐含未知参数的马尔可夫过程的统计模型。马尔可夫过程(Markov …
-
图嵌入和图神经网络:结构信息怎么进模型
图(Graph / Network)数据类型可以自然地表达物体和物体之间的联系,在我们的日常生活与工作中无处不在。例如:微信和新浪微博等构成了人…
-
预训练语言模型:从词向量走到能干活的底座
本文为 Pre-trained Models for Natural Language Processing: A Survey 和相关模型的读…
-
工程笔记:toB 产品用户权限
用户权限在产品中是一个最基础的功能,它决定了用户在产品中能做些什么。虽然用户对权限的感知并不是很明显,但作为一个系统的基础功能,用户权限可以说会…
-
把「京东数科 HIPO 学习之旅」写成可执行的一页
今年有幸参加了京东数科的 HIPO 培训课程,整个学习之旅可谓收货满满。由于出差没能参加 8 月份的开营仪式,看到小伙伴们各种拓展,还能自己做饭…