• 百度NLP二面


    实验室项目:1.实验室方向

                     2.用两分钟介绍自己的项目,创新点在哪里

    个人项目:     1.自己实现的贝叶斯分类器,目的,怎么做的

                     2.怎么计算各个分类的先验。(因为我使用的训练预料是每个分类10篇,没有分类的先验)

                     3 每个主题有10篇文档,假设有1W篇文档,如何分到不同的主题中(我答的是计算与每个文档中其它文章的相似度,每个doc用一个term数组来表示,数组中每位表示的是这个文档中该单词 出现的个数(过滤掉停用词), 面试官提示会有漏掉的停用词,我说用出现的次数除于TF, 面试官说这就是TF-IDF)

    算法:        1.STL中set怎么实现的,假设有“I like love”三个词,如何存。每个节点是直接指向这个单词的指针吗)

                    2.假设有100W个单词,如何存储(我答的是trie树,面试官问每个节点会有很多子节点,每个子节点是一个指针,占用8个字节,如何节省空间,我说不知道,面试官提示双数组trie树)

                    3.假设一个文档,连续的K个词,认为是一个时间窗口,一个时间窗口的词有关系,如何得到所有的时间窗口。(当时记得有个算法,但是忘了,应该是k-shingle算法)

                    4. 很多单词,如何计算单词之间的相似度(或者对单词进行分类)

                  

    C++ :      1.程序有错误如何调试(回答打log,如何段错误,gdb调试core文件)

                   2.如何用gdb调试core文件,

                   3.如何想让变量a=100的时候中断,如何写gdb代码

                   4. Makefile文件,提示未定义的引用,是什么原因(我答的是使用C库忘记加extern,其实应该是没有在makefile指定编译顺序) 

                   5. g++中-L,-I,-l的作用,有什么区别。-l指定链接库的时候,如何a库依赖b库,是否a库必须放在b库前面

  • 相关阅读:
    Unity 网络通信以及buffer优化
    Unity 滑动列表ScrollRect制作
    Unity中一些辅助工具类
    一个欠揍的广告语
    翻译:使用 Asp.net mvc 15 分钟创建 Movie 数据库应用程序
    [转]如何查找.NET程序内存不断上涨的原因(CLRProfiler)
    [转载]SQL语句的解析过程
    [转]C#汉字转换拼音技术详解(高性能)
    adb devices 找不到设备的解决方法
    JS中对象object的复制
  • 原文地址:https://www.cnblogs.com/hellochennan/p/6654244.html
Copyright © 2020-2023  润新知