第135章 借你导师面子用用(2 / 2)

天才之上 一桶布丁 2532 字 6个月前

创新的论文往往会有新的框架跟理论体系。所以用这玩意儿来审稿肯定是不行的。

我只是希望它能把那些很水的论文给分辨出来。从庞杂的文献库里找出真正有用的论文。」

骆余馨点了点头,随后狐疑的看向乔源,问道:「目标这么明确说明你仔细考虑过了?聊聊?」

乔源点了点头,说道:「的确想过一些。首先核心检索层,我觉得可以施加一个语义扩散噪声,首先用嵌入式模型把论文映射到向量空间。

不一样的地方在于它不是直接检索最接近的东西。而是在向量空间里进行语义的随机游走。

比如我让它找几何分析的创新论文,它会有一个思维扩散,偏微分方程、信息几何甚至拓扑量子场等等各个区域都会同步检索。」

骆余馨点了点头,立刻开口追问道:「找到了,然后呢?如何实现所谓的学术审美?」

「哎————」

乔源叹了口气,才开口说道:「的确想过一些,不过都是些不太成熟的想法。」

「比如训练模型的时候除了基础的论文指标,比如引用量、期刊声望加成等等这些,再增加一个反共性的识别器。

给一些引用量不高,但方法新颖,又或者争议很大思想超前的文献增加权重?

至于论文过滤这块,需要这个人工智慧不止判断对错,还要识别价值。这的确挺难。

这需要AI能够对比跟计算已知结论的复杂表述比例,可以检测符号滥用,以及拥有论证链冗余度分析的能力————

我知道这系统挺复杂的,所以就是想试试而已。但万一成功了,以后可就方便多了。」

骆余馨建议道:「不如直接跟微软合作?你知道微软的lean不?这证明器他们做了十多年了。」

这显然是有的放矢。

毕竟乔源是微软求而不得的男人,还有对面大人物的联系方式。肯定有得聊。

乔源摇了摇头,说道:「还是算了吧。我跟微软不熟,真要合作很麻烦。

而且有这个想法后我专门去了解过lean。其实我的思路跟微软完全不一样。

他们的lean严格意义上来说是做减法。把数学模糊的部分全部去掉,只留下逻辑骨架。

我要设计的AI则是需要它能理解论文作者的直觉跟思想脉络。当然证明过程也是需要考虑的————算了,我直接跟你说数学命题吧。

一个由数学文献构成的拓扑空间K,对于任意给定的研究前沿子流形M,总存在一个唯一的最有噪声分布η*,使得沿着由η*生成的随机路径,首次击中一个更高维度的创新子流形M「的期望时间最小化。

也就是————咦,这里竟然没有黑板。」

乔源说着说着,就想直接把他脑子里浮现出的公式给写下来。

可惜了这里不是江大的办公室。

骆余馨随手从兜里掏出了一支笔递给了乔源。

乔源接过笔,直接拿起桌上的一个本子,写下了一串公式。

「我觉得可以让η的强度σ*由知识空间K在M处的曲率张量R和研究者的认知函数f共同决定。

当然这个函数的关系我还没想好。不过可以等AI着手设计之后再考虑这些。」

说完,乔源看向骆余馨问道:「是不是有点异想天开了?」

骆余馨没直接回答这个问题,而是反问道:「你怎么想到的?」

乔源答道:「有为雅典娜的凝视项目。我觉得既然分布优化系统最终会收敛到最优解分布。

那么设计一个系统在叠代海量文献过程中,内部价值判断标准应该也能收敛到一个稳定状态。

无非就是要找到一个绝佳的平衡点。既然能搞定雅典娜的凝视,没道理做不出这样一个AI。

当然效果如何我现在也不敢保证。不过我觉得可以尝试一下。哪怕效果不及预期,应该也能有所帮助。」

「咻————」

骆余馨撮唇吹了声口哨,气流拂面而过,好在很有温度,不像外面的西北风那般割人,还挺舒服。

乔源一脸莫名其妙的看着这女人,毕竟当一个女人比男人更会耍流氓的时候,多少会让当事人感觉有些不适。

「干了,如果真有用,那我以后可就轻松了。相当于有一个团队帮忙搜索文献。」

听到这句话,乔源点了点头,刚想开口,又被这女人打断。

「不过第一步还得你落实。首先你得定义一个价值吧?把你所谓的学术美感或者说学术价值做一个数学模型出来。

如果真像你说的,要让模型能有学术审美,这个模型可就有点复杂了。相当于定义一个思想熵,啧啧————

从这个角度来说,你这个思想熵还能衡量一篇论文能在多大程度上打破当前学术领域的认知均衡。

这很不简单啊?乔源,你有这个信心没啊?」

什么叫反客为主?

这就是了!

乔源盯着骆余馨半晌,都没搞清楚这女人怎么如此丝滑的对他发号施令了!

需要免费给他打十年工的好像是这位学姐才对。

虽然这个最核心的问题肯定还是需要他来解决。但起码应该由他来分配任务。

「咳咳————骆学姐————」

「不用说了,我懂。让我想想啊,首先你需要一个助手,然后我们需要一个算法工程师团队。

你要做知识结构流形,就还得有做微分几何跟拓扑学研究的专家。回头我去博后流动站找几个人。

涉及到Fkker—Plank方程及其稳态解,需要随机分析跟懂统计物理的研究员。这些人估计得去找相关教授。

另外还需要数据工程师构建跟管理训练数据集。最后就是搞自然语言处理跟表示学习的算法工程师了。这部分可以直接找几个研究生来做,直接去找他们的导师借。

这么算下来,加上还要考虑到效率的话,我们大概需要组建一个十五到二十人左右的团队来实现你的想法。

接下来我去帮你组建团队吧。毕竟你在这里人生地不熟的,也不认得几个人。」

乔源沉默地点了点头。

虽然这女人似乎有点反客为主上瘾了,但毫无疑问的是,这个安排很合理。

「你别光点头啊。我可没那么大的面子。你得把你家老师面子借我用用。」

举报本章错误( 无需登录 )