论文期刊的数据都可以喂给大模型么?
期刊中的表格、图表那么复杂,机器知道这些表和和图表的意思么?
期刊中的表格、图表那么复杂,机器知道这些表和和图表的意思么?
1
pulutom40 4h 23m ago 很明显,chatgpt 这些大模型,已经把各种期刊论文数据喂给大模型了。连各种实体书都扫描喂给大模型了。只要是公开的,他们能搜集到的数据,都已经喂过了。
垂直领域的大模型,我一直觉得是一个伪命题,除非你有什么比公开论文期刊更优质的数据集、比 openai 、google 、claude 更牛逼的算法,不然你训练不出比 chatgpt 更牛逼的模型。既然你训练不出来,那为啥不直接用 chagpt 呢。 你如果有比他们更牛逼的算法,那你搞鸡毛垂直领域啊 |
3
tianjiyao 4h 18m ago
我也觉得#1 说的对。。。通用大模型才是正道。。你能找到的资料,这些大厂早就翻了好几遍了
|
4
xunuohan2008 4h 5m ago
你可以搜一下“睿宾 Agent”。
|
5
zhuanggu 3h 39m ago
这就是一个伪命题:1 、你每次训练都要把新的知识加进去,成本高不说效果可能回撤 2 、通用大模型的一次大的版本迭代就可能把垂类模型的优势给替代了。 更好的方式是通用大模型+垂类知识库,在这个基础上去做分词、召回的精准化建设,比上面那种务实多了。当然如果是一个政绩工程,当我没说。
|
6
doudouisamomo 3h 39m ago
我是生物医药的,按我最近使用的 gemini,dicksuck 的情况看,无论是联网搜索能力,论文解读能力,都基本合格。
为什么说是合格?因为 gemini 它会有明显的胡编乱造,偏向你的观点,如果它说这个论文中含有 a 结论,我实际去看了整篇文章,一直溯源到头,都没找到 a 结论,然后再一点点贴回去反驳,最后它又说我说的对。 而用 workbuddy 的 dicksuck 去搜索文章,一般可以搜到 Pubmed 里的免费文章或者摘要,搜的比我们读的快,要点提炼大家都懂的,大模型比人强,所以做一个综述是没问题的,非常详细的问题,则要我们自己去看文章。 而对文章里的图,实验等,经过检验,大部分都可以完全看懂,我不懂的,它也懂,我懂的,它也懂。 所以现在直接用搜索就行了。 |
7
furlxy 3h 35m ago
你要解决什么问题?例如你要问这个病治好多少钱?他答不出来,即使有答案也不准,因为没有具体省市卫健委的价格表
|
8
paopjian 3h 8m ago
为什么要喂期刊呢, 大模型只是不需要最前沿的技术吧, 反而是把各种医学书学会了更好吧, 还有各种口述问题能理解到位, 还是说你想做的是医学科研大模型
|
9
GooogIe 3h 4m ago
@doudouisamomo #6 好奇你说的 dicksuck 是什么,我没有搜索到相关的内容
|
10
wzha2008 3h 2m ago
百川当初也是和智普五五开,现在搞医疗大模型都搞得快倒闭了吧
蚂蚁阿福也感觉只是 app/agent 做的好些 |
11
doudouisamomo 3h 0m ago
@GooogIe
deepseek |
12
SiLenceControL 2h 1m ago
@doudouisamomo #6 同意,真正发现有意思还是得要自己去读,AI 会出现很多学术不严谨甚至意思不对的东西
|
13
la2la 56 mins ago
可以研究一下怎么把除了医学之外的知识给剔除出去
|
14
zhangli2946 49 mins ago
@la2la 不认中文没有常识可不行吧。 胶囊剂,切开吃粉 肠溶变粘膜吸收。
|