peopleevents
梁斌penny 2025-01-23 18:59+08:00Z
原微博

大量硬盘从南京发出//@司寇玹棠:不是还有@梁斌penny 为这些大模型提供训练数据吗?//@冬亚:唉,南京呢?继续躺着呢?//@UB_吴斌:我观察,大模型这波技术浪潮,中国的产业驱动中心,正在由珠三角,转向长三角。比如,目前发展最快的:DeepSeek(杭州深度求索人工智能基础技术研究有限公司,杭州),MiniMax(上海稀宇极智科技有限公司,上海),通义千问(阿里,杭州),秘塔(上海秘塔网络科技有限公司,上海)。

@张俊林say

国内大模型发展速度确实快,Deepseek和阿里在开源方面已经领先国外的Meta,是世界范围内开源最强者,而且目前国内发布的推理模型效果基本和o1打平,虽仍弱于o3,但是技术路线走通了追上甚至赶超是必然的,只是时间问题。目前国内开源的风气越来越好了,这是被Deepseek和阿里带动起来的,或者说是被逼迫的,希望国内公司能更进一步,开源方案超过OpenAI 的闭源方案,逼迫国外头部大模型公司重回开源路线,只要我们自己实力够强且开源,这就是有可能的。为啥呢?道理很简单:如果闭源公司作出的模型还不如开源模型,想靠闭源获得技术领先优势以及由此而来的API调用收入就不再成立,此时要么走出很大的差异化路线(基座模型要做到这点很难,谁最强谁就是差异化最明显的),要么放弃基座模型转而去做应用,要么转而也跟进开源,貌似可做的选择不多。目前陆续有之前定位为基座模型的公司放弃了基座模型训练,其实在现在这个时间点应该咬咬牙坚持下去,因为目前大模型基座的研发重心已经转移了,可以找到相对低成本把模型做到最强的方法。好的选择貌似是可以选择放弃Pre-train阶段,Base模型可以采用最好的开源模型,重心放在Post-Training阶段,目前看如果方法得当,完全可以低成本得做到最强。在基座模型快速发展与竞争的年代,如果立志于做基座模型,最好放弃短期内靠基座模型获取收入的想法,你只要有这个念头并试图去做些什么,大概率就会掉队。国内基座做的最好的几家,Deepseek、阿里,这两位是国际开源届的翘楚,已经通过开源模型的能力证明了自己;再加上字节豆包,字节基座模型能力说不上特别强,但胜在产品力Max及AI赛道无论投入多少都要拿下的决心。你要找共性因素的话,一方面就是持续投入的决心比较坚决,无论投入多大一定要把最领先基座模型这个赛道要占住,另一方面也都有从其它渠道获得的资金来做资源投入,不指望靠基座模型本身赚钱,专心把基座模型做好。有其他收入来源养活基座模型团队,这点是其它创业型大模型公司比不了的优势。但是比较残酷的现实就是如此,如果既想要收入又想要技术领先,目前看基本是不可能的,OpenAI先发的巨大领先优势目前几乎丧失殆尽,跟这个也有很大关系,好的思路是未来两年重点把基座模型做到第一梯队把其他人快速甩开,到最后剩下几家最终胜出再考虑怎么赚钱的事情,而且那时候应该更容易找到赚钱的方法。腾讯在AI赛道的潜力我认为是被低估的,尽管腾讯不以技术见长,看似在AI方向胜算没有太大,但腾讯的风格是后发先致,看清后投入比较坚决且有能力做巨大的投入,所以我个人其实比较看好腾讯未来在AI赛道的表现。国外的最大潜力股那肯定是马斯克的xAI了,不计成本的资源投入国内外首屈一指,做到最顶尖速度应该比较快。

上一页791/995每页 10总共 9943下一页