模型的单次“后训练”(Post-Training)成本不足8000美元。。这个钱主要花在哪里了呢?测评?//@梁博第二助理:小助理到家也要测试一下
@微博AI
【#微博发布首个开源大模型#】微博AI开源 VibeThinker-1.5B:小模型也可以有大智慧目前业界最强大模型参数量大都超过了1T,甚至出现了2T规模的模型,是否只有巨量参数模型才有高度的智能?是否只有少量科技巨头才有能力做大模型?VibeThinker-1.5B,正是微博AI对此问题给出的否定答案,它证明了小模型也可以有高智商。这意味着做最强大模型不再像传统观念以为的那样主要依赖推高参数量,也可以通过巧妙的算法设计来做到这一点。这款模型仅有1.5B(15亿)参数,经过微博AI研发人员提出的创新“频谱到信号原理”(SSP)方法训练后,其效果堪称颠覆:VibeThinker在AIME24、AIME25以及HMMT25三个高难度数学测试集上的表现,超越了参数量超其400倍的模型DeepSeek-R1-0120版本(模型大小671B),与规模为456B的MiniMax-M1效果接近或相当;在LiveCodeBench v6(编程算法题测试集)中的成绩,成功追平参数量数超其数十倍的模型,比如欧洲领先AI企业Minstral.AI的深度思考模型Magistral-Medium-2506版本。VibeThinker能力强大不靠堆参数,而是源于微博研发人员提出的SSP训练理念,即在学习阶段先鼓励模型发散探索所有可能的解题路径,而非一味关注正确率;随后,通过强化学习进行高效策略优化,精准锁定正确路径,将模型性能提升至极致。模型的单次“后训练”(Post-Training)成本不足8000美元,与此对应,DeepSeek-R1和MiniMax-M1的后训练成本分别是29万及53万美元,降低了几十倍。VibeThinker-1.5B的开源,旨在为全球计算资源有限的中型企业及高校研究团队,提供一条高性价比的研发新路径,使得人人都可以训练最前沿的大模型,而不是像之前一样被排斥在外,这对于业界技术进步至关重要。#AI前沿速递#Github:网页链接HuggingFace: 网页链接Arxiv: 网页链接ModelScope: 网页链接
他们想象中的自己披着一件略有点旧的毛呢制服,凝视着一幅巨大的全国地图,思考着今年收下来的棉花应该给每个省分配多少。 //@南郭刘勃://@猫头鹰快艇:秦政殊勋绝千古,关中父老望王师。//@船人老姚:也是倒霉的开始
@古典奥派主义者
正能量国师基本上都是商鞅与秦制的信徒
2016 年,FBI 要求苹果协助获取圣贝纳迪诺恐怖袭击案嫌犯 iPhone 5c 手机里的数据。苹果不同意。然后 FBI 向法院提起了诉讼,准备拿起法律武器让苹果就范。不过后来 FBI 撤诉了。因为他们从以色列的 Cellebrite 公司买到了能绕过密码解锁 iPhone 的技术。买破解技术肯定比收买苹果便宜多了,可能也比打官司便宜。
源头倒也不在联通。是“都是为你好”大项目下的一个子KPI。从正能量角度看,能刺激经济,起码能让大家多买几个卡,还有利于VOIP业务: 查看图片
@flypig
来跟大家分享一下 @中国联通 的最新事迹:今天在上海回北京的飞机上,即将起飞时,我收到了中国联通的短信,图1。落地后,我发现我的所有联通号码,主卡+副卡,全部被停机了。于是,我就和世界失联了——直到我坐进了我停在机场的车,连上了车子的 Wi-Fi。落地之后,直奔联通营业厅。服务人员态度挺好:您是不是最近打很多电话?(没有,我不咋打电话。)最近是不是很多人给您打电话?(没有,没啥电话。)是不是接了诈骗电话?(没有,陌生电话基本不咋接。)服务人员:那您签了这个承诺书,图2,给我们身份证,给我们实体SIM卡,给您解锁。我:好的。谢谢。但是不是应该告诉我停机的原因?总不能随便就把用户手机号给停了吧?服务人员:我们营业厅只有您短信上那个信息可以告知您。只能给您提交一个工单,让客服回答您了。就在沟通的过程里,又有一个女生走进了营业厅:您好,我的手机号被锁了....@中国联通 那我现在就忍不住问问你们,你们没事儿,不通知,不询问,不核实,莫名其妙把这么多用户手机号给停了,是在干什么呢?
!!,!!,!!! 查看图片
@来去之间
#黎巴嫩大爆炸后续# 早上吃饭,老妈说“黎巴嫩的新闻你看了吗”……俺心里一惊“该来的还是会来”,“看了”……老妈说那你以后还用苹果手机?我说苹果是咱们河南产的你还不放心?老妈说那也不放心你少废话,至少你把我孙子的手机先换了……我说还是先把你的换了吧,我今年换下来的手机就不给你了……我妈说我还是继续用,我年纪大了无所谓了