这是一个信息爆炸的时代,也是一个信息严重污染的时代。所以,我对任何信息都不会轻信,尤其是面对重大利好,更加「存疑」。对我来说,排除信息污染的最好办法,就是交叉对比,正反面都看。
过去48小时内,我几乎都泡在X上,浏览各种关于Deep Seek的消息,在英语世界,绝大多数都是压倒性正面评价,这时候,我就特别想看看负面的评论,找了一圈,的确有。
一类,为了反而反,尤其是一些海外的反中人士,任何关于中国的新闻,他们都会给出负面的评价,这类信息简直就是垃圾。但看看也好,至少不难得知垃圾是什么样子。
另一类,是业内人士的负面评价,其中第一个,也是最的声音,居然来自一个华裔业内人士——Alexandr Wang。
首先,此人的名字有点奇怪,第一次看到,我以为是CNBC拼错了,正常的情况下,Alexander是英语中最常见的拼写形式,也是国际通用的版本。而Alexandr,则是某些东欧语言(如俄语、捷克语等)的拼写形式。一个美国华裔,居然用东欧的名字,有点蹊跷。但我定睛一看,确实是Alexandr。
其次,这位王先生,不仅名字奇怪,更有着与众不同的背景。他出生于1997年,是Scale AI的创始人兼CEO。24岁时,Alexandr Wang成为了世界上最年轻的「白手起家」的亿万富翁。根据福布斯的说法,截至2024年7月,他的身价为20亿美元。
他是中国移民的儿子,父母都在洛斯阿拉莫斯国家实验室(Los Alamos National Laboratory)担任物理学家,核武器就诞生在这个实验室。中国人能在这种单位工作,非常罕见。
Alexandr 从小就对数学和计算机编程充满热情。他在2013年获得了美国队的数学奥林匹克资格。在十几岁时,他就在美版知乎Quora担任软件程序员。随后,他在麻省理工学院学习计算机科学,但中途退学,创办了Scale AI,成了硅谷的AI神童。
Alexandr说:Deep Seek至少有5万张英伟达H100显卡,只不过因为制裁的原因,不方便说而已。事后,我看了好几遍CNBC电视台的采访,他的原话是as my understanding,也就是「按照我的理解」,而没有一点实锤的证据。
根据Deep Seek的说法,训练模型只用了2048张H800显卡,也就是H100的版,价格也只有H100(3万美刀)的三分之一。正因为用了低配的硬件,才体现了Deep Seek的创新价值。
而Alexandr Wang暗示了,Deep Seek只不过也是大力出奇迹而已,就没有什么创新。
今年,马斯克用全球最大AI超算Colossus轰动了全世界,这台超算也只配备了10万张英伟达H100显卡。
即便Alexandr Wang说的是线亿美元。折合一百多亿人民币。一个小小的幻方公司,能拿出这么多钱吗?就算有,H100美国禁运,中国大陆根本没货,也很难买到。
再退一步讲,就算Deep Seek能拿出这么多钱,买5万张英伟达H100显卡,他的成本就和Open AI不相上下了,但Deep Seek是开源免费的,而Open AI要200美元一个月。
因为Deep Seek,我也是人生第一次,学会了用API。我用中国手机开了一个账户,就送10块钱,我用Deep Seek API翻译文本,百万输入 tokens才2元,用了一个晚上,才花了0.11元。这已经不能算白菜价了,几乎就是免费!从售价倒推成本,Deep Seek也不可能拥有5万张H100显卡。
总之,无论从哪个角度看,Alexandr Wang的论点都站不住脚,但他的说法,依然有价值。
另一方面,说明Deep Seek的影响力太大,以至于Alexandr Wang有点慌了,口不择言。
我不是什么AI专家,但根据我这几天索阅读的大量信息理解,Deep Seek可能是一只巨型的黑天鹅,她正在硅谷的上空游荡。
1/ 目前,训练顶级AI大模型的成本极其高昂。OpenAI等巨头,需要拥有数万个H100显卡的大型数据中心。每块最低3万美元,总价就要十几亿美元,而且耗电量惊人,需要一整座发电厂提供电力。他们仅在训练模型上,就要花费数亿美元。
2/ Deep Seek忽然出现并说:「哈哈,如果我们花 500 万美元做这件事会怎么样?」他们不只是说说而已,而是真的做到了。Deep Seek的模型在许多任务上,甚至击败了 GPT-4 和 Claude。硅谷的人工智能世界,瞬间就懵了,AI天才Alexandr Wang语无伦次了。
3/ DeepSeek怎么做到的?他们从头开始重新思考一切。传统AI就像是把每个数字都写成 32 位小数。而DeepSeek 说:「如果我们只使用8位小数呢?」结果,它仍然足够准确!瞬间,所需内存就减少了75%。
4/ 然后是他们的「多标记」系统。普通人工智能的阅读方式就像一年级学生一样:「鹅......鹅......鹅......曲......项......向......天......歌」,逐字阅读。但DeepSeek一次读完整段线%,当你处理数十亿个单词时,这一点很重要。
5/ 但真正聪明的是:他们建立了一个「专家系统」,而没用一个试图了解一切的大型人工智能(比如让一个人同时成为医生、律师、工程师、木匠),只在需要时才激活特定专家,节省了大量参数。
6/ 而传统模型呢?所有1.8万亿参数始终处于活动状态。与此同时,DeepSeek总共6710亿个参数,一次只激活370亿。这就像拥有一支庞大的团队,但只召集每个任务真正需要的专家。
7/ 结果令人震惊,训练成本:数亿美元 → 500万美元;所需GPU:100000 → 2000 ; API 成本:便宜 95%;可以在普通游戏显卡上运行,而不是数据中心硬件。
8/ 最疯狂的部分——DeepSeek是开源的(完全免费)。任何人都能够正常的使用,代码是公开的。技术论文解释了一切,这不是魔术,只是令人难以置信的巧妙工程。现在x最流行的一个梗,Open AI → Closed AI(闭源AI),取而代之的是DeepSeek,才是真正的Open AI (开源AI)。
9/ 为什么DeepSeek很重要?因为它打破了「只有大型科技公司才能涉足人工智能」的神话。你不再需要价值数十亿美元的数据中心,几个好的游戏显卡,就能做到这一点。
10/ 对英伟达来说,这很可怕。他们的整个商业模式都建立在利润率高达90%的昂贵显卡的基础上,比如售价高达三四万美元的H100,奇货可居,有钱都买不到。如果每个人都能突然用普通的游戏显卡做AI……那么,问题所在了。
12/ 这是一个经典的颠覆故事:既有者优化现有流程,而颠覆者重新思考根本方法。
13/ DeepSeek就像一次地震,余震太大:人工智能开发变得更容易,竞争加剧,大型科技公司的「护城河」看起来更像水沟,硬件要求(和成本)大幅下降
14/ 当然,OpenAI 等巨头不会坐以待毙。但一切都要颠覆,再也不是大力出奇迹的模式了。
DeepSeek这只黑天鹅,煽动翅膀,整个硅谷都会被波及,效应可以总结为以下几点。
AI初创企业危机:Deep Seek的高性能可能会引起大量购买英伟达显卡的AI初创企业破产,释放大量二手GPU。对Scale AI的CEO兼创始人Alexandr Wang来说,这是攸关生死的存亡之争,口出恶言,也可以理解。
数据中心业务受挫:大型数据中心运营商,其租用英伟达显卡的商业模式将受到冲击。
Magnificent 7:这个词指的是目前美国股市中表现最好的七家科技巨头公司,它们在很大程度上推动了美国股市的上涨。
两次泡沫:分别是上世纪60年代的Nifty 50泡沫和90年代的互联网泡沫。这两次泡沫都导致了股市,这一次,deepseek来了...美股会崩吗?
最后,我们在看一看,Deep Seek团队刚在康奈尔发表的论文,其中每一个作者都可以让我们铭记,大部分都是30岁以下的年轻人,来自国内的顶尖大学,有的还在读博士,其中,无人具有海外的学术背景。这再次表明中国在大学教育质量上已经赶上美国,并且未来几十年中国在STEM毕业生方面将占据绝对的数量优势。
正如DeepSeek创始人梁文锋所说:我们的价值在于团队,通过这一个过程不断成长和积累专业相关知识。建立一个能够持续创新的团队,才是我们真正的护城河。
刚才下载deepseek试着用了一下,真的很厉害,连续提问,居然会把前后两个问题联系起来思考,推测出我提问的目的,这在之前那些号称Ai的软件里面是做不到的。
会有中国资本特意做空英伟达吗?这可是一夜暴富[捂脸][捂脸]最好是国资做空
中国外交官点出白宫发言人着装系中国制造:攻击中国制造是工作 享受中国制造是生活
中国外交官点出白宫发言人着装系中国制造:攻击中国制造是工作 享受中国制造是生活
崩了!美国进口订单量下跌64%!最新业内调查:特朗普的关税不会使供应链回流到美国
每经编辑:张锦河据券商中国4月15日消息,受美国总统特朗普掀起的“关税风暴”影响,美国海运贸易正面临骤然中断的风险。货运数据公司Vizion最新发布报告数据显示:美国进口订单在第一季度激增后出现了崩溃的迹象。
极目新闻记者 唐佳燕 詹钘4月15日,江西省景德镇市中级人民法院一审公开开庭审理了被告人廖某宇以危险方法危害公共安全一案。极目新闻记者从参加庭审的知情人处了解到,被告人廖某宇当庭鞠躬致歉,但被害人家属不接受其道歉。
来自奥运三金王的底气!全红婵世界杯因失误摘银被质疑,分享18张照片回怼“那咋了这就破防了”#全红婵
山西大同“订婚案”二审16日将宣判,男方母亲 :孩子说“妈我冤枉啊”,“我没有做对不起她的事”
4月15日,山西大同“订婚案”男方母亲受访,坚信儿子无罪:女方事后说不同意,说不过去
增长940%,突然爆火!苹果商店排名飙升至第二,特朗普关税下,美国人正大量下载这款中国App:堪称“省钱利器”
特朗普引发的贸易战,令许多美国人焦虑于未来“T恤价格可能会像鸡蛋一样上涨”。随着大量中国厂商的宣传视频在TikTok上骤然爆火,一家原本在普通美国人那可能并不算特别出名的中国跨境B2B电子商务平台DHgate(敦煌网),也在短短数天内悄然被推上了美区App商店最火热的位置。
一文回顾始末!山西订婚案二审将宣判,男方家属称案情复杂结果难料,律师解析要点
4月15日,男方席某某家属向潇湘晨报记者表示,该案案情复杂结果难以预料,但他们也做好了应对准备,“希望能有公正合理的结果”。
近日,广东省教育厅公示2024年度中小学正高级教师职称评审通过人员,经广东省中小学正高级教师职称评审委员会评审,全省399位教师评审通过,其中珠海23位教师榜上有名。珠海23位教师榜上有名。
位于香洲区前山街道翠峰街的珠海市社会福利中心,是孤残儿童生活与成长的家园。绿化带中绽放的鲜花,儿童游乐区色彩斑斓的玩具,处处体现对孩子们贴心的关爱。
体制内有高人,此次反制刁钻蛮横的特朗普,干的最漂亮的,一个就是加征一定的关税到125%后,我们明确,即便特朗普再搞数字游戏的笑话,就是不跟;
上一篇:k12教育指的是什么意思
s