最近最火的是中国出现的这款最强AI引擎。这里面对我感触最多的是几位年轻人才,因为十年前我也都经历过这个过程,尤其是前期过程。
我们当时2014年底投身AI引擎,这个赛道当时几乎没有什么竞争对手,所以在鸟巢开第一款产品发布会的时候,还很宏大,拿到了上亿融资。当时合伙人去美国学习考察了量化基金、还有kenso 等初创AI。最后也基本是想把量化的技术用在一级市场服务。如果用在股票或者直接用在全网搜索,就是现在的这个深度求索了。
当时有一段时间我也参与数据科学家、尤其是NLP工程师和相关模型设计开发的实习生。当时就拿出七八十万年薪、还有经验弱一点的给到三五十万年薪,月薪三四万一年十六薪。
巧合的是当时我们原本想用投入全样本数据纯机器学习这个思路,后来我的团队招聘进来一位女士,思路清晰,创新力强,和工程师一起碰出了规则下的机器模型训练体系。然后就让产品进度更快更有效地推进发展。
可惜的是当时下手太早,数据很贵,开发成本很高,融资耗尽,多个产品线头也都断了,只剩下个产业知识图谱。
呜呼哀哉。
>>浙江大学机器视觉专业
>> 2015 年,30 岁时,推出 High-Flyer 量化对冲基金
>>赚大钱(now资产管理规模达 80 亿美元)
>>希望开发“人类”级别的人工智能作为副业,并向合作伙伴推介,但他们最初持怀疑态度
>> 2021 年购买 10,000 块 H800 芯片,并招募其顶级对冲基金员工(他们都有丰富的经验,可以为基金充分利用 Nvidia GPU)
>> 2023 年推出 DeepSeek,并聘请了数十名来自中国顶尖大学(北京大学、清华大学和北航)的博士
>>为科技人才提供最高薪资,中国只有字节跳动能与之匹敌……希望 DeepSeek 成为领先的“本土”公司
>>美国出口限制迫使 DeepSeek 团队发挥创造力,他们找到了新的训练方法,使 LLM 模型 (V3、r1) 能够与 OpenAI、Anthropic、Gemini、Grok、LLama 等相媲美,而成本仅为其二十分之一
>>培训成本并不完全相同,但方法新颖,效率明显提高(还有关于复制其他模型、他们可能无法谈论的更大的 H-100 集群和/或中共支持的问题)
>>开放来源并发布方法(r1 推理论文有 200 多位作者)
>> DeepSeek 刚刚登上 App Store 榜首
此前,“雷军千万年薪挖掘天才AI少女”的话题爆火。而这位让雷军以千万年薪招揽的罗福莉,则是DeepSeek开源大模型DeepSeek-V2的关键开发者之一。
罗福莉本科就读于北京师范大学计算机专业,硕士毕业于北京大学计算语言学专业。
硕士毕业后,罗福莉先是进入阿里达摩院做人工智能研究,从事预训练语言模型相关的工作,负责阿里达摩院AliceMind开源项目,主导开发了多语言预训练模型VECO。2022年,罗福莉加入幻方量化从事深度学习相关策略建模和算法研究,后又跳槽到DeepSeek担任深度学习研究员,参与研发MoE大模型DeepSeek-V2。
就在DeepSeek-V3发布前几天,小米创始人雷军已开出千万元年薪招聘罗福莉,领导小米AI大模型团队。
招聘网站显示,深度求索公司的北京子公司正在招人,现共放出了52个岗位,包括深度学习研究员、核心系统研发工程师以及资深ui设计师等,均为14薪。其中,薪资最高的为核心系统研发工程师(校招),薪资范围为6万元-9万元;除此之外,大部分岗位的起薪在2万元及以上。值得一提的是,该公司正在招聘实习生,AGI大模型实习生的工资为500元/天-1000元/天,数据百晓生实习生为500元/天-510元/天。
近一周,来自中国的深度求索(DeepSeek)全球爆红,尤其让美国硅谷极为震撼和恐慌。其最新发布的R1大模型不仅在性能上比肩甚至超越了OpenAI的o1,并完全开源,且以对手3%的超低成本实现了这一突破。
AI科技初创公司Scale AI创始人亚历山大·王(Alexandr Wang)接受电视媒体公开采访时表示,中国人工智能公司DeepSeek的AI大模型性能大致与美国最好的模型相当。过去十年来,美国可能一直在人工智能竞赛中领先于中国,但DeepSeek的AI大模型发布可能会“改变一切”。
Meta创始人兼CEO扎克伯格表示,DeepSeek非常先进,并认为中美之间的AI差距非常小。扎克伯格还表示,中国正在全力冲刺,如果将来有一个开源模型能被全世界广泛使用,我们希望它是一个美国模型。