再战Transformer!原作者带队的Mamba 2来了,新架构训练效率大幅提升
再战Transformer!原作者带队的Mamba 2来了,新架构训练效率大幅提升自 2017 年被提出以来,Transformer 已经成为 AI 大模型的主流架构,一直稳居语言建模方面 C 位。
搜索
自 2017 年被提出以来,Transformer 已经成为 AI 大模型的主流架构,一直稳居语言建模方面 C 位。
合理选择存储,助推生成式AI应用。麦肯锡研究报告显示,到2030年前,生成式AI有望为全球经济贡献7万亿美元的价值。
开放但禁止商用用途。
开源代码大模型的王座,再次易主! 来自素有“欧洲OpenAI”之称的Mistral,用22B参数量表现超越了70B的Code Llama。
就在刚刚,法国AI初创公司Mistral发布了自家首款代码生成模型Codestral。不仅支持32K长上下文窗口以及80多种编程语言,而且还用22B的参数量取得了与70B的Llama 3相近的性能。目前,已经开放API与IDE插件供用户使用。
一直以来,UC伯克利团队的LMSYS大模型排行榜,深受AI圈欢迎。如今,最有实力的全新大模型排行榜SEAL诞生,得到AI大佬的转发。它最大的特点是在私有数据上,由专家严格评估,并随时间不断更新数据集和模型。
国内大厂AI社交产品已大面积“熄火”。 AI 社交产品“未伴”发布公告,宣布自 5 月 27 号起逐步停止创建、搜索、聊天及朋友圈功能,并在下个月 14 日正式停止在中国大陆地区的服务,团队的重心也将集中在非大陆地区的迭代运营上,发力出海。说起来这也是我们目前观察到的首款官宣下架的大厂背景的 AI 社交产品。
马斯克最近哭穷表示,xAI需要部署10万个H100才能训出Grok 3,影响全球的大模型算力荒怎么解?昨天开源的这款MoE大模型,只用了1/19算力、1/19激活参数,性能就直接全面对标Llama 3-70B!
马斯克搞大模型又融到60亿美元(约435亿元)! 这是xAI最大的一轮融资,目前估值已来到240亿美元(约1738亿元),一举超过Anthropic,成为OpenAI之下第二位。 借着这个势头,老马也亲自下场发起招聘广告: 如果你相信我们理解宇宙的使命,需要最大限度地严格追求真理,而不考虑受欢迎程度或政治正确性,欢迎加入xAI。
你真正用AI做过什么吗?