ai训练-的相关资讯
[台积电开始利用InFO_SoW技术生产特斯拉Dojo AI训练模块]
[5月21日讯,台积电已开始利用其InFO_SoW(晶圆上集成扇出硅)技术生产特斯拉下一代Dojo AI训练模块,目标是到2027年通过更复杂的晶圆级系统,将计算能力提高40倍。(台湾电子时报)]
[马斯克宣布开始在“全球最大AI训练集群”上训练]
[7月23日讯,当地时间7月22日,马斯克在社交平台X上发文宣布xAI团队、X团队、英伟达及支持公司于当地时间凌晨4点20分开始在“世界上最强大的AI训练集群”——孟菲斯超级集群上进行训练。该集群在]
[上海AI实验室发布大模型训练工具箱XTuner,降低大模型训练门槛]
[9月20日讯,上海人工智能实验室(上海AI实验室)发布了一款面向大模型训练的开源工具箱XTuner,再次降低了大模型训练门槛。据悉,XTuner聚焦于微调环节,为各类开源大模型提供了轻量级微调框架,]
[小红书开源首个大模型,11万亿非合成训练数据]
[大幅度降低训练和推理成本。dots.llm1最大特色是使用了11.2万亿token的非合成高质量训练数据,这在现阶段的开源大模型中非常罕见。所以,在中文测试中dots.llm1的性能非常强,以91.3的平均分]
[上海:将工业品跨境电商纳入上海市“5+6”垂直领域人工智能重大示范场景和模型训练]
[场景和模型训练场。提高非标工业品研发应用能力,提升产品设计、智能排产等环节效率。发挥市级语料平台作用,构建中英文工业品通识语料库。推动企业运用大模型底座,研发设计工业品行业模型,建设智能选品、智能设计、]
[字节开源MoE关键优化技术,训练成本再砍40%,内部万卡集群已部署]
[3月10日晚间讯,字节豆包大模型团队官宣开源一项针对 MoE 架构的关键优化技术,可将大模型训练效率提升1.7倍,成本节省40%。据悉,该技术已实际应用于字节的万卡集群训练,累计帮助节省了数百万 ]
[建行已引入DeepSeek模型并进行定制化训练,推进生成式AI体系化应用]
[银行引入DeepSeek大模型的消息“不绝于耳”。据近日消息,又一家国有银行已引入DeepSeek。券商中国报道,建行总行已引入DeepSeek大模型并进行定制化训练,积极推进生成式人工智能在全集团]
[李飞飞团队用不到50美元训练出媲美DeepSeek R1的AI推理模型]
[李飞飞等斯坦福大学和华盛顿大学研究人员近日以不到50美元的云计算费用训练了一个名叫s1的人工智能推理模型。该模型在数学和编码能力测试中的表现与OpenAI的o1和DeepSeek的R1等尖端推理模型]