IT之家今日(3月29日)消息,马斯克旗下人工智能公司xAI今天在官方博客中宣布,正式推出Grok-1.5大语言模型。
Grok-1.5具有改进的推理能力和128k的上下文长度,其中最显著的改进之一是其在编码和数学相关任务中的表现。Grok-1.5将在未来几天内在𝕏平台上向早期测试人员和现有的Grok用户推出。
在官方测试中,Grok-1.5在MATH基准上取得了50.6%的成绩,在GSM8K基准上取得了90%的成绩,这两个数学基准涵盖了广泛的小学到高中竞赛问题。此外,它在评估代码生成和解决问题能力的HumanEval基准测试中得分为74.1%。
附测试对比表如下:
长上下文理解方面,Grok-1.5能够在其上下文窗口内处理多达128ktokens的长上下文。这使得Grok的内存容量增加到之前上下文长度的16倍,从而能够理解更长文档中的信息。
据介绍,Grok-1.5构建在基于JAX、Rust和Kubernetes的自定义分布式训练框架之上。自定义训练协调器可确保自动检测到有问题的节点并将其从训练作业中剔除。xAI还优化了检查点、数据加载和训练作业重新启动,以最大限度地减少发生故障时的停机时间。
顶: 54578踩: 1764
马斯克xAI推出Grok
人参与 | 时间:2024-12-31 01:31:45
相关文章
- 《饥荒:联机版》“拾荒斗士”提前更新 3月28日正式推出
- 《肯泽拉传说》导演想要一部《凯恩的遗产》电视剧
- 随身摄像头视角恐怖模拟游戏《Zoochosis》玩法预告公布
- 《铁拳8》更新补丁今日上线:招式属性调整、新头像皮肤等
- 解放双手,轻松护肝!《暗黑破坏神:不朽》春季版本挂机功能上线开创自动战斗新时代
- 传闻:迪士尼或将用AI控制电影成本
- 《公民沉睡者》将于2月发布免费更新 增加简体中文
- 续航输出双双加强 《圣斗士星矢:重生》金牛座·哈斯加特起源觉醒究极之力搭配思路送上
- 2024年了,我不信还有二次元游戏能把“肉鸽”做出花儿来的——《苍翼:混沌效应》正式版发售
- 体验虚幻5制作的物理演示!《虚幻物理》免费登陆Steam
评论专区