Light-R1-14B-DS

12个月前发布 8 00

Light-R1-14B-DS 是由北京奇虎科技有限公司开发的开源数学模型。该模型基于 DeepSeek-R1-Distill-Qwen-14B 进行强化学习训练,在 AIME24 和 AIME25 数学竞赛基准测试中分别达到了 74.0 和 60.2 的高分,超越了许多 32B 参数量的模型。它在轻量级预算下成功实现了对已经长链推理微调...

收录时间:
2025-05-29
Light-R1-14B-DSLight-R1-14B-DS

Light-R1-14B-DS 是由北京奇虎科技有限公司开发的开源数学模型。该模型基于 DeepSeek-R1-Distill-Qwen-14B 进行强化学习训练,在 AIME24 和 AIME25 数学竞赛基准测试中分别达到了 74.0 和 60.2 的高分,超越了许多 32B 参数量的模型。它在轻量级预算下成功实现了对已经长链推理微调模型的强化学习尝试,为开源社区提供了一个强大的数学模型工具。该模型的开源有助于推动自然语言处理教育领域的应用,特别是数学问题解决方面,为研究人员和开发者提供了宝贵的研究基础和实践工具。

数据统计

相关导航

成语游戏大全

成语游戏大全

成语游戏大全是一个集成了多种成语游戏的在线学习平台,旨在通过趣味互动的方式让学习成语变得简单有趣。平台提供了成语闯关、成语接龙、成语消消乐等多种游戏,结合成语词典和成语故事,形成了完整的学习体系。通过游戏化学习,可以提升语言能力、文化素养、思维能力,并培养学习兴趣。产品背景信息显示,成语游戏大全适合各年龄层的用户,特别是在校学生、语言学习者和文化爱好者,有助于提升语文成绩、中文水平和对中华传统文化的理解和欣赏。
KET-RAG

KET-RAG

KET-RAG(Knowledge-Enhanced Text Retrieval Augmented Generation)是一个强大的检索增强型生成框架,结合了知识图谱技术。它通过多粒度索引框架(如知识图谱骨架和文本-关键词二分图)实现高效的知识检索和生成。该框架在降低索引成本的同时,显著提升了检索和生成质量,适用于大规模 RAG 应用场景。KET-RAG 基于 Python 开发,支持灵活的配置和扩展,适用于需要高效知识检索和生成的开发人员和研究人员。
easegen-front

easegen-front

easegen-front 是一个开源的数字人课程制作平台,旨在通过结合最新的前端技术和人工智能,为教育工作者提供一个便捷、高效的课程内容制作和发布工具。该平台前端基于 Vue3 + Element Plus 构建,后端则基于 Spring Boot,支持智能课件制作和文档解析,是 AGI 时代超级个体践行者为 AI 发展做出的贡献。产品的主要优点包括开源、易用性强、技术栈先进,且适合全栈工程师和教育工作者使用。
Quizzio

Quizzio

Quizzio是一个教育技术平台,它使用人工智能将用户的学习资料转化为个性化的测验,帮助用户发现知识盲点并测试对学习内容的理解。这个平台通过AI分析用户上传的学习材料,生成定制的测验,提供即时的反馈和改进建议,从而提高学习效率和学术表现。Quizzio的主要优点包括个性化学习体验、AI反馈、进度跟踪和移动友好设计。它适合所有希望提高学习效率和成绩的学生,尤其是那些寻求个性化学习路径和即时反馈的学习者。

暂无评论

您必须登录才能参与评论!
立即登录
none
暂无评论...