老刘说NLP
老刘的R1类推理大模型三部曲及RAG小课堂正式发布
今日2025年02月16日北京晴。老刘的三部曲课程与RAG系列课堂完成,涵盖Deepseek-R1及GraphRAG等大模型知识,包括应用场景、技术原理和复现项目等内容。
Deepseek R1及Deep research复现回顾及近期前沿进展速递
2025年02月16日,北京晴天。社区第39讲《DeepseekR1及Deepresearch复现》顺利结束,老刘报告了4小时深度讨论内容。介绍了大模型推理和复现进展,包括DeepSeek-MoE-ResourceMap、OpenR1-Math-Raw等资源库,并展示了OpenThinker-32B在MATH500测试中的表现。研究发现,长链推理的结构比内容更重要。老刘呼吁社区成员参与讨论。
Think思考用来增强RAG的Embedding?兼看推理模型使用实践建议等前沿进展
今日为2025年2月15日星期六。文章回顾了昨日的大模型进展,包括GraphRAG、开放AI推理模型使用建议、大模型训练注意力机制等,并介绍了深度思考与RAG结合的新进展,如生成嵌入和输出thought的方法。
GraphRAG前沿之MedRAG医疗问答路线:兼看基于KG进行上下文扩展方案
2025年02月14日,北京晴。文章介绍了MedRAG工具结合知识图谱解决医疗诊断问题,并回顾了利用知识图谱进行上下文扩展的思路和实践。
GraphRAG前沿之Graph RAG-Tool Fusion:将知识图谱用于Agent工具编排实现思路
今天是2025年02月13日,星期四。文章介绍了使用基于知识图谱的方法来改善多智能体系统中的工具检索准确性。通过构建工具依赖关系的知识图谱并结合向量搜索和图遍历技术,可以更准确地找到用户所需的相关工具。
KG增强Agentic Reasoning进行深度研究的有趣思路:兼看社区R1类推理分享三部曲
今天是2025年02月12日,星期三。老刘在NLP技术社区分享了关于Deepseek R1模型的习得过程、场景机会及技术风险等内容,并介绍了R1卡顿问题、知识库搭建等实践应用细节。
R1-GRPO强化范式用在KG抽取的粗暴实现:兼看RAG、推理加速等相关进展
今日文章介绍了R1和知识图谱结合的粗暴实现以及强化学习在知识图谱信息抽取中的进展。具体包括开源复现DeepSeek R1的文本到图谱抽取训练方案,并回顾了昨日技术社区的进展,涉及RAG webui、推理框架KTransformers等。
再看增强大模型推理能力的四种范式及蒸馏微调范式具体实现
文章介绍了增强大模型推理能力的四种范式,并探讨了使用蒸馏微调方式进行数据集和工具的选择。强调了监督微调(SFT)加上强化学习(RL)的重要性,同时提到了不同蒸馏方法及其应用。