开源归档 - 第51页共201页

K8S集群化部署RAGFlow文档

2025年5月30日8时作者 NLP工程化

RAGFlow支持通过Kubernetes (K8s)集群化部署，包括主应用、文档引擎（可选）、MinIO、MySQL和Redis等组件，从v0.15.0版本开始提供。

2025年5月30日8时作者 NLP工程化

DeepSeek发布R1-0528，显著提升代码生成能力，推理速度和质量提高，性能接近OpenAI的o3等前沿模型，在数学、编程和复杂任务上表现出色。

2025年5月30日8时作者 NLP工程化

一种从数据为中心和训练阶段视角构建的端到端智能信息检索代理方法及其在WebWalkerQA上的实验结果

2025年5月30日8时作者开源星探

腾讯混元与腾讯音乐联合开源的数字人音频驱动模型HunyuanVideo-Avatar，支持单或多角色对话和多种图像风格生成。通过一张人物图片和一段音频（最长14秒），生成高保真语音驱动动画，并引入了三项关键创新。

2025年5月29日23时作者开源AI项目落地

PaddleOCR 3.0发布全面适配飞桨框架，提升文字识别精度并新增国产硬件支持。PP-StructureV3在文档解析方面表现突出，精度和专精能力领先众多方案。PaddleOCR系列解决方案为AI大模型文档处理提供了强有力的支持。

2025年5月29日14时作者小兵的AI视界

依赖于复杂的拍摄条件或后期处理，难以实现高效且自然的光照调整
。为了解决这一问题，上海
AI Lab

2025年5月29日11时作者每日AI新工具

HunyuanVideo-Avatar生成多角色对话视频；Paper2Poster自动生成科研海报并评估其质量；Chatterbox TTS提供情感控制的TTS模型；日本语文章解析器支持文本分析、OCR和语音朗读功能；syftr优化代理工作流程以达到准确性和成本之间的平衡。

2025年5月29日8时作者 NLP工程化

CoGenAV 框架结合 ResNet 3D CNN 和 Transformer 编码器提取音视频特征，并通过对比生成同步训练提升模型理解能力，实现‘听清+看懂’多模态理解。

2025年5月29日8时作者 NLP工程化

Telegram Search：支持向量搜索和语义匹配的聊天记录搜索客户端，提供备份功能和智能检索技术。

2025年5月29日8时作者 NLP工程化

Awesome-Diffusion-LLM为扩散大语言模型研究者提供最新论文、教程和代码资源，持续更新中。