-
大模型训练框架:ms-Swift
-
分布式训练知识点
-
分布式训练知识点
-
大模型领域扫地僧:DeepSeek(深度求索)介绍,各个版本模型总结
-
自然语言转结构化查询 NL2SQL 专题, 大模型对 NL2SQL 的应用方案
-
大模型LLM部署工具,如 Ollama
-
大模型工业落地的技术经验:如何快速修复基座模型的知识点?
-
大模型会往哪个方向发展?
-
端到端语音交互方案汇总
-
Transformer、Attention 有什么问题?如何改进?是唯一选择吗?
-
如何检测AIGC内容?区分机器还是人工编写?怎么攻击AIGC/LLM内容?
-
大模型时代的推荐系统方法总结
-
大模型工业落地的技术经验总结:参数高效微调 PEFT/OFT
-
大模型工业落地的技术经验:RAG 检索增强生成及其改进版本
-
大模型推理能力专题,包含openai o系列、deepseek r1等长程思考模型
-
谈谈影响LLM发展的幻觉问题及其解法
-
谈谈影响LLM发展的重要定律, 规模法则(Scaling Law)
-
RLHF 原理及各个改进版本
-
数据质量直接决定模型上限,如何高效利用数据?
-
大模型原理、架构、代码理解、改进
-
创新创业方面的书籍
-
音频生成技术,如音乐生成、视频配音
-
文生视频技术
-
分布式训练代码实践知识点
-
大模型训练原理,如何训练,有什么经验?
-
大模型训练案例及经验
-
分布式训练知识点
-
DeepSpeed 知识点、训练技巧总结
-
训练大模型前,如何快速预估显存消耗?设计最合适训练/推理方案
-
数据标注流程介绍,大模型时代如何提升数据标注效率?
-
大模型时代的开发模式,如何用LLM模式重构已有应用?
-
混合专家模型,MoE系列
-
开源大模型笔记
-
开源大模型笔记
-
开源大模型百川笔记
-
大模型工业落地的技术经验总结
-
大模型时代对话何去何从?LLM时代,如何改造智能对话?
-
智能体开发框架汇总, 如 AutoGen
-
OpenAI Function call 开发、函数调用知识总结
-
如何提升LLM推理效率?
-
模型部署、推理知识点,模型格式
-
如何提升LLM推理效率?
-
vLLM 大模型推理知识
-
大模型如何加速推理过程?方法之一:投机采样,整理系列解法
-
GPT之类大模型微调方法
-
如何将大模型LLM部署在边缘设备上? 大模型小型化
-
大模型 LLM 驱动的智能体
-
ChatGPT插件开发知识总结
-
各个大模型表现究竟怎么样?如何评估大模型表现?LLM真的是AGI吗?
-
如何评估大模型表现?如何生成高质量数据集?