七脉的笔记

人工智能学习
汇集人工智能领域学习技巧与知识梳理,帮助读者更系统掌握相关技术要点。
AI-study

【知识点】记录学习人工智能零散的记录

1. SFT 和 RL 机器学习训练的区别: 1. 监督微调(SFT, Supervised Fine-Tuning) 定义: 在预训练模型(如基于海量文本训练的基座模型)的基础上,使用标注数据(输入-输出对)进行有监督的微调,使模型适应特定任务。 特点: 数据形式:输入(如用户提问) + 对应的理想输出(如人工标注的回答)。 目标:通过最小化预测输出与标注输出的差异(如交叉熵损失),让模型学会生成符合要求的回答。 优点:简单直接,适合学习明确的输入-输出映射。 局限:依赖高质量标注数据,无法学习更复杂的策略或长线…

2025年5月29日 513点热度 0人点赞 阅读全文
最新文档分类
  • AI-study
  • aigc-agent
  • B端产品
  • 产品工具篇
  • 产品生命周期
  • 好好学习
  • 技术积累
  • 日常攻略
  • 行业信息
  • 随笔记录
最新 热点 随机
最新 热点 随机
用户与 Agent 对话时序图 SSML 语音合成标记语言 & LaTeX 公式朗读 调研报告 Hermes 的多 Agents 是一套边界清晰的三层架构记录 个人助理:家庭mini-AI实验室建设 Agent从原理到落地笔记:Harness Engineering 面向长期运行型应用开发的 Harness 设计(译文)
Hermes 的多 Agents 是一套边界清晰的三层架构记录SSML 语音合成标记语言 & LaTeX 公式朗读 调研报告用户与 Agent 对话时序图
ffmpeg-常用命令 Anthropic 研究报告深入解读:AI 对劳动力市场的影响 推荐一个兼具图像处理和存储和加速的wordpress插件 从零开始,炼制你的第一个LoRA 如何毁掉一个产品大佬 开源waf部署与安装
标签聚合
AI框架 产品经理 技术架构 AI技术对比 智能决策 大模型智能体 图像压缩 大模型应用 智能体分级 RAG技术 GPU部署 模型训练方法

COPYRIGHT © 2026 75live.com. ALL RIGHTS RESERVED.

Theme Kratos Made By Seaton Jiang