Embedding 和语义相似度入门:把文本变成可比较的向量
理解 Embedding 如何把文本映射为向量,并用 Python 调用 API 和计算余弦相似度,完成第一个语义相似度实验。
从标题、正文、标签与分类中查找内容
理解 Embedding 如何把文本映射为向量,并用 Python 调用 API 和计算余弦相似度,完成第一个语义相似度实验。
用版本化提示词、固定测试样例和简单断言建立回归检查,避免一次提示词修改悄悄破坏已有能力。
用 Pydantic 校验模型输出,在结构错误时进行有限次自动修复,建立可验证而不是盲目信任的 AI 调用流程。
了解长文本为什么需要分块,使用 Python 实现按段落切分,并把分块摘要组织成一次最终总结。
通过少量输入输出示例和 Python 提示词模板,理解如何约束模型行为,并构建可复用、易测试的请求。
从任务、上下文、约束和输出格式四个部分拆解提示词,使用一个最小 Python 示例写出更稳定、可验证的模型请求。
理解模型选择的核心权衡:能力、延迟与价格,学会按任务匹配模型档次,并用 usage 字段估算每次 API 调用的成本。
理解大模型 API 调用中常见的超时、限流、连接错误,学会用 SDK 内置重试与手写指数退避让程序在接口不稳定时也能可靠运行。
用 response_format 让模型直接返回 JSON,对比 json_object、json_schema 与 Pydantic parse 三种方式的用法、差异和常见坑。
用 stream=True 让模型回复像打字一样逐字出现,理解流式 chunk 的结构、如何累加完整文本与获取 token 用量。