流式输出:逐步接收模型结果
用 stream=True 让模型回复像打字一样逐字出现,理解流式 chunk 的结构、如何累加完整文本与获取 token 用量。
从标题、正文、标签与分类中查找内容
用 stream=True 让模型回复像打字一样逐字出现,理解流式 chunk 的结构、如何累加完整文本与获取 token 用量。
理解 temperature、top_p、max_tokens 和 stop 四个核心生成参数,通过最小可运行示例观察它们如何影响模型输出。
理解 Token 与上下文窗口的概念,学会用 tiktoken 估算 token 数量,并写出一个自动裁剪历史的方案,避免对话因超限而中断。
理解大模型 API 中的三种消息角色,学会管理对话历史,写出能记住上下文的聊天程序。
用 OpenAI Python SDK 发出第一次真实的大模型 API 请求,理解请求参数、响应结构,并写出一个可复用的最小聊天程序。
从零搭建可复现的 Python AI 开发环境,掌握虚拟环境、依赖清单、环境变量与密钥保护的基本方法。
从一次最小的大模型调用出发,理解模型、提示词、上下文与 API 在 AI 应用中的职责和协作方式。
FastAPI 中使用 Jinja2Templates 渲染 HTML 页面,包括模板配置、变量传参、控制结构与模板继承实战。
详解 FastAPI 应用从开发到生产的部署方式,包括 Uvicorn 单进程、Gunicorn 进程管理、Worker 数量调优、优雅关闭、Docker 打包以及 Nginx 反向代理配置等实战要点。
详解 FastAPI 中如何使用 pydantic-settings 管理配置,包括环境变量读取、多环境切换、嵌套配置、敏感信息保护和与依赖注入结合的实战用法。