// 文本生成

使用 AI Playground 进行文本生成与聊天。

掌握持久化会话、系统提示词的使用,以及高级生成参数的调节。

文本生成界面

文本生成器是 AI Playground 的核心工具。它将来自不同服务商的数十个模型统一在同一界面之下。无论您使用 OpenAI 的 GPT-4o、Anthropic 的 Claude 3.5、Google 的 Gemini 还是本地 Ollama 模型,体验都完全一致。

持久化多轮对话

默认情况下,聊天界面支持持久化的多轮对话。您发送的每条消息都保留之前的全部上下文——就像网页版的 ChatGPT 或 Claude。

聊天控制:

  • 新建聊天:开启全新对话,清空消息历史。
  • 停止:中断正在输出的回复。当模型跑偏时非常有用。
  • 重试:以新的随机种子重新生成最后一条回复。
  • 复制:将最后一条回复复制到剪贴板。
  • 删除:从对话中移除单条消息。

聊天历史管理

所有对话都会自动保存在本地。通过左侧边栏的历史抽屉即可访问。

  • 浏览:点击历史图标查看所有过往对话,按时间排序。
  • 重命名:点击铅笔图标为任意对话自定义命名。
  • 续聊:打开任意历史对话,从上次中断的地方继续。
  • 删除:删除不再需要的旧对话。

您还可以在对话中途切换模型——随时在顶部下拉框中更换服务商或模型,聊天历史不会丢失。

系统提示词

系统提示词是一组基础指令,在模型看到您的消息之前控制其行为。点击参数控件上方的系统提示词开关即可启用该字段。

"你是一位资深 Python 工程师。只提供原始 markdown 代码片段,不要客套话。"

系统提示词非常适合:

  • 设定角色:"你是一名专业文案编辑。"
  • 输出格式:"始终以 JSON 格式回答,键为:answer、confidence、sources。"
  • 行为约束:"绝不要提到自己是 AI。回答控制在 100 字以内。"
  • 角色扮演:"你是苏格拉底。对每个问题都用另一个问题来回答。"

调节参数

配置侧边栏让您对模型生成文本的方式有精细的控制。这些参数仅应用于当前聊天会话。

Temperature(0.0 - 2.0)

  • 控制随机性。低值(0.1-0.3)产生聚焦、确定性的输出——适合代码、数学和数据提取。高值(1.0-2.0)增加创造力和多样性,适合头脑风暴和创意写作。

Top-P(0.0 - 1.0)

  • 核采样。取值 0.1 表示只考虑概率最高的前 10% token。值越低输出越聚焦。最佳实践:调整 Temperature Top-P,不要同时调整两者。

Max Tokens

  • 生成回复的最大长度。同时计入输入和输出 token。有助于控制 API 成本,并避免回复过长。

Frequency Penalty(0.0 - 2.0)

  • 对重复使用相同词语或短语进行惩罚。值越高越能减少重复、鼓励用词多样。技术写作中常见重复时,可设为 0.5-1.0。

停止序列

停止序列告诉模型何时停止生成。您可以在参数面板中指定一个或多个:

  • 单序列:输入如 \n\n 的字符串,在连续两个换行处停止。
  • 多序列:用逗号分隔多个停止词:<|end|>, <|stop|>
  • 使用场景:停止序列对 JSON、XML 或代码生成等结构化输出至关重要,可以精确控制输出边界。

流式与非流式

AI Playground 支持两种响应交付模式:

  • 流式(默认):回复随生成逐 token 显示。您能立即看到结果,并可在中途停止。最适合交互式使用。
  • 非流式:完整回复在生成结束后一次性返回。完成前看不到任何内容。适合自动化工作流,或需要完整输出的场景。

导出回复

每条回复都可通过导出菜单(回复上的下载图标)以多种格式导出:

  • 以 Markdown 复制:复制回复并完整保留 markdown 格式。
  • 以纯文本复制:去除所有格式,得到干净的文本。
  • 以 JSON 复制:导出原始响应对象,包括角色、内容、token 计数和时间元数据。

Up next

图像生成 →

了解宽高比、CFG 强度、步数、种子,生成惊艳图像。