图片处理

AI 图片 OCR、文生图与图像理解

功能概述

图片处理模块提供 AI 驱动的图片分析和生成能力,包括 OCR 文字提取、AI 图像理解、文生图和图片编辑。

核心功能

OCR 文字提取

从图片中提取文字内容:

  1. 上传图片或粘贴截图
  2. 系统自动识别图片中的文字
  3. 支持中英文混合识别
  4. 结果可复制和编辑

AI 图像理解

使用视觉模型分析图片内容:

  • 识别图片中的物体和场景
  • 描述图片内容
  • 回答关于图片的问题
  • 提取图表和数据

文生图

通过自然语言描述生成图片:

  1. 输入图片描述
  2. 选择风格和尺寸
  3. AI 生成图片
  4. 下载或进一步编辑

图片编辑

基础图片编辑功能:

  • 裁剪和缩放
  • 亮度和对比度调整
  • 滤镜效果
  • 格式转换(PNG、JPG、WebP)

常见问题

OCR 支持哪些语言?

支持中文、英文、日文等主要语言,以及它们的混合识别。

文生图的质量如何?

取决于描述的详细程度和选择的模型。详细的描述通常能生成更好的结果。

图片有大小限制吗?

单张图片建议不超过 20MB。超大图片会自动压缩后处理。