图片处理
AI 图片 OCR、文生图与图像理解
功能概述
图片处理模块提供 AI 驱动的图片分析和生成能力,包括 OCR 文字提取、AI 图像理解、文生图和图片编辑。
核心功能
OCR 文字提取
从图片中提取文字内容:
- 上传图片或粘贴截图
- 系统自动识别图片中的文字
- 支持中英文混合识别
- 结果可复制和编辑
AI 图像理解
使用视觉模型分析图片内容:
- 识别图片中的物体和场景
- 描述图片内容
- 回答关于图片的问题
- 提取图表和数据
文生图
通过自然语言描述生成图片:
- 输入图片描述
- 选择风格和尺寸
- AI 生成图片
- 下载或进一步编辑
图片编辑
基础图片编辑功能:
- 裁剪和缩放
- 亮度和对比度调整
- 滤镜效果
- 格式转换(PNG、JPG、WebP)
常见问题
OCR 支持哪些语言?
支持中文、英文、日文等主要语言,以及它们的混合识别。
文生图的质量如何?
取决于描述的详细程度和选择的模型。详细的描述通常能生成更好的结果。
图片有大小限制吗?
单张图片建议不超过 20MB。超大图片会自动压缩后处理。