API 目录
探索所有可用的 SEE2AI 标准动作 API,找到适合您 Agent 的能力。
SEE2AI 音频转码
SEE2AI audio transcode. Submit an audio URL with optional encoding settings, then poll for a stable hosted result URL.
SEE2AI 图像生成 · 稳定交付
SEE2AI guaranteed image generation. Valid accepted jobs stay recoverable across provider interruptions and return SEE2AI-hosted images when ready.
SEE2AI 图像规整
SEE2AI image normalization service that generates an independent compressed image URL without mutating the original upload. Suitable for face analysis, visual understanding, video reference inputs, and image generation reference inputs.
SEE2AI 大模型 · Claude
SEE2AI 高推理多模态大模型对话服务,支持文本、图片、PDF、TXT 输入及流式回复。适合复杂分析、长文档理解和需要高质量推理的 Agent 场景。
SEE2AI 大模型 · Gemini Flash
SEE2AI 快速多模态大模型对话服务,支持文本、图片、PDF/TXT 文档、联网检索及流式回复。适合低延迟问答、轻量分析和需要快速响应的 Agent 场景。
SEE2AI 音视频拼接
SEE2AI audio/video media concat. Submit ordered audio or video media URLs, then poll for a stable hosted result URL.
SEE2AI 媒体链接检测
SEE2AI 媒体链接探活:HEAD(必要时降级为短 Range GET)检查公网视频/图片/音频 URL 是否真的可访问、可分段播放。当用户对已生成的 mp4/png/mp3 等资源报告「打不开」类问题,agent **必须**先调用本 skill 再判断是否需要重新生成;若返回 ok=true,应直接告知用户换浏览器 / 复制链接 / 长按下载,禁止重新调用付费的 video / image / audio 生成 skill。
SEE2AI 视频提取音频
SEE2AI video audio extraction. Submit a video URL, then poll for a stable hosted audio file.
SEE2AI 视频抽帧
SEE2AI video frame extraction. Submit a video URL, then poll for stable hosted frame image URLs. Defaults to extracting the first frame.
SEE2AI 视频理解
SEE2AI 视频语义理解服务:一次调用同时理解视频画面与视频自带音频(语音/旁白/音乐),返回结构化的摘要、问答、秒级时间线、画面观察与音频转述。区别于视频处理类动作(抽帧/提音频/拼接),本动作输出语义结论而非媒体文件。