Skill Package
可复用、可版本化的能力定义。
Java AI,从模型调用到生产运行
从统一的模型调用开始,按需组合 Agent、RAG、多模态、OCR、Skills 与可观测能力。保持业务架构清晰,也通过异步任务为长任务恢复和生产运行留出空间。
ChatModel model = OpenAIChatConfig.builder()
.apiKey(System.getenv("AI_API_KEY"))
.model("your-model")
.buildModel();
String answer = model.chat(
"用一句话介绍 Agents-Flex"
);一个面向 Java 开发者的 AI 应用与智能体开发框架。
Agents-Flex 将模型、Agent、知识、多模态、执行环境与运行治理组织为可独立引入的模块。可以只使用 ChatModel,也可以随业务逐步扩展。
ChatModel、Prompt、Memory、流式输出、Tool Calling 与 MCP。
AGENT任务规划、子 Agent、人工审批、预算、重试、挂起与恢复。
KNOWLEDGE文档抽取、切分、Embedding、Rerank 与多种 Vector Store。
MEDIA图片、TTS、STT、视频生成与 OCR 文档解析,共享一致的 Java 接入体验。
EXECUTION封装专业方法,在本机或隔离环境执行脚本并交付产物。
OPERATIONS关联 Model、Agent、Tool 与 Runtime,追踪延迟、Token 和状态。
SKILLS & SANDBOX
Skill 封装说明、脚本与资源,SkillRuntime 提供统一执行边界,再按任务路由到本机或 Sandbox。能力定义保持不变,运行环境可以独立选择。
可复用、可版本化的能力定义。
为不同运行环境提供一致的命令与文件接口。
每种内容保留适合自身的调用语义,同时通过统一的 Config、Request、Response 和模型接口降低服务商切换成本。
同步或流式调用大模型,组合 Prompt、Memory、Tool Calling 与结构化输出。
ChatModel · chat() · chatStream()I覆盖文生图、参考图、多图融合、局部编辑和多图输出。
ImageModel · GenerateImageRequestA提供 TTS、STT 和流式语音合成,适配实时 AI 语音交互。
TextToSpeech · SpeechToTextV统一提交、查询和等待异步任务,支持文生视频、图生视频与编辑。
VideoModel · TaskStatus · VideoO统一解析图片与 PDF,支持百度智能云、Gitee AI 和 MinerU,并输出文本、Markdown 或结果资源。
OcrModel · OcrRequest · OcrResponseAgentTurn 管理智能体执行状态,Async Task 持久化跟踪 OCR、视频等供应商长任务。人工审批、外部等待、进程重启和后台接管都有明确的恢复路径。
从模型接入、Agent 编排到知识检索与生产运行,选择当前任务继续阅读。