跳到主要内容

开发平台

AIEZZ工具标签

正在浏览与“开发平台”相关的AI智能产品,共展示 10 个匹配结果。

Orchard – 微软研究院开源的 Agentic AI 建模框架AI智能体Orchard – 微软研究院开源的 Agentic AI 建模框架。该框架以基于 Kubernetes 的 Orchard Env 环境服务为核心,支持跨域复用沙箱进行数据蒸馏、强化学习 rollout 与评估,覆盖软件工程、浏览器导航和个人助理三大场景。它提供完整的 SFT + RL 训练配方以及 107K 条 SWE 轨迹与 3,070 条 GUI 多模态 rollout 数据,并能在 Codex、OpenClaw 等真实 harness 中直接进行端到端训练。面向 Agent 研发的学术与工业团队,Orchard 具备更低的算力与托管成本,同时通过跨 harness 泛化能力帮助以较小模型逼近前沿性能。00wigoloAI智能体wigolo 是开源的本地搜索工具,通过 MCP 接入 Claude Code、Cursor 等编程 Agent。无需 API Key,零成本可在本地完成搜索、网页抓取、全站爬取、结构化提取、...00MemHarness – 上海 AI Lab 等推出的智能体记忆重构框架AI智能体MemHarness 是上海 AI Lab 联合浙大、复旦、上海交大等高校推出的 LLM Agent 记忆重构框架。它在检索与动作之间插入批判与重构环节,结合当前上下文对历史经验进行保留、改写或丢弃,通过 GRPO 端到端训练,无需额外人工标注。该框架支持记忆检索、批判重构、动作生成、经验回写与剪枝等完整流程,并提供五阶段决策流程。其 7B 参数模型在 ALFWorld 和 WebShop 上分别超越 Gemini-2.5-Pro 23.1% 和 39.7%,在分布外场景中平均成功率达 85.9%。适用于具身智能家务、自主在线购物、智能客服、代码辅助开发等场景。00PixelRAG开发平台PixelRAG 是伯克利 SkyLab/BAIR 开源的视觉原生 RAG 框架。框架跳出网页抽成纯文本再检索的传统路线,改用浏览器把网页、PDF 渲染成截图瓦片,通过 LoRA 微调...00HOMIEAI视频生成HOMIE 是香港科技大学开源的数字人视频生成框架,基于 Wan2.1-T2V-14B 骨干网络并集成 Qwen3-VL 多模态大模型。框架能统一处理数字人+商品+Logo+文字四要素,...00MindMemOS – 华为诺亚方舟开源的 AI Agent 记忆操作系统AI智能体MindMemOS – 华为诺亚方舟开源的 AI Agent 记忆操作系统,旨在为需要长期记忆管理的智能体提供开源、可复用的记忆层。它采用实体‑属性‑时间的三维结构,将记忆从单个 Agent 中解耦为跨框架的独立资产,并通过 Dreaming 离线整理、Feedback 纠偏和 Skill Evolution 自动进化等机制实现记忆的持续优化。系统提供双模式记忆写入(MindVanilla、MindSchema)和多路径 Compact Search 检索,支持 Docker 本地部署、云端 API、Python SDK、CLI 等多种接入方式。凭借 94% 以上的结构化召回准确率和压缩记忆后问答准确率提升 10% 的效果,帮助开发者在个性化助手、多 Agent 协作和复杂办公自动化等场景中实现跨会话信息共享与任务效率提升。00AnyParser APIAI文档处理AnyParser API 是首个具备高准确率和速度的文档解析大型语言模型。它通过视觉语言模型将文档检索准确性提高了多达2倍,能够精确地从PDF、PowerPoint和图像中提取文本、表格、图表和布局信息。该API优先考虑客户隐私并实现无缝的企业集成。00Get3W – AI 模型聚合平台,统一接口自由切换模型开发平台Get3W – AI 模型聚合平台,统一接口自由切换模型 是面向开发者和企业的 AI 模型聚合平台,通过统一 API 一站接入来自 Google、OpenAI、ByteDance、Alibaba、Kling、Midjourney、Runway、MiniMax、Black Forest Labs 等 20 多家厂商的 700+ 模型,能力覆盖视频、图像、音频、3D、全景与对话生成。开发者只需一次接入,可在同一套接口规范下自由切换模型,无需重复适配各家 API。平台提供 REST API、Python/JavaScript SDK、异步任务与 Webhook 回调,采用按量计费模式,相对直连官方最高可省约 50% 成本。00Hunyuan3D-Buffalo 1.0 – 腾讯混元推出的 3D 多模态框架3D设计Hunyuan3D-Buffalo 1.0 – 腾讯混元推出的 3D 多模态框架 是腾讯混元推出的统一3D多模态框架,通过共享的 Hunyuan3D-VLM 主干将3D问答、空间定位、文生3D、指令编辑和部件生成集成到单一流程中。框架支持自然语言理解3D模型结构、定位部件、按指令修改局部几何,提取语义级部件,旨在打通3D理解、生成与编辑的闭环,为游戏、动画和工业设计提供可组合的3D资产生产方案。核心功能包括3D理解、文生3D、指令编辑和部件生成,四类任务共享同一种3D语义表示与处理管线。适用于游戏开发者、动画制作人员、工业设计师及3D内容创作者,通过自然语言交互降低专业门槛,提升资产复用与迭代效率。00WorldClaw – 腾讯混元团队推出的 3D 世界生成框架3D设计WorldClaw是腾讯混元团队推出的Agent驱动开放世界3D生成框架。用户输入一句自然语言描述,系统可自动规划地形、区域、建筑、物体与空间关系,采用全局到局部的生成策略,在Blender中构建出可自由探索且支持逐对象编辑的完整3D场景。框架由Claude Opus、GPT-Image-2、SAM3及Hunyuan3D等多模型协同驱动,具备视觉Agent自检修复能力,可自动修正悬空、穿模等接触问题。00

已显示当前标签下的全部工具