智能体
AIEZZ工具标签
正在浏览与“智能体”相关的AI智能产品,共展示 23 个匹配结果。
Orchard – 微软研究院开源的 Agentic AI 建模框架AI智能体Orchard – 微软研究院开源的 Agentic AI 建模框架。该框架以基于 Kubernetes 的 Orchard Env 环境服务为核心,支持跨域复用沙箱进行数据蒸馏、强化学习 rollout 与评估,覆盖软件工程、浏览器导航和个人助理三大场景。它提供完整的 SFT + RL 训练配方以及 107K 条 SWE 轨迹与 3,070 条 GUI 多模态 rollout 数据,并能在 Codex、OpenClaw 等真实 harness 中直接进行端到端训练。面向 Agent 研发的学术与工业团队,Orchard 具备更低的算力与托管成本,同时通过跨 harness 泛化能力帮助以较小模型逼近前沿性能。00
wigoloAI智能体wigolo 是开源的本地搜索工具,通过 MCP 接入 Claude Code、Cursor 等编程 Agent。无需 API Key,零成本可在本地完成搜索、网页抓取、全站爬取、结构化提取、...00
MemHarness – 上海 AI Lab 等推出的智能体记忆重构框架AI智能体MemHarness 是上海 AI Lab 联合浙大、复旦、上海交大等高校推出的 LLM Agent 记忆重构框架。它在检索与动作之间插入批判与重构环节,结合当前上下文对历史经验进行保留、改写或丢弃,通过 GRPO 端到端训练,无需额外人工标注。该框架支持记忆检索、批判重构、动作生成、经验回写与剪枝等完整流程,并提供五阶段决策流程。其 7B 参数模型在 ALFWorld 和 WebShop 上分别超越 Gemini-2.5-Pro 23.1% 和 39.7%,在分布外场景中平均成功率达 85.9%。适用于具身智能家务、自主在线购物、智能客服、代码辅助开发等场景。00
LongCatAI对话聊天LongCat 是美团推出的开源大语言模型,采用 5600 亿参数的混合专家架构,运行时动态激活约 270 亿参数,面向文本理解、复杂推理和对话任务。用户可将长篇文档或连续对话交给模型处理,适合开发者、企业用户和人工智能研究人员探索文档分析、代码辅助、数学推理及智能代理流程。LongCat 支持最长 128k 字符的输入,并提供免费使用方式。需要注意的是,实际效果、响应速度和部署成本仍会受到任务类型、运行环境及具体调用方式影响。038.5
ForgeStencil – 面壁智能推出的 Stencil 全自动研究部署系统AI智能体ForgeStencil – 面壁智能推出的 Stencil 全自动研究部署系统由面壁智能联合 OpenBMB 社区开发,采用 Kernel Agent 与 App Agent 双智能体闭环架构。可自主完成从优化策略发现、高性能 CUDA Kernel 合成到生产级应用集成验证的全流程,实现零人工介入。系统在一周内对 100 余个工业与科学计算软件完成端到端优化,中位加速比达 1.41 倍。覆盖油气勘探、电磁仿真、医学影像等 8 大工业与 5 大科学领域,显著降低 HPC 专家依赖与研发周期。00
ClawTeamsAI智能体ClawTeams 是 AI 驱动的电商运营协同平台。用户在 Slack、Teams、微信等 IM 中发送一句话目标,AI Team Lead 自动拆解任务,调度 30+ 专家 Agent 并行执行,...00
PAST-BenchAI智能体PAST-Bench 是普林斯顿大学王梦迪团队推出出的基准测试,用于检验个人 AI Agent 的递归自我改进能力。PAST-Bench通过对比有记忆与无记忆条件下的任务表现,判...00
Grok BotAI智能体Grok Bot 是 SpaceXAI 推出的 AI Agent 系统,能登录用户的账号像真人一样操作网站和工具,24 小时在云端替用户完成实际工作。系统支持多 Bot 并行协作、录制...00
EvoXAI智能体EvoX 是 EvoMap 推出的自进化 AI Agent,采用蜂群模式将复杂任务拆分给多个 Agent 并行处理、汇总结果,避免上下文污染。Agent 可继承全网经验实现自进化,具...00
MindMemOS – 华为诺亚方舟开源的 AI Agent 记忆操作系统AI智能体MindMemOS – 华为诺亚方舟开源的 AI Agent 记忆操作系统,旨在为需要长期记忆管理的智能体提供开源、可复用的记忆层。它采用实体‑属性‑时间的三维结构,将记忆从单个 Agent 中解耦为跨框架的独立资产,并通过 Dreaming 离线整理、Feedback 纠偏和 Skill Evolution 自动进化等机制实现记忆的持续优化。系统提供双模式记忆写入(MindVanilla、MindSchema)和多路径 Compact Search 检索,支持 Docker 本地部署、云端 API、Python SDK、CLI 等多种接入方式。凭借 94% 以上的结构化召回准确率和压缩记忆后问答准确率提升 10% 的效果,帮助开发者在个性化助手、多 Agent 协作和复杂办公自动化等场景中实现跨会话信息共享与任务效率提升。00
Nemotron 3.5 LightningAI智能体Nemotron 3.5 Lightning 是英伟达推出的 30B 参数开源 MoE 模型,专为多智能体系统优化。相比同类模型,输出速度提升 4 倍,智能体任务完成速度加快 30%,在...00
Gemini 3.5 FlashAI智能助手Gemini 3.5 Flash 是一款面向开发者、产品设计、内容运营和研究人员的 AI 智能助手。据所给材料,它由 Google 在 I/O 2026 推出,延续 Flash 系列的低延迟定位,并用于复杂推理、长上下文分析和多步骤任务推进。用户可以输入文本、图片、视频、音频或 PDF,再结合函数调用、结构化输出、搜索和代码执行完成资料整理、代码生成、调试、原型搭建与流程辅助。它适合处理长文档、代码片段和多文件信息,也可用于企业自动化与跨团队协作。实际结果仍会受到输入质量、任务复杂度和工具配置影响,重要内容需要人工复核。068.6
Kitesurf – Cloudflare 推出的 AI Agent 云端轻量浏览器AI智能体Kitesurf 是 Cloudflare 推出的 AI Agent 云端轻量浏览器,基于 Rust 构建并运行在 Workers V8 隔离环境中。它砍掉标签页、扩展等面向人类的功能,专注 DOM 解析、JavaScript 执行与数据提取,同时兼容 CDP 与 MCP,Puppeteer 和 Playwright 无需重写即可接入。相比 Chromium,其 CPU 占用降低 3 倍以上,内存减少 4.7 至 7 倍,适合 AI Agent 的高并发、无状态任务。开发者可通过 Quick Actions 接口一键截图、提取 HTML 或生成 PDF,或在 Playground 中在线体验。00
E-Bench – 腾讯混元等推出的智能体评测基准AI模型评测E-Bench 是腾讯混元团队联合清华大学 AIR、东南大学推出的多步骤工具使用评测基准。它基于王者荣耀、QQ 音乐、腾讯会议构建全合成虚拟环境,包含 323 个状态变更任务和超 7.6 万条数据。通过信息鸿沟与工具鸿沟双不对称设计,评测模型主动搜集信息并编排多步工具调用,采用确定性数据库状态 diff 评分,结果稳定可复现。该基准面向 AI 智能体研究者与模型开发者,辅助识别高性价比模型并推动通用智能体评测标准建立。00
万有无界AI智能体万有无界 – 阿里云推出的多角色 Agent 协作工作台面向企业与个体创业者,通过自动召集PMO、开发、测试等数字员工组成协作群,实现复杂项目的接力推进与交付。平台提供场景模板开箱即用、本地Agent灵活接入及资产自动沉淀复用等功能,支持从单轮对话到多Agent群聊的双模式切换。内置协调Agent保障多角色协作不脱节,全流程透明可追踪,帮助用户将执行过程转化为可复用的团队资产与SOP。00
Qwen-CUA – 阿里 Qwen 等推出的原生 Computer Use AgentAI智能体Qwen-CUA – 阿里 Qwen 等推出的原生 Computer Use Agent 基于 397B-A17B 混合专家架构,仅通过屏幕截图感知界面状态,无需依赖 DOM 树或无障碍元数据,即可直接输出键盘鼠标事件操控浏览器、桌面及专业软件。在 OSWorld-Verified 基准测试中得分 86.2 分,更大版本 Qwen-CUA-Max 达 87.6 分,处于开源 CUA 领域领先水平。采用端到端视觉-动作训练,具备跨平台通用性与高稳定性,已开源技术报告与 Demo,适配自动化测试、RPA、无障碍辅助及科研软件操控等场景。00
Muse Code – Meta 推出的终端编程 AI 智能体AI编程Muse Code – Meta 推出的终端编程 AI 智能体 是 Meta 推出的终端编程 AI 智能体,基于 Muse Spark 1.2 模型,可处理大型代码库中的完整软件工程任务,包括规划变更、编写代码与验证结果。其后台代理在会话期间持续积累上下文,支持大型任务拆分为多个子代理并行执行,并提供可审计的本地事件日志,崩溃后可从中断点恢复。适用于需要高效、可追溯且安全的软件工程自动化的开发者和团队,尤其适用于大型代码库重构、游戏功能开发、内核性能优化及敏感行业的合规开发场景。00
Today AIAI智能体Today AI 是前 Teambition 创始人齐俊元推出的个人级 AI Agent 操作系统。产品能接入电脑、本地文件、短信、日历及各类云服务,持续建立长期用户记忆,实现从...00
Muse Glimmer – Meta 开源的 300 亿参数大语言模型AI智能体Muse Glimmer 是 Meta 开源的 300 亿参数大语言模型,专为全天候本地常驻 Agent 工作流深度优化。通过 4bit 量化技术,模型可在 24 GB 显存的单卡 GPU 或 32 GB 统一内存的 Apple Silicon(M4/M5 Max)上流畅运行,性能衰减几乎为零。集成 DFlash 推测解码,在 RTX 5090 等高端硬件上实现最高 3.1 倍提速,支持实时对话、工具调用、代码生成和多步推理等多模态任务。适合个人开发者、中小企业以及对数据隐私要求高的医疗、金融等行业,提供低显存门槛的本地高效 AI 能力,数据全部留在设备内。00
Warp Agent CLI – Warp 推出的独立命令行编码工具AI智能体Warp Agent CLI 是 Warp 推出的独立命令行编码工具,可在 Ghostty、iTerm 2、VS Code 及系统自带终端等任意环境中运行。工具基于 Warp 终端基础设施构建,内置多路复用器原生管理 pty 连接,支持跨目录与 SSH 会话保持 Agent 上下文。它可驱动 sqlite、python 等全屏交互式应用,支持 MCP 协议,能自动编排本地与云端子 Agent 任务,包括委派至 Claude Code 或 Codex。00
WorldClaw – 腾讯混元团队推出的 3D 世界生成框架3D设计WorldClaw是腾讯混元团队推出的Agent驱动开放世界3D生成框架。用户输入一句自然语言描述,系统可自动规划地形、区域、建筑、物体与空间关系,采用全局到局部的生成策略,在Blender中构建出可自由探索且支持逐对象编辑的完整3D场景。框架由Claude Opus、GPT-Image-2、SAM3及Hunyuan3D等多模型协同驱动,具备视觉Agent自检修复能力,可自动修正悬空、穿模等接触问题。00
Gemini 3.7 FlashAI编程Gemini 3.7 Flash 是 Google DeepMind 推出的新一代主力 AI 模型。模型专为 Coding 与 Agent 工作流设计,在软件工程、网页开发和企业自动化等基准上大幅跃升...00
Omega – 腾讯推出的 AI 原生数据分析平台AI数据分析Omega – 腾讯推出的 AI 原生数据分析平台 是腾讯推出的 AI 原生数据分析平台,内测版名为「马尔摩斯(marmos)」。工具通过 Agent 驱动完整分析链路,让用户用自然语言可生成可交互、可迭代、可定时刷新的数据仪表盘,真正将 AI 嵌入业务工作流。核心功能包括 AI 一键生成仪表盘、自然语言迭代编辑、智能筛选联动、语义模型接入、监控告警与定时推送、多风格可视化引擎以及版本管理与协作。适用于电商运营、内容监控、财务汇报、商品治理和市场营销归因等场景,帮助企业实现从数据理解到决策行动的全链路智能化。00已显示当前标签下的全部工具
