跳到主要内容
全站搜索

查找工具、资讯与教程

一个入口,探索站内全部 AI 内容。

AI当前分类 847 条结果

AI工具

847
AI智能体Nemotron 3.5 LightningNemotron 3.5 Lightning 是英伟达推出的 30B 参数开源 MoE 模型,专为多智能体系统优化。相比同类模型,输出速度提升 4 倍,智能体任务完成速度加快 30%,在...AI编程SALMONN-2 – 清华等开源的通用音频大语言模型SALMONN-2 – 清华等开源的通用音频大语言模型 是基于字节跳动 SPEAR 统一自监督音频编码器与多层特征融合适配器构建,以 Qwen3 为文本基座的通用音频大语言模型。它支持语音识别、音频描述、音乐理解、情绪识别、说话人验证等跨域任务,并首次在通用 ALLM 中系统实现声音事件检测、音频伪造检测、语音质量评估与多模态上下文语音识别等进阶能力。模型采用单一 SPEAR 编码器替代传统双编码器方案,通过 MLF 适配器融合多层声学特征,实现更均衡的跨域表现。凭借仅约 1.8 万小时监督数据的高效训练,SALMONN-2 在 MMAU-Pro、MMAR、MMSU 三大综合基准上达到同规模开源模型最佳表现,适用于智能会议助手、音频内容审核、语音质量监控等场景。AI智能体Qwen-CUA – 阿里 Qwen 等推出的原生 Computer Use AgentQwen-CUA – 阿里 Qwen 等推出的原生 Computer Use Agent 基于 397B-A17B 混合专家架构,仅通过屏幕截图感知界面状态,无需依赖 DOM 树或无障碍元数据,即可直接输出键盘鼠标事件操控浏览器、桌面及专业软件。在 OSWorld-Verified 基准测试中得分 86.2 分,更大版本 Qwen-CUA-Max 达 87.6 分,处于开源 CUA 领域领先水平。采用端到端视觉-动作训练,具备跨平台通用性与高稳定性,已开源技术报告与 Demo,适配自动化测试、RPA、无障碍辅助及科研软件操控等场景。AI智能体万有无界万有无界 – 阿里云推出的多角色 Agent 协作工作台面向企业与个体创业者,通过自动召集PMO、开发、测试等数字员工组成协作群,实现复杂项目的接力推进与交付。平台提供场景模板开箱即用、本地Agent灵活接入及资产自动沉淀复用等功能,支持从单轮对话到多Agent群聊的双模式切换。内置协调Agent保障多角色协作不脱节,全流程透明可追踪,帮助用户将执行过程转化为可复用的团队资产与SOP。AI大模型SenseNova U1.5-Lite-Preview – 商汤开源的轻量多模态模型SenseNova U1.5-Lite-Preview – 商汤开源的轻量多模态模型基于NEO-Unify架构,以8B-MoT参数实现视觉理解、推理、生成与编辑的原生统一。模型支持4K超高清图像原生生成,具备精细纹理、真实质感及中英文复杂版式文字渲染能力。内置Prompt Enhance Skill降低创作门槛,可精准执行超长自然语言与结构化视觉指令并支持可持续迭代编辑。面向设计师、开发者及内容创作者,提供低部署成本、高指令遵循度的商业级视觉创作工具。AI智能体ForgeStencil – 面壁智能推出的 Stencil 全自动研究部署系统ForgeStencil – 面壁智能推出的 Stencil 全自动研究部署系统由面壁智能联合 OpenBMB 社区开发,采用 Kernel Agent 与 App Agent 双智能体闭环架构。可自主完成从优化策略发现、高性能 CUDA Kernel 合成到生产级应用集成验证的全流程,实现零人工介入。系统在一周内对 100 余个工业与科学计算软件完成端到端优化,中位加速比达 1.41 倍。覆盖油气勘探、电磁仿真、医学影像等 8 大工业与 5 大科学领域,显著降低 HPC 专家依赖与研发周期。LSAT备考评分 8AdeptLRAdeptLR由Adept Testing LLC推出,是一款面向LSAT考生的在线备考工具,重点帮助用户通过刷题发现并练习逻辑推理和阅读理解中的薄弱部分。平台提供自适应练习、表现分析、LawHub数据导入、笔记与题目解析等入口,适合已有课程或教材、希望进行针对性训练的考生。菜单设计评分 8.2MenuFormaMenuForma是一款面向餐饮业务的数字菜单与在线点餐平台,可将PDF、照片或网站菜单转换为二维码菜单和在线订购页面,并支持多语言展示、自取、外卖、堂食订单及在线支付。平台还提供过敏原标签、Google评论、菜单分析和多地点管理等功能。社媒运营评分 8PicmimPicmim 是一款面向小型企业和专业服务商的社交媒体内容管理工具,由 Picmim 团队推出。用户输入企业网站后,产品会结合业务信息生成帖子、图片和发布安排,用户可审核、跳过、编辑并排期发布,减少持续运营社交账号时的内容准备工作。3D设计评分 8.6Mugen3DMugen3D 是 SumeruAI 推出的图生3D工具,围绕从二维照片生成三维资产原型的流程展开。用户可通过单张普通照片生成带有纹理细节和空间感的可互动三维内容,适用于角色、物体及场景的早期制作与验证。产品资料显示,其采用自研图生3D算法和3DGS技术,并支持消费级显卡参与推理生产流程,面向3D内容创作者、游戏开发、影视制作、电商展示和教育内容团队。它适合缩短建模原型阶段,但生成结果仍应结合具体项目进行结构、纹理和交互效果检查。AI视频工具评分 8.3RiveRive 是由 Rive, Inc. 推出的交互式设计与动画引擎,将设计、动画和代码整合在同一编辑器中,帮助团队制作可直接用于网站、应用、游戏、设备和车辆的交互体验。产品提供编辑器、开放源代码运行时及多种平台集成。AI配色评分 7.8Color Picker from ImageColor Picker from Image 是一款免费的网页图片取色工具,无需注册即可使用。用户可以上传图片、粘贴图片或输入图片 URL,获取图片中的颜色信息,并查看 HEX、RGB、HSL、HSV 等格式的颜色值。AI设计工具评分 8.4Zoo Design StudioZoo Design Studio 是 Zoo Corporation 面向硬件设计的 CAD 软件,将传统 CAD 工具、代码编辑和 Zookeeper 对话式 CAD 代理结合在同一环境中。用户可以通过点选、代码或自然语言构建设计,并生成可编辑的 B-rep 几何与参数化模型。AI营销工具评分 7.6AhrefsAhrefs 是一款面向搜索引擎优化(SEO)与数字营销的数据分析工具,围绕网站、关键词、外链和搜索排名提供分析能力。用户可输入网站域名或关键词,查看自然搜索表现、外链情况、关键词难度及排名变化,并通过网站诊断和内容探索辅助制定内容与优化计划。它适合数字营销机构、SEO从业者、内容创作者、企业网站管理者和电商运营人员使用。工具提供免费与付费模式,但部分数据范围和功能可能受方案限制,分析结果也需要结合业务目标与实际验证。AI编程工具评分 7.6GreptileGreptile是一款面向开发团队、技术负责人和创业团队的人工智能编程工具,重点处理代码仓库理解与研发协作。它会结合整个仓库的上下文审查Pull Request,帮助发现潜在风险;开发者也可以通过自然语言询问功能实现位置、代码调用关系或可能的副作用。对于Jira和Linear中的任务,Greptile还能补充相关代码实现细节,帮助接手者更快建立背景信息。工具适合复杂项目、旧代码维护和快速迭代团队使用,但审查结果与问答内容仍应结合实际代码和业务要求进行人工核验。AI图形处理评分 8VisionatiVisionati是一款面向图像和视频分析的视觉人工智能工具,将多种视觉模型集中到统一工作台,并提供应用程序接口、浏览器扩展、内容分析器和Figma插件等入口。用户可以上传图片或视频,获取图像描述、标签、文字识别、颜色提取、人脸检测及内容审核等结果;视频则通过抽帧方式进行分析。它适合个人用户、内容创作者、电商与媒体从业者,也适合开发者和产品团队接入内容整理、审核和自动化流程。实际使用中,模型输出仍需结合业务要求人工复核,且该服务采用付费模式。AI办公工具评分 7.8BrandedBranded是一项面向企业和研究团队的市场调研与消费者洞察服务,专注于了解消费者需求、动机、痛点及购买驱动因素。用户可围绕新品、服务、品牌或市场问题定制研究项目,通过动态问卷、定性访谈和购买行为分析收集反馈,并获得产品与品牌测试、数据整理及项目管理支持。市场营销团队、产品经理、品牌管理者、创业企业和咨询机构可将其用于产品上市与品牌策略判断。该服务按付费模式提供,研究结论仍会受到问题设计、样本选择和执行范围影响。AI设计工具评分 7.1简单设计简单设计是一款基于网页的在线平面设计工具,面向自媒体创作者、电商运营人员、职场用户、学生和设计初学者。用户可以从海报、长图、Banner、小说封面、头像壁纸等模板入手,完成编辑后导出视觉内容,也可以直接使用图片压缩、裁剪、抠图、加水印等处理功能。平台还提供九宫格切图、三联屏切图、印章生成、视频转GIF、在线PS、白板和思维导图等工具,适合处理日常宣传与办公素材。平台标注为免费使用,但模板化流程对复杂、高度定制的设计项目仍有局限。