AI工具集
共 850 条资讯-
Alpamayo 2 Super – 英伟达开源的自动驾驶 AI 推理模型
Alpamayo 2 Super 是英伟达开源的自动驾驶 AI 推理模型。模型基于 NVIDIA Cosmos 3 Super Reasoner 构建,具备 360° 环境感知、高级驾驶决策与自动推理标签生...
-
Wan-Animate-2 – 万相团队开源的新一代角色动画模型
Wan-Animate-2是万相团队开源的新一代角色动画模型,作为 Wan-Animate 的重大架构升级,放弃了对显式姿态骨架和辅助姿态提取网络的依赖,改为端到端的双分支 ...
-
Grok Imagine Image 2.0 – SpaceXAI 推出的图像生成模型
Grok Imagine Image 2.0 是 SpaceXAI 发布的全新一代图像生成与编辑模型,以「Quality Mode」形式上线 grok 网页端及 iOS、Android 应用。不只做「重抽一张」...
-
CosyVoice Studio – 阿里推出的一站式AI语音生产力平台
CosyVoice Studio是阿里巴巴推出的国内首个一站式AI语音生产力平台,基于自研Qwen-Audio模型打造。平台含三大模块,CosyFlow实现语音转写叠加语义理解,自动...
-
Warp Agent CLI – Warp 推出的独立命令行编码工具
Warp Agent CLI 是 Warp 推出的独立命令行编码工具,可在 Ghostty、iTerm 2、VS Code 及系统自带终端等任意环境中运行。工具基于 Warp 终端基础设施构建,内...
-
Ling-3.0-tiny – 蚂蚁百灵推出的原生混合推理模型
Ling-3.0-tiny是蚂蚁百灵推出的原生混合推理模型,总参数 7.9B、每 token 仅激活 1.3B,面向数学推理、指令遵循及资源敏感型部署优化。
-
SALMONN-2 – 清华等开源的通用音频大语言模型
SALMONN-2 是清华大学、上海人工智能实验室与剑桥大学联合开源的通用音频大语言模型,基于字节跳动 SPEAR 统一自监督音频编码器与多层特征融合适配器构建,以...
-
Wan3.0 – 阿里万相最新推出的视频生成大模型
Wan3.0 是阿里云万相团队最新推出的视频生成大模型。模型在生成时长、万能创作、全能参考与真实感等维度全面升级,单次可生成 30秒 视频,首次支持 doc、xls...
-
微信公众号 AI 美女贴图教程,爆款起号解锁流量主收益
最近我发现了一种非常高效又简单的 AI 起号玩法,你可能也刷到过,这种随手拍的美女生活照,配一两句简单的文案,点开一看,阅读量、互动量都轻松破万。应群...
-
InstructAV2AV – 智源联合北大开源的音视频联合编辑模型
InstructAV2AV 是北京智源人工智能研究院与北京大学联合推出的音视频联合编辑模型。用户只需一句自然语言指令,可在端到端生成过程中同时编辑视频画面与对应...
-
RabbitVis – 兔展智能推出的一站式 AI 设计生产工具
RabbitVis 是兔展智能推出的图层级一站式 AI 设计生产工具,基于自研 UniWorld-Design 视觉大模型,将 AI 生成能力与图层编辑能力深度融合。
-
Muse Code – Meta 推出的终端编程 AI 智能体
Muse Code 是 Meta 推出的终端编程 AI 智能体,基于 Muse Spark 1.2 模型,可处理大型代码库中的完整软件工程任务,包括规划变更、编写代码与验证结果。
-
Acti – AI 智能键盘,一键触发复杂任务
Acti 是新加坡团队开发的 AI 智能键盘。键盘将 AI 嵌入手机键盘层,用户长按空格键即可触发 Acti Bar,无需跳转应用可查信息、搜文件、建会议或运行工作流。
-
Hunyuan3D-Buffalo 1.0 – 腾讯混元推出的 3D 多模态框架
Hunyuan3D-Buffalo 1.0 是腾讯混元推出的统一3D多模态框架,通过共享的 Hunyuan3D-VLM 主干将3D问答、空间定位、文生3D、指令编辑和部件生成集成到单一流程中。
-
Omega – 腾讯推出的 AI 原生数据分析平台
Omega 是腾讯推出的 AI 原生数据分析平台,内测版名为「马尔摩斯(marmos)」。工具通过 Agent 驱动完整分析链路,让用户用自然语言可生成可交互、可迭代、可...
-
MemHarness – 上海 AI Lab 等推出的智能体记忆重构框架
MemHarness 是上海 AI Lab 联合浙大、复旦、上海交大等高校推出的 LLM Agent 记忆重构框架。现有记忆增强 Agent 常将检索到的历史经验直接注入上下文,若旧经...
-
Qwen-CUA – 阿里 Qwen 等推出的原生 Computer Use Agent
Qwen-CUA 是 Qwen 团队与 XLang Lab 联合推出的原生 Computer Use Agent,基于 397B-A17B 混合专家架构,仅通过截图感知界面状态,无需依赖 DOM 树或辅助功能...
-
开源 AI 视频生成工具 MoneyPrinterTurbo 使用教程
AI 视频生成现在越来越精致且自然了,但很多时候我们还是想要真实的画面作为视频素材,AI 只是帮我们去剪辑内容,如果 AI 能自己去找真实素材再剪辑,那就更...
-
Hy ASR 3.0 preview – 腾讯混元推出的新一代语音识别模型
Hy ASR 3.0 preview是腾讯混元推出的新一代语音识别模型,基于 Hy3 大语言模型,融合高精度语音识别与深度语义理解。模型支持中文、英语、粤语及10大方言片区...
-
JoyAI-Video-Edit – 京东开源的实时流式视频编辑模型
JoyAI-Video-Edit是京东开源自研的实时流式视频编辑模型,基于16B参数自回归扩散架构,在720P分辨率下实现30FPS推理速度,支持任意时长稳定流式编辑。