AI工具集
共 850 条资讯-
Lyria 3.5 – 谷歌 DeepMind 推出的 AI 音乐生成模型
Lyria 3.5是Google DeepMind 在 Google Flow Music 中推出的新一代音乐生成模型,实现音乐性、歌词质量、人声表现力与创作控制四项核心升级。
-
Codex Security CLI – OpenAI开源的AI代码安全扫描CLI工具
Codex Security CLI是OpenAI开源的AI代码安全扫描CLI工具,前身为Codex内置的闭源安全插件。工具基于大模型语义理解自动扫描代码漏洞,深度验证攻击路径真实...
-
AngelSpec – 腾讯混元团队开源的端到端推测解码训练框架
AngelSpec 是腾讯混元团队开源的端到端推测解码训练框架,基于 TorchSpec 构建,支持 MTP 自回归与 DFly 块并行共 6 种草稿架构。推理与训练解耦,推理引擎经...
-
Grok Voice Think Fast 2.0 – SpaceXAI 推出的语音模型
Grok Voice Think Fast 2.0 是 SpaceXAI(xAI)推出的端到端语音到语音模型,采用原生语音到语音架构,无需经过识别—推理—合成多阶段流程即可直接理解并回应...
-
商汤 Seko 3.0 实测 – 一键生成爆款AI短漫剧
AI 剧漫剧的观众越来越多,普通创作者却越来越难赚到钱了。 这并不是你的错觉,DataEye 预估显示,2025 年国内漫剧用户规模约 1.2 亿,到 2026 年上半年,用...
-
RingBot AI – AI智能体AaaS平台,零代码配置与上线
RingBot AI是首个'Agent as a Service'智能体即服务 AaaS 平台,主张交付开箱即用的 AI 智能体。企业零代码操作,数分钟即可同时部署语音 Voice Agent 与网站...
-
NewMax – 本地 AI Agent 工作台,AI会真实操作浏览器
NewMax 是本地优先的 AI Agent 工作台,支持 macOS、Windows 与 Linux。平台以工作区为单位管理本地文件与对话,可调用 OpenAI、Claude、DeepSeek、Kimi 等十...
-
Qwen-Audio-Agent – 阿里开源的实时语音 Agent 框架
Qwen-Audio-Agent 是阿里语音AI团队推出的开源实时语音 Agent 框架,基于 Qwen-Audio-3.0-Realtime 模型构建。框架作为统一的实时语音入口层,让用户通过自然...
-
AgentLink – 心言集团推出的跨智能体工作流终端
AgentLink 是心言集团推出的跨智能体工作流终端 App,将分布在不同设备、不同类型的 AI 智能体,如 Claude、Codex、OpenClaw 等统一接入移动端,实现扫码配对...
-
Instella-MoE – AMD 开源的混合专家语言模型系列
Instella-MoE 是 AMD 开源的混合专家语言模型系列,总参数量 16B、激活参数量 2.8B,采用 27 层解码器架构。模型基于 AMD Instinct MI300X / MI325X GPU 及 R...
-
KerWork – 桌面级AI执行助手,可在本地完成各种任务
KerWork 是桌面级智能执行助手,用户用自然语言下达目标,工具可自动在本地电脑中翻阅查找资料、理解任务背景、规划执行步骤,并调度工具完成跨文件、跨应用...
-
JiuwenSwarm – 华为开源的 AI Agent 统一工作平台
JiuwenSwarm是华为2012实验室、华为云、终端小艺等团队联合构建的开源AI Agent平台,也是首个面向鸿蒙PC的开源AI统一工作台。平台采用多智能体协同架构,支持...
-
AlphaEval – 跨赴科技等推出的生产级 Agent 评测框架
AlphaEval 是跨赴科技联合推出的生产级 Agent 评测框架。框架覆盖 7 家真实企业场景的 94 个生产任务,构建从需求澄清到 App 交付的完整可复现链路。
-
MAI-Cyber-1-Flash – 微软推出的首个网络安全 AI 模型
MAI-Cyber-1-Flash 是微软推出的首个专为网络安全从零构建的 AI 模型。模型接入多智能体系统 MDASH,可高效处理约 90% 的网络安全任务,在 CyberGym 基准测试...
-
Midjourney V8.2 – Midjourney推出的最新AI图像生成模型
Midjourney V8.2是Midjourney推出的最新AI图像生成模型版本,在提示词理解、风格参考逻辑和出图稳定性上实现全面升级。
-
GreenSock官方GSAP Skills 实测 – 让AI生成专业级前端动画
今天发点适合做前端动画的东西。 平时让 AI 做点前端动画,要不就是它根本听不懂你在说什么,要不就是做出来的东西一塌糊涂。
-
水杉输入法 – 免费开源的中文输入法,支持 AI 联想
水杉输入法是基于 Windows 原生 TSF 框架的免费开源中文输入法,专为 Win10/Win11 设计。与多数基于 RIME 的方案不同,工具完全自研,原生兼容 UWP 及高 DPI ...
-
PerceptionBench – 月之暗面开源的视觉感知诊断基准
PerceptionBench是月之暗面开源的视觉感知诊断基准。PerceptionBench 从 42 个现有评测集中前沿模型的失败案例中,归纳出 10 项原子视觉感知能力,并构建 3,0...
-
ChatLens语镜 – AI 会话智能体,透镜读屏智能回复辅助
ChatLens语镜是独立第三方的AI会话智能体,通过纯视觉技术为微信等聊天场景提供智能回复辅助。基于OpenCV自研算法与本地OCR实现界面识别和文字提取,不Hook、...
-
LLaDA2.2-flash – InclusionAI 开源的扩散语言模型
LLaDA2.2-flash是InclusionAI开源的扩散语言模型(dLLM),采用MoE架构,总参数量约100B,原生支持128K上下文。模型通过多轮并行去噪拟合答案,引入莱文斯坦...