AIbase
共 3668 条资讯-
《第九区》导演震撼发布首部AI短片 字节Seedance 2.0 助力科幻巨制
《第九区》导演尼尔·布洛姆坎普发布首部AI微电影《阴兵》,片长13分钟,完全由字节跳动Seedance 2.0生成。他仅通过文本提示词逐帧引导创作,影片获32位真人演员外貌与声音授权,并有专业概念设计师辅助。
-
阿里发布Qwen-Image-3.0,支持4.5K Token超长输入与复杂图文生成
阿里发布Qwen-Image-3.0图像生成基础模型,支持最长4.5K Token文本输入,可一次性生成公式、几何图形、逻辑推导及多层UI等复杂内容,原生兼容12种语言和20余款字体渲染,文本长度较上代提升4.5倍,大幅强化影视分镜、知识图解等商业级图文创作能力。
-
小鹏甩出TuringViT视觉编码器:只用十分之一数据,却把SOTA基线甩在身后
视觉大模型因隐形门槛——顶尖效果需天量数据与算力,长期仅为头部团队专属。7月21日,小鹏集团发布TuringViT高效视觉编码器,系统性重构架构、数据范式与训练流程,提供可复现、低成本的SOTA级视觉Transformer训练路径,推动先进视觉能力走向行业普惠。
-
Kimi3引发访问热潮:月之暗面回应资源紧张,优先保障付费用户
月之暗面新模型kimi3上线后需求超预期,致计算资源紧张,暂未全面开放新用户注册,优先保障付费老用户。B端负责人称已充分准备但实际增长仍超预估,出现资源压力。公司明确不牺牲现有体验换取短期用户增长。
-
消息称阿里将推出千问办公,整合三款智能体布局AI办公市场
据《财经》报道,阿里计划推出“千问办公”产品,已整合QoderWork、悟空、MuleRun三款智能体,主攻Agent办公市场,推动企业AI落地。产品由钉钉新任CEO陈宇森负责,他6月接替原CEO陈航,7月统一接管上述三款产品,形成阿里在Agent办公的重要布局。
-
YouTube 收紧政策,严打低质 AI 内容
YouTube近日更新政策打击AI垃圾内容,将“非真实内容”细分为三类并全面禁止变现,以维护平台生态、提升视频质量。首类被禁的是通用、重复的模板化视频,通常由 AI 或计算机生成,毫无原创性,仅对现有内容进行简单重复。
-
打破 15 秒魔咒:智象未来发布全球首个无限时长创作智能体vivago R1,商业可用率拉到85%
2026世界人工智能大会上,智象未来发布全球首个无限时长内容创作多模态智能体Vivago R1,并联合中科类脑等组建一带一路Token出海联盟,携手飞捷科思等发起物理智能创新联合体,以技术创新与生态协同双轮,推动AI从
-
腾讯WorkBuddy6月访问量超2000万,领跑AI办公智能体市场
《2026年Q2中国办公智能体市场洞察报告》显示,腾讯WorkBuddy在PC端AI原生办公智能体市场领先,6月访问量达2097万次,超过第二、三名的总和。当月市场总访问量突破6000万次,行业规模持续扩大。腾讯旗下AI编程智能体CodeBuddy亦居头部。WorkBuddy可通过自然语言指令完成办公任务。
-
一行GitHub代码出卖了AMD:Anthropic被曝成其新客户,算力去英伟达化加速
一行GitHub公开代码意外暴露Anthropic芯片布局。AMD AI业务高管提交的代码中,留下Anthropic将作为其客户的痕迹。行业分析机构SemiAnalysis指出,这虽非官方披露,却释放出明确信号:Anthropic正主动拓宽算力供应链,不再依赖单一芯片供应商。
-
首包延迟300ms、支持20种方言:通义千问Qwen-Audio-3.0-TTS正式开放
阿里通义千问发布新一代实时语音合成模型Qwen-Audio-3.0-TTS,实现从“能说话”到“会表达”的跨越。Plus版本在Artificial Analysis Speech Arena排名全球第一,超越Gemini3.1TTS等主流模型。双版本中Flash版主打低延迟实时交互(首包约300ms),Plus版专攻高质量自然度与音色还原。
-
100 亿次下载破纪录:工信部亮出开源半年报,OpenHarmony设备已超13. 5 亿台
国新办发布会上,工信部公布2026年上半年数据,首次全面量化中国开源生态发展。基础软件、工业软件与开源建设协同推进,为外界提供明确评估依据。
-
发布仅三天就踩下刹车:Kimi K3 用户请求爆表,月之暗面算力顶到天花板
月之暗面大模型Kimi K3上线仅三天便暂停新用户订阅,因请求量激增超预期,团队决定优先保障现有订阅用户体验,将算力集中服务已付费会员。此举折射出K3市场反响火爆,也暴露了算力瓶颈,凸显大模型产品在爆发式增长中的服务承载力挑战。
-
阿里新一代大模型千问3. 8 将至:预览版抢先登陆阿里云与Qoder,正式版拟近期开源
国内大模型开源节奏持续加快。阿里即将发布并开源新一代通义千问3.8,预览版Qwen3.8-Max已率先上线阿里云Token Plan、Qoder及QoderWork三平台,用户可提前体验其能力边界,正式版近期推出。此举进一步推动通义千问家族在开源赛道上的迭代与布局。
-
Kimi因算力紧缺暂停C端新用户订阅,全速推进集群扩容
7月19日深夜,Kimi公告称因用户请求量激增,算力集群接近承载极限,即日起暂停C端新用户订阅,并启动算力扩容计划。过去48小时请求量远超预估,团队将优先保障现有订阅用户权益,全速推进扩容以应对需求。
-
Netflix5.87亿美元收购本·阿弗莱克AI电影制作公司InterPositive
Netflix以5.87亿美元现金收购AI电影制作公司InterPositive,交易金额首次披露。该公司由本·阿弗莱克联合创立,专注将AI技术融入影视创作流程,旨在借助AI保护人类创造力。
-
神珍科学多模态基础模型在沪亮相: 110 亿参数打通六类科学数据,一个模型读懂DNA到气象场
上海科学智能研究院在2026世界人工智能大会上发布“神珍”科学多模态基础模型,名字源自《西游记》,定位为多领域科研底层超级大脑。该开放模型形态精炼,可承载多样科学任务,鼓励研究者检验与共建,并成为此前推出的科研智能体“大圣”的核心脑力支撑。
-
Claude Fable5使用权限大调整:部分用户失去访问权,Anthropic加速扩容
Anthropic宣布7月20日起调整Fable5订阅策略:Max/Team Premium用户保留访问但限额大减,奖励期后常规额度再减33%,实际可用额度仅为调整后限额的50%;Pro/Team Standard失去权限,获一次性100美元额度后按API付费。因高频调用。
-
面壁智能开源MiniCPM-Robot:1.5B的VLA模型完整放出,个人开发者也能在真机器人上跑操作
过去,具身智能因模型庞大、门槛极高,一直由巨头和实验室把持。7月19日,面壁智能开源首个具身AI模型系列MiniCPM-Robot,完整放出1.5B参数的视觉-语言-动作模型,让个人开发者在真实机器人上实现操作与目标跟踪,开放力度在具身领域罕见。该系列包含三个核心组件。
-
Google DeepMind发布GenCeption:基于视频生成模型实现多项计算机视觉突破
谷歌DeepMind发布GenCeption,基于预训练视频生成模型,统一解决深度估计、图像分割、3D姿态估计等任务,性能接近或超越专用模型,且训练数据需求远低。这挑战了当前以Segment Anything、Depth Anything等专用模型为主的格局。
-
Epoch AI测试三大AI文本检测器:模仿人类文风后最高近三成内容漏检
Epoch AI研究显示,主流AI文本检测器能近乎完美识别普通AI生成内容,但当大语言模型刻意模仿特定作者写作风格时,准确率明显下降,科学写作最难辨别。实验测试了Pangram、GPTZero和Originality.ai三款工具,采用495篇涵盖博客、小说、科学的人类原创文本(均创作于ChatGPT问世前),发现风格模仿可有效逃逸检测。