AIbase
共 3668 条资讯-
OpenAI 首席执行官奥尔特曼泼冷水:AI 救不了你的工时,超级智能时代人只会更忙
萨姆·奥尔特曼称AI无法缩短工时,因为生产力提升会激发竞争意识,导致人们不会减少工作。他指出,长期以来科技企业CEO承诺缩短工作时间,但并未成真。
-
企业微信AI助理"大圆"内测:一句话写周报,专治99+群聊消息
腾讯企业微信AI助理“大圆”开启内测,支持手机侧边把手滑动唤醒、电脑侧边栏入口,无需切换应用。主打“爬楼”功能,可自动提炼群聊重点、总结语音消息,并根据对话生成内容,一站式处理日常办公任务。
-
灵光APP上线“一键部署”:支持Codex、Claude Code、Cursor等AI应用直接发布
近日灵光APP推出闪应用“一键部署”功能,用户可通过Codex、Cursor等AI工具开发的应用,借助灵光部署Skill一键发布为灵光闪应用,并同步在PC与手机端展示分发。同时灵光开放大模型、搜索、LBS等30余项免费API,降低应用搭建门槛。即日起所有用户均可登录体验。
-
美团发布全场景 AI Agent 平台 CatPaw,搭载 1.6T 参数开源大模型 LongCat 2.0
7月27日,美团上线全场景AI Agent平台CatPaw,搭载刚开源的万亿参数大模型LongCat2.0。该模型总参数1.6T,原生支持1M超长上下文,首次在五万张国产算力卡上完成全流程训练与推理。CatPaw将这一底层能力转化为开箱即用的企业级智能工作台与Agent开发托管平台,标志着美团大模型从技术开源全面迈向产业落地。
-
GEO服务商迎来“效率革命”:一套SaaS平台系统解决计费、交付、代理管理三大难题
AI搜索引擎普及催生GEO刚需,但服务商面临两大痛点:一是按有效收录计费的扣费模式依赖人工对账,效率低且易扯皮;二是缺乏标准化AI内容与知识库工具,导致单客交付成本居高不下。
-
ChatGPT 桌面端装上了"真人口吻":GPT-Live 语音上线,你说话它就在后台干活
OpenAI今日为ChatGPT桌面端大升级,该客户端已与Codex整合,正式上线基于GPT-Live模型的ChatGPT Voice语音模式。新版本支持在聊天、办公和编程三个板块通过语音直接发起、检查或调整任务,将多线程工作协同从键盘移至语音。早在2024年,OpenAI便为ChatGPT添加语音识别,此后持续发力语音技术。
-
腾讯甩出 WorkBuddy Bench:一套把代码、网页、办公、安全全装进来的编码智能体考场
腾讯推出WorkBuddy Bench多领域评测套件,论文已发布于arXiv。它打破编码智能体评测各自为政、生产基准不透明的局面,将仓库级代码工程、前端制品、办公自动化等四类工作场景整合为一。最大亮点不在题量,而是从题目根源设计上杜绝“背答案”,确保评测能真实反映智能体在不同领域的通用与迁移能力。
-
德国黑森林实验室发布Flux3 多模态模型:原生音频生成, 20 秒音视频同步输出
德国黑森林实验室发布多模态基础模型Flux3,基于Self-Flow架构及专用图像、视频、音频、动作编解码器,实现物理与数字环境的统一理解与生成。性能碾压Luma、Runway,首次原生支持音频生成,可一次性输出20秒音视频同步片段,并具备文本/图像/视频转视频、关键帧转场和多语言对话等功能。
-
阿里开源0.8B文档解析模型OvisOCR2,端到端方案登顶OmniDocBench
7月24日,阿里开源0.8B参数的文档解析模型OvisOCR2,以96.58分登顶OmniDocBench基准,首个全面超越传统流水线,推动文档智能范式转折。它
-
Claude 语音模式终于用上 Opus 了:从"随口问答"升级成能调工具、换语言的实时参谋
Anthropic今日为Claude语音模式关键升级:不再限于Haiku,现可运行Opus、Sonnet、Haiku三档模型,并接入Gmail、Slack等已连接工具,扩展支持语言。此前添加免提对话后,用户已将语音用于更复杂的长会话,靠说话解决打字啃不动的难题。
-
ChatGPT桌面应用上线语音模式:口述需求AI多线程干活,冲杯咖啡的功夫会议纪要就备好了
OpenAI升级ChatGPT桌面应用并整合Codex,推出基于GPT-Live的全新语音模式。覆盖聊天、办公和编程场景,用户可用语音发起、检查、调整任务,实现多线程协同。核心亮点是全双工语音,支持同时聆听与对话,边聊边干活。该技术源于2024年首次语音识别,逐渐进化至今。
-
支持产品问答与辅助决策,苹果 Apple Store 应用拟推 AI 虚拟购物助手
Apple Store隐私条款更新暗示将推AI虚拟购物助手,用生成式对话解答产品疑问辅助购物决策。此举把AI从售后支持延伸到零售端,是加码AI电商体验的关键布局,助手将收集账户与设备标识数据。
-
Google Q2 资本开支翻番破纪录:449 亿美元砸向 AI 基建,云业务利润率几乎翻倍
Alphabet二季度资本支出同比暴涨100%至449.2亿美元,年化逼近1800亿美元;营收增24%至1198亿美元,超预期。谷歌云营收飙升82%至248亿美元,运营利润率近乎翻倍,巨额算力投入正转化为强劲盈利引擎。
-
腾讯混元"合二为一":多模态与大语言模型部门合并,姚顺雨统管冲全模态上限
据7月24日报道,腾讯于7月23日宣布将混元多模态模型部门与大语言模型部门合并,组建基础模型部,由首席AI科学家姚顺雨统率。此举旨在提升研发与协同效率,全力冲刺全模态模型的智能上限。整合早有伏笔,去年12月姚顺雨已接管大语言模型团队,如今双边归一,意味着腾讯集中资源推动多模态与语言深度融合,加速构建新一代统一基础模型,向全模态智能更高峰迈进。
-
快手入局AI互动内容赛道,开放首批创作者招募
快手推出“AI互动内容”创作功能,招募首批创作者,聚焦AI互动剧情、角色对话和轻应用。这标志着短视频平台竞争从传统内容时长转向交互式体验,入选者可优先体验工具并与团队共同打磨产品。
-
新晋菲尔兹奖得主IMO 满分天才 Tsimerman 官宣加入 OpenAI
2026年菲尔兹奖揭晓,邓煜、王虹成为首批中国籍获奖者。另一位得主雅各布·齐默尔曼随后宣布将入职OpenAI,深耕AI安全领域。
-
黑森林实验室放出 Flux3:首个原生生成音频的多模态基础模型,20 秒音画同步一次成型
黑森林实验室发布多模态模型Flux3,基于Self-Flow架构并集成图像、视频、音频、动作编解码器,实现物理与数字世界的统一理解与生成。其亮点是首次支持原生音频生成,一次输出20秒音视频同步片段,能力涵盖文本、图像、视频转视频等。
-
小鹏人形机器人广州工厂开启小批量试生产 预计2026年实现量产
近日,小鹏人形机器人在广州工厂正式开启小批量试生产,量产产线已进入最后联调,标志着量产冲刺进入倒计时。集团董事长何小鹏已亲自兼任机器人业务CEO,全面统筹并推进商业化落地进程。按照内部机器人量产动员大会规划,公司将于2026年正式实现人形机器人量产,并计划
-
Runway推出Media Router:自动切换AI模型帮你省Token,创意验证到成片一条龙搞定
Runway推出Media Router,可依据质量、速度与成本优先级,为图像、视频、音频生成自动切换AI模型。系统将调用场景分为三类,如高速生成模式用于快速创意验证,实现智能匹配,省去开发者逐一比较和手动切换的负担,兼顾效率与成本。