AIbase
共 3668 条资讯-
Swiftlet 把 80B 量级 Qwen 巨兽塞进 Mac:峰值内存仅 4.3GB,iPhone 17 还能原生机跑 35B
Swiftlet 项目利用 Swift + Metal,让 Qwen3-Next 等 MoE 模型在 Mac 上极致瘦身运行:仅常驻小型稠密核心,专家权重存于 SSD 按需流式加载。在 M5 Mac 上,Qwen3.6-35B-A3B 的 4-bit 版仅占 18GB 磁盘,峰值内存 2.6GB,解码速度达 7–11 tok/s。
-
面壁智能开源 ForgeStencil:双 Agent 一周自动优化 100+ 工业软件,全程零人工介入
现代工业与前沿科研的核心计算模式——Stencil模板计算,通过网格点邻居加权组合迭代更新,广泛应用于天气预报、地震勘探、电磁仿真等领域。它极度访存密集,内存带宽成为瓶颈,占用大半运行时间,其速度直接决定整体性能。
-
8B 参数塞进 4K 生成与编辑,商汤开源轻量统一多模态模型 U1.5-Lite 预览版
商汤科技面向社区开源轻量统一多模态模型SenseNova U1.5-Lite-Preview。该模型基于U1系统性迭代,在单一架构中融合视觉理解、推理、生成与编辑四大能力,仅以8B-MoE参数即支持4K分辨率、更真实质感与复杂视觉控制。商汤称U1验证了统一架构可行性,U1.5则实现了轻量高性能的突破。
-
腾讯混元发布Hy ASR3.0preview:语音识别迈入“懂语境”新阶段
腾讯混元发布语音识别模型Hy ASR3.0preview,首次将大语言模型Hy3的语义理解融入识别,实现从逐字转写向“理解语境、一键直出”跨越。在开源评测集上,中文普通话、英语、粤语词错误率分别为3.34%、2.62%、3.12%,整体约3%,多维度表现亮眼。
-
AI 写代码烧掉 1215 万元,超预算 860%:亚马逊内部事故敲响企业 AI 成本警钟
美国媒体曝光亚马逊一AI成本失控事故:工程师用Anthropic的Claude Sonnet模型处理作者与商品数据匹配等常规任务,却累积180万美元账单,超预算860%。项目拖延长达5个月最终未成功落地,高额算力消耗酿成巨额浪费。
-
腾讯混元发布 Hy ASR 3.0 preview:语音识别不再逐字硬转,而是真的听懂了语境
腾讯混元发布语音识别模型Hy ASR3.0preview,基于大语言模型Hy3的语言理解能力,融合高精度识别与深度语义理解。它在通用识别、上下文感知、多场景鲁棒性及方言覆盖等方面全面提升,能结合语境给出更准确连贯的转写,实现从逐字转写到理解语义的进化。
-
微软首款自研全双工 AI 语音模型曝光:听说并行,16 种语言自由切换
微软正测试首款原生实时语音模型MAI Realtime,支持16种语言和2种语音风格,实现听说并行,用户无需等待AI说完即可插话,且能自动识别并切换语言。采用双向全双工交互,打破传统轮流对话模式,并依靠端点检测技术。
-
还没发布就被砍:谷歌取消独立 AI Studio 应用,把移动创作塞回 Gemini 怀里
谷歌宣布取消原定推出的独立AI开发应用Google AI Studio,该应用曾在今年5月I/O大会亮相,计划作为移动端便携工作台,让开发者随时构建、测试和发布AI应用,但尚未正式上线便被终止。
-
AI 造假炒股第一案:95 后两天炮制 17 篇虚假文章,赚 8.5 万被罚 48.5 万
四川证监局8月3日披露,95后投资者孙某用AI批量生成并散布某上市公司纯碱锅炉故障虚假消息,同时交易纯碱期货获利,被没收违法所得8.5万元并处罚款40万元,合计48.5万元。这是AI造假操纵期货市场的罕见案例。2023年11月,孙某通过百家号连续发布虚假信息实施操纵。
-
苹果诉 OpenAI 窃密案:前员工离职后,仍能借个人 iCloud 摸出机密文件
苹果诉OpenAI窃密案中,媒体曝出其自身数据管理裂缝:已离职员工仍可通过个人iCloud查阅产品发布计划等机密。根源是公司长期允许员工将个人Apple ID绑定工作设备,离职后未及时收回权限,为双方法律战增添技术注脚。
-
三星智能电视应用被曝含住宅代理代码,数百万设备面临安全风险
三星智能电视多款热门应用被曝含住宅代理代码,可能将用户网络共享给第三方,涉及数百万设备。其中一款官方推荐的吃豆人游戏也在列。研究由Mnemonic发布,指出应用结构简单却潜藏风险。
-
80 万人预购等到一刀切:Google 砍掉 AI Studio 独立应用,全盘塞进 Gemini
Google再度展现其“砍产品”传统,在发布前夕宣布取消尚未正式上线的Google AI Studio移动应用。该应用曾于5月I/O大会惊艳亮相,原定登陆安卓与iOS平台,旨在让开发者在手机端即时捕捉灵感并构建AI项目。尽管已在168个国家吸引约80万用户预购,仍难逃被彻底终止的命运。
-
MiniMax H3 开源却把美国人挡在门外:不是封锁,是好莱坞版权官司逼出的自保
稀宇科技开源视频大模型MiniMax H3,性能对标字节Seedance,但许可协议却将美国、欧盟、英国及韩国用户排除在外。此举引发社区大量吐槽,连下载都受阻。负责人Ryan Lee解释,限制接入主要源于公司与好莱坞的某种关联,暗示版权或合规考量。开源附带使用边界的做法,在AI圈激起热议。
-
ChatGPT Atlas 浏览器 8 月 9 日停止服务,用户需10天内导出书签
OpenAI 首款浏览器 ChatGPT Atlas 将于 8 月 9 日停止服务,不再推送更新和安全补丁。该产品自去年 10 月 21 日登陆 macOS 后仅存活不到十个月。用户数据无法自动迁移至新版 ChatGPT,需手动将书签和历史导出为 HTML 文件,再导入 Chrome 等浏览器,迁移过程繁琐且后续仍有更多麻烦。
-
高德升级世界模型ABot-World-0:实现全球首个24小时连续稳定推理
阿里巴巴旗下高德推出自研交互式世界模型ABot-World-0,单消费GPU可24小时连续稳定推理,画质物理交互无衰减,全球首次将连续推理时长从分钟级提升至天级。此前主流模型最长仅维持30秒至1分钟,长时推理易崩坏。
-
IBM报告:92% AI安全事件源于访问控制缺失,AI相关泄露成本达533万美元
IBM报告揭示,AI安全事件多因访问控制等基础管理薄弱,仅8%企业有完善措施。约五分之一事件源于API入侵等外围风险,模型本身并非主因。
-
微软为Teams加入“举报会议”功能,打击AI身份冒用和深度伪造
微软Teams将于2026年8月上线“报告问题”功能,参会者可在会议中直接举报网络钓鱼、深度伪造等可疑行为,帮助企业安全团队快速响应。此举旨在应对日益增长的AI驱动攻击风险,包括利用生成式AI克隆声音、面部特征进行身份冒用与诈骗。
-
白宫 AI 评估框架按时完成却秘而不宣,OpenAI、Anthropic、谷歌都没看到全文
美国已完成先进AI模型自愿性评估框架制定,但未公布具体内容、涉及机构及采纳时间表。该框架依据6月总统行政令设立,旨在为AI开发商提供结构化流程,以协同政府判定研发中模型是否需纳入监管。
-
OpenAI 砸钱办奢华夏令营讨好网红,一晚 2000 美元被骂"反乌托邦"
OpenAI在纽约哈德逊河谷Wildflower Farms豪华度假村为网红举办“夏令营”式活动。庄园占地140英亩,周末房费每晚超2000美元,现场设可坐30人的长桌晚宴,暖光与发光标识营造如品牌宣传片的氛围。受邀内容创作者纷纷晒出视频,活动日程安排紧密。
-
灵光App闪应用创作者超400万人,普通人正成为AI应用创作主力
灵光App“闪应用”平台创作者已超400万,多为无编程背景的普通用户,推动AI原生应用生态走向大众。游戏化成为最活跃趋势,其中“模拟器”类应用表现突出。