InfoQ中国
共 1027 条资讯-
微服务架构进化:从业务加一堆横切代码到 Sidecar 解耦
在基于微服务的 ASP.NET Core 应用中实现 Sidecar 模式。
-
GitHub 利用 eBPF 消除部署风险,防止循环依赖导致故障失控
GitHub 近期公布了一种新的部署安全方案,通过利用 eBPF 来检测并阻止隐藏的循环依赖,从而避免系统在故障期间失去恢复能力。根据 GitHub 在最新工程博客中的介绍,这项技术能够在内核层面对部署流程的网络行为进行监控与限制,确保即便平台部分服务不可用,关键系统仍能够完成更新与修复。
-
迈向高保真与工业化:混元 3D 生成大模型从理论到实践的 SOTA 之路|AICon上海
AICon 全球人工智能开发与应用大会
-
Legare Kerrison 与 Cedric Clyburn 谈 LLM 性能与评估
有效衡量基于大语言模型(LLM)的应用性能,已经成为企业采用 AI 技术的关键因素。来自红帽团队的 Legare Kerrison 与 Cedric Clyburn 近日在 Arc of AI 2026 大会上分享了评估与优化 LLM 推理的实用方法。他们讨论了 RAG(检索增强生成)与 Agentic AI 等 AI 应用中不同工作负载的资源需求与成本影响,同时强调了 Requests Per Second(RPS)、Time to First Token(TTFT)以及 Inter-Token Latency(ITL)等指标在应用评估中的重要性。
-
借助全新的安全概览仪表板,Cloudflare每日处理超过1000万条洞察数据
借助全新的安全概览仪表板,Cloudflare每日处理超过1000万条洞察数据。
-
Agent时代需要怎样的分布式基础设施
自本轮大模型技术爆发以来,Agent得到了广泛关注。进入2026年后,伴随OpenClaw的现象级爆火,Agent更是彻底破圈,进入了更广阔的大众视野。同时,如果说以往的Agent更多用于Demo或一些相对定制的场景,那么经过最近一年Agent Skills等技术的出现和逐渐成熟,如今的Agent已经可以处理更多的实际场景,可以认为Agent应用形态的时代可能即将到来。
-
生成式推荐引擎升级,快手在线参数服务器性能与时延深度优化实践|AICon上海
AICon 全球人工智能开发与应用大会
-
Meta部署统一的AI智能体,实现超大规模环境的自动化性能优化
Meta推出了一款新的AI驱动的容量效率平台,该平台使用统一的AI智能体自动检测和解决其全球基础设施中的性能问题,标志着向超大规模自优化系统的重大进展。
-
技术·艺术· 算术:京东零售 AIGC 百亿素材供给实践
行业中很多时候将 AIGC 等同于文案、图片、视频的生产工具,认为“能生成 = 能落地”。我今天会站在一个偏应用的视角来分享一下我们京东零售在 AIGC 大规模供给落地的一些经验和分享。
-
Cloudflare构建了面向LLM的高性能基础设施
Cloudflare最近发布了全新的基础设施,可在其全球边缘网络上运行大型的AI大语言模型。
-
AI 把编程这件事接管之后,作为程序员的我该何去何从?
编程没有被消灭,它的瓶颈从一处转移到了另一处。问题是——转移到哪了?转移之后,做软件工程的人到底要做什么?
-
Vitest 4.1:测试标签、原生 Node.js 执行和 AI 代理报告器
由 VoidZero 维护的 Vite 原生测试框架 Vitest 发布 4.1 版本,带来了一系列新功能和工具增强,旨在让 JavaScript 测试更加条理清晰、贴近生产环境。