SIGGRAPH 2026 | VeraRetouch:多任务推理式照片修图框架

7 月 9 日
阅读 5 分钟
141
作者:vivo BlueImage Lab 摘要:我们团队提出了 VeraRetouch,一个轻量、全可微分、可移动端部署的多任务推理式照片修图框架。VeraRetouch 不仅能自动修图,还能听懂用户想要的风格描述,甚至能执行精确的参数式调整。通过将 0.6B 视觉语言模型作为“修图大脑”,并设计全可微分的 Retouch Renderer 作为“修图执行器”,Ve...

当 AI 进入推荐系统:从“推什么”到“怎么选”

7 月 9 日
阅读 7 分钟
155
作者:vivo 互联网产品团队- Wang Yuxi 本文探索:不改排序,补上排序之后的“表达与决策”——把游戏理解透,让同类多款可比较、可解释、可追溯。做法是让大模型放开探索、用工程约束收住,使生成稳定进生产。目标不是替代排序,而是帮用户从“给结果”走向“帮决策”。

ICLR 2026 | 基于后验采样的图像恢复方法LearnIR:人脸去阴影、去雾

7 月 2 日
阅读 4 分钟
273
作者:  vivo BlueImage Lab 本文入选 ICLR 2026 ICLR(International Conference on Learning Representations)是聚焦机器学习与深度学习等领域的国际顶级学术会议,致力于推动人工智能理论与方法的前沿研究与创新发展。 ICLR 2026 19525篇投稿,接收率约27.4%。 论文主页: [链接]

从 10 分钟到 1 秒:ES 深度分页任意跳页的三轮优化实战

7 月 2 日
阅读 6 分钟
279
作者: vivo 互联网服务器团队- Chen Yifan 本文介绍了一种基于 search\_after + Redis 多级锚点缓存的 Elasticsearch 深度分页跳页方案。针对 Elasticsearch 原生不支持随机跳页的限制,通过三轮优化——分段预热缓存、最近锚点定位 + Elasticsearch 查询提速(禁用 \_source/关闭 track\_total\_hits)、大区间预热 + 小...

未来,什么才是 AI“正确的使用方式”

6 月 25 日
阅读 6 分钟
387
作者:vivo 互联网项目团队- Jiang Zuohan 本文以“大模型不是马,而是大脑”为核心视角,重新定义 AI 系统结构,指出当前问题不在模型能力,而在 Agent 作为“身体”的不成熟,分析感知、行动、反馈与调度等工程缺陷,并将 Harness 类系统比作 ICU 的生命维持机制,强调当下混乱源于最佳实践尚未收敛,认为当前阶段本质是“...

CVPR 2026 | 全新强化学习框架 BeautyGRPO:重塑真实人像

6 月 18 日
阅读 4 分钟
456
CVPR(IEEE/CVF Conference on Computer Vision and Pattern Recognition)IEEE 国际计算机视觉与模式识别会议,主要内容是计算机视觉与模式识别技术。

从 Web 到桌面:基于 Tauri 2.0 + Vue 3 打造 vivo 线下门店「大头贴」拍照体验系统

6 月 18 日
阅读 14 分钟
487
作者:vivo 互联网大前端团队- Yang Maoxiang 本文介绍 vivo 线下门店「大头贴」拍照合成打印一体化桌面应用软件的技术方案。该项目基于 Tauri 2.0 + Rust + Vue 3 构建,实现了手机实时投屏、智能拍照、Live Photo 处理、模板合成、视频生成、跨平台打印等核心能力,为门店用户提供沉浸式拍照体验。

MagicWorld 实现长时交互视频世界建模

6 月 11 日
阅读 4 分钟
411
作者:vivo BlueImage Lab MagicWorld 针对当前视频世界模型在长时间交互中易出现运动不合理与场景崩坏的问题,提出了一种面向长时稳定性的交互式建模框架。该方法通过引入基于光流的运动约束提升动态真实性,利用历史检索机制增强跨时间一致性,并通过多步聚合的训练策略优化整体交互序列质量,从而有效缓解误差累积问...

动效开发不踩坑:几种动效实现方案对比与实战选型

6 月 11 日
阅读 23 分钟
628
作者:vivo 互联网大前端团队 - Xu Jie 本文从 Android 渲染系统内核出发,系统拆解 Native、Lottie、PAG、SurfaceView、TextureView五种动效方案的底层原理,通过多维度量化测试建立性能评估模型,结合实战场景提供可落地的优化策略与选型体系,帮助开发者突破动效性能瓶颈。

ICLR 2026 | LiveMoments 用参考图引导的扩散模型提升重选封面帧画质

6 月 4 日
阅读 4 分钟
715
作者:  vivo BlueImage Lab 摘要: 我们团队提出了 LiveMoments,这是首个专门针对 Live Photo 重选封面帧画质修复的解决方案,已被 ICLR 2026 录用。 针对用户重选封面时面临的画质降级痛点,我们利用 Live Photo 自带的原始高清封面作为参考,构建了一个包含运动对齐模块的参考引导扩散模型。 该方法有效解决了两帧之...

把输入框变成 AI 的“超级入口”(ProseMirror 全流程实战)

6 月 4 日
阅读 5 分钟
883
作者:vivo 互联网项目团队- Ding Junjie 最近在做知识库问答输入框的 @文档 能力,表面上是“输入 @ 后选一个文档”的小需求,实操后发现核心难点在于编辑器稳定性。本文按真实心路历程展开:先讲最直觉的 DOM 方案与踩坑,再讲为什么转向 ProseMirror,并给出 @文档 的落地实现。

AI 导购在 vivo 官网的落地实践

5 月 28 日
阅读 10 分钟
562
作者:vivo 互联网大前端团队-Feng Wei、Li Quanlong 本文介绍AI导购技术在 vivo 官网 APP 的落地实践,通过定义解决问题的边界能力、搭建多层架构方案、方案落地这三大块内容逐步递进地展开 AI 导购在为用户服务的应用过程。

VAPD AgentKit:可组合 Agent 前端通用库实践

5 月 21 日
阅读 5 分钟
699
作者:vivo互联网项目团队- Ding Junjie 我们围绕三大业务场景(笔记、知识库、项目管理)统一了一套可组合的 AI Agent 能力。 本文聚焦一期「Chat 模式」落地:强调 Runtime Adapter 的“协议无关、面向任意后端流”特性——只要后端能够以流式输出事件,前端即可通过统一的 Adapter 转为标准消息模型进行渲染与编排。我们...

vivo 万台规模 YARN 集群升级实践

5 月 14 日
阅读 12 分钟
637
作者:互联网大数据团队-Wang Zhiwen 本文主要介绍了 vivo 大数据架构的演进历程中 YARN 服务的升级事项,从整体方案出发剖析每个环节遇到的问题难点并逐一分析讲解,对于研究调度器性能和从事大数据运维工作的同学具有较大的参考借鉴价值。

下一代图片格式 AVIF 在 vivo 社区的落地实践

5 月 7 日
阅读 5 分钟
776
作者:vivo 互联网前端团队- Liu Daqiang 本文分享 vivo 社区在 WebP 已全面落地的基础上,引入下一代图片格式 AVIF 的实践经验。通过 CDN 边缘缓存 + 服务端异步转码的方案,在保证画质的前提下,图片体积相比 WebP 进一步降低 20%+,有效提升了用户的浏览体验。

深度解析 vivo 活动系统全球化实践

4 月 23 日
阅读 6 分钟
894
作者:vivo互联网服务器团队- Zhang Mengtao 随着经济全球化的趋势,业务逐渐覆盖海外更多国家和地区,如何快速的将内销业务复用到外销环境,是业务走向国际化的必经之路,同时在内销服务和外销服务共存的场景下,做好内外销业务的稳定迭代和快速拓展是走向全球化的必要前提,对于中台业务,项目进行全球共线有着非常重...

OpenClaw 落地到生产实际应用的一种可能的路径

4 月 16 日
阅读 5 分钟
846
作者:vivo 互联网项目团队- Ding Junjie 本文从 Coding Agent 为什么能率先跑通谈起,分析 OpenClaw 若要进入真实生产场景还缺哪些关键能力。核心判断是,要让 Agent 在业务世界稳定落地,必须把开放、分散、难回滚的执行环境,重构成一个可视化、相对封闭、可验证、可恢复的操作空间。

从 OpenClaw 看 Agent 架构设计

4 月 9 日
阅读 13 分钟
2.5k
作者:互联网搜索团队-Wang Wenqian 本文通过对OpenClaw,Claude Code等主流Agent产品的设计进行分析,给出Agent架构设计的关键决策,分析各方案的利弊。

CVPR 2026 | C²FG:用分数差异分析提高条件生成中CFG的引导

4 月 2 日
阅读 4 分钟
895
作者: vivo BlueImage Lab 摘要:针对扩散生成中长期使用的固定 CFG scale 机制存在不合理论的假设,该工作从 score 差异随扩散时间衰减的角度首次提出了 时间自适应的指数控制函数(C²FG)。这一 training-free、plug-and-play 引导策略在 DiT、SiT、Stable Diffusion 等多种框架上均稳定带来显著 FID 降低与 IS 提升...

Nanobot(OpenClaw 轻量实现)的底层原理解析

4 月 2 日
阅读 22 分钟
900
作者:vivoAI技术开发团队- Lin Weiwei 本文以精简版 OpenClaw——Nanobot 为切入点,拆解其核心原理。 其本质是基于循环执行的“提示词构建 + 调用大模型 + 工具操作”的本地 Agent 架构。通过分析消息处理、上下文构建、循环决策(AgentLoop)与工具调用(Tools)等流程,揭示其运行机制。

营销自动化数据驱动 - 多源数据 OLAP 架构演进

3 月 26 日
阅读 5 分钟
803
作者: vivo互联网服务器团队- Liu Xianchao 本文基于营销自动化数据驱动场景,分析介绍了Presto+大宽表方案、Bitmap方案、StarRocks方案的架构演进。

ICLR2026 | Ada-RefSR: 自适应隐式相关建模,开启“信而有证”的参考超分新范式

3 月 19 日
阅读 4 分钟
1k
作者: vivo BlueImage Lab 摘要: 我们针对于单步SD的超分模型容易出现幻觉问题,提出了信而有证参考超分新范式,基于单步扩散模型构建,首先通过注意力机制引入参考信息,随后通过隐式相关性建模进行过滤与验证,对应的论文已被 ICLR2026 接收! 该工作由vivo BlueImage Lab,南开大学共同完成。

从业务开发视角聊聊可观测体系建设

3 月 12 日
阅读 5 分钟
1k
作者:vivo 互联网服务器团队- Lei Zezheng 本文探讨了分布式架构下可观测体系的建设实践,提出了基于业务视角的可观测体系建设框架:明确业务核心边界、建立指标体系(业务指标+SLO指标)、构建多维度观测(业务观测、链路观测、异常观测、变更观测)和固化排障路径,以游戏中心项目为例,介绍了项目在问题发现与问题定...

Vibe Coding 之我们距离 “贾维斯” 还有多远

3 月 6 日
阅读 6 分钟
830
作者:vivo 互联网项目团队- Ding Junjie 摘要:作者通过使用Vibe Coding和Claude Code等AI编程工具的实践经验,分享了与AI协作的方法和技巧。文章探讨了当前AI工具与理想中"贾维斯"智能助手的差距,包括缺少持续记忆、意图理解需反复对齐、决策点过于依赖人工等问题。作者提出了通过模板化常见场景、记录决策过程、优化...

ICLR2026 | 视频虚化新突破!Any-to-Bokeh 一键生成电影感连贯效果

3 月 5 日
阅读 3 分钟
814
作者:vivo BlueImage Lab本文入选 ICLR 2026ICLR (International Conference on Learning Representations)是聚焦机器学习与深度学习等领域的国际顶级学术会议,致力于推动人工智能理论与方法的前沿研究与创新发展。ICLR 2026 约19000篇投稿,接收率约28.18%。

深度解析悟空系统多机房部署共线改造

2 月 26 日
阅读 11 分钟
1.4k
作者:vivo 互联网前端团队- Fang Liangliang 多地区销量持续增长、业务运营诉求与日俱增,悟空作为一站式h5搭建平台,需要先发完成多地区化能力改造,基于复用、提效的思路,探索多地区系统方案,实现多地区一体化运作。

游戏中心弱网优化实践

2 月 12 日
阅读 10 分钟
3.6k
作者:vivo 互联网客户端团队- Ke Jie 本实践围绕游戏中心在弱网环境下的性能优化展开,针对复杂网络场景下的页面加载慢、资源加载失败等问题,提出了优化方案:接入支持 QUIC 协议的 Cronet 网络库,通过更快的连接建立与传输特性提升请求响应速度。配合弱网状态精细化判定与限速测试,线上灰度实验显示页面加载失败率...

Chat 模式是和 AI 最好的交互范式吗?

2 月 5 日
阅读 3 分钟
1.2k
作者:vivo 互联网项目团队- Ding Junjie 本文从作者使用AI的实践经验出发,探讨了Chat模式作为AI交互范式的特点和优势。作者提出了"意图信息密度匹配"的核心概念,认为好的AI交互设计本质上都在解决人机意图信息密度匹配问题。通过分析Cursor Tab补全、Granola会议笔记等成功案例,以及对比一键生成模式的局限性,文章...

vivo GPU容器与 AI 训练平台探索与实践

1 月 29 日
阅读 9 分钟
3.2k
作者:互联网容器团队-Chen Han、AI 研发团队 - Liu Dong Yang 在大规模GPU容器集群与模型训练场景,面临稳定性和资源利用率等多重挑战。本文展示vivo GPU平台的总体架构,介绍容器平台在大规模GPU容器集群稳定性建设措施,以及探索多种GPU容器降本提效的解决方案。分享AI工程训练平台大规模训练稳定性建设,及GPU利用率...

vivo互联网全链路多版本环境落地实践

1 月 22 日
阅读 8 分钟
1.3k
作者:互联网效能平台团队-Wu Qinghua 在软件研发过程中,“环境问题”是制约研发效能的关键瓶颈之一。环境不稳定、测试环境混乱、环境抢占严重等问题,显著影响开发与测试效率。本文系统介绍vivo通过“全链路多版本环境管理”模式,实现开发测试环境的快速构建与高效管理,使多版本环境能够像“平行宇宙”一般,实现安全、隔...