{"id":93626,"topic":"ai","source":"infoq.cn","title":"AIGC 驱动的内容生产力变革 --Vidu 多模态大模型的创新与实践｜QCon 上海 - infoq.cn","url":"https://www.infoq.cn/article/OBQpdcB1xURrJMRlrJZ1","url_hash":"5f0997cbd10acf5c6ab7f759e06673cf39c0a345","author":"","summary":"<a href=\"https://news.google.com/rss/articles/CBMiXkFVX3lxTE9fOHlacUwwemFiWUZRWEdfeWgwM1N6VFBrRXNQNjBkek4wZzJuRGVDRXlYVkpHOUdxNzMzSjRQTXZldXQyZ2JtSjE2eUZlVnJwM2dYVmZ3UE1EM1llLVE?oc=5\" target=\"_blank\">AIGC 驱动的内容生产力变革 --Vidu 多模态大模型的创新与实践｜QCon 上海</a>&nbsp;&nbsp;<font color=\"#6f6f6f\">infoq.cn</font>","content":"从「构建 AI」到「驾驭 AI」，100+ 实战案例拆解 AI Native 时代的工程新实践！\n将于 10 月 22 日—24 日举办，聚焦 Harness AI 时代的工程实践，围绕 AI Native 架构、Agent Runtime、AI Infra、Data Systems、Agent 安全与可观测、Loop Engineering、Vibe Coding、具身智能与世界模型、端云协同等前沿技术方向，邀请全球技术社区与产业一线的实践者，系统性分享前沿洞察与实战经验，共同探索 AI 从能力到系统、从实验到生产的真实路径。\n在这一背景下，2026 年 QCon 全球软件开发大会大会 · 上海站正式启动。本次大会将于 10 月 22 日—24 日举办，聚焦 Harness AI 时代的工程实践，围绕 AI Native 架构、Agent Runtime、AI Infra、Data Systems、Agent 安全与可观测、Loop Engineering、Vibe Coding、具身智能与世界模型、端云协同等前沿技术方向，邀请全球技术社区与产业一线的实践者，系统性分享前沿洞察与实战经验，共同探索 AI 从能力到系统、从实验到生产的真实路径。\n生数科技 & 解决方案负责人郑重已确认出席 “AIGC 内容工业化” 专题，并发表题为《AIGC 驱动的内容生产力变革--Vidu 多模态大模型的创新与实践》的主题分享。视频生成模型正在从“生成一段可看的视频”进入更复杂的阶段：它需要在多主体、多镜头、长时序和交互场景下保持一致性、可控性和实时响应能力。这些问题不仅决定了生成效果，也决定了视频 AIGC 能否真正进入专业内容生产和实时互动场景。\n本次分享将围绕视频生成中的关键技术挑战展开，包括角色与场景一致性、参考驱动生成、镜头与叙事控制、流式视频生成以及世界模型方向的探索。分享将结合 Vidu 在模型迭代和场景实践中的技术路径，讨论视频生成模型如何从离线生成工具，逐步演进为可控、可交互、可扩展的内容生产基础能力。\n郑重现任生数科技解决方案负责人，拥有 16 年 AI 大模型、多模态人工智能应用、营销智能领域从业经验，贯通 AI 底层技术体系与产业商业化落地全链路。历任字节跳动解决方案高级总监、百度智能云解决方案副总经理，具备深厚的企业级 AI 场景落地与产业服务经验。\n作为资深多模态 AI 领域专家，系统掌握视频生成大模型底层架构原理，深耕帧间一致性、推理加速、跨模态对齐等 AIGC 核心技术体系，具备通用多模态大模型全局技术认知与行业研判能力。立足各产业数字化升级的核心诉求，打造兼具技术创新性与场景适配性的 AIGC 产业解决方案。长期为英特尔、可口可乐、耐克、宝洁、联合利华、宝马等国际头部企业提供深度定制化 AI 服务，实现社交数字人、智能营销素材、AI 影视短剧工业化生成等场景的规模化落地。依托自研多模态视频大模型技术底座，构建稳定、高效、可规模化的 AIGC 内容生产体系，以前沿 AI 技术推动全域内容产业生产力与生产范式革新。他在本次会议的详细演讲内容如下：\n演讲大纲\n1. 视频生成模型面临的关键挑战：\n从图像生成到视频生成，难点不只是增加时间维度，而是如何在连续画面中保持主体、场景、动作、风格和叙事逻辑的一致。分享将首先拆解当前视频生成在多主体一致性、长时序稳定性、动作控制、镜头语言和实时响应方面的主要瓶颈。\n2. 一致性：从随机生成到参考驱动生成\n视频内容生产需要模型稳定复现角色、商品、场景和风格。分享将介绍参考生视频、参考生图、主体保持等能力所解决的问题，以及它们如何降低多镜头、多场景创作中的断裂感。\n3. 可控性：从画面生成到镜头与叙事控制\n专业视频创作并不只是生成画面，还需要理解剧本、角色关系、情绪变化、动作节奏和镜头调度。分享将结合 AI 剧创作场景，讨论模型如何完成脚本理解、智能分镜、运镜规划和多镜头一致性控制。\n4. 实时性：从离线生成到流式交互\n传统视频生成通常是输入提示词后等待结果，难以支撑实时互动体验。分享将介绍 Vidu S1 流式视频生成模型的方向，重点讨论秒级响应、无限互动时长、双向感知、即时指令遵循和多模态输入输出对交互式内容生产的意义。\n5. 从世界生成到世界行动\n视频模型不仅生成画面，也在学习对时空、动作和物理世界的理解。分享将介绍生数科技在世界行动模型方向的探索，讨论视频生成、世界模型与具身智能之间的关系。\n6. 总结：视频 AIGC 的技术演进路径\n回到整体技术路线，总结视频生成模型如何从“可生成”走向“可控生成”，再走向“实时交互”和“世界理解”。\n听众收益\n理解视频生成模型在一致性、可控性、长时序和实时交互上的核心难点。\n了解参考驱动生成、智能分镜、镜头控制、流式生成等能力背后的技术价值。\n获得视频 AIGC 从 Demo 走向专业内容生产场景时需要解决的问题框架。\n看到视频生成模型向世界模型、具身智能方向演进的技术趋势。\n除此之外，本次大会还策划了Loop Engineering、千行百业 Agent 创新实践、Agent 自主进化：从记忆到持续学习、Agent as a Service、Vibe Coding 时代的新质量债、理性驾驭 AI 的 SRE 可靠性工程、金融 AI Native工程实践：从研发提效到业务破局、AI Infra：算力效率决定规模化落地、AI Native 架构等 20 个专题论坛，届时将有来自不同行业、不同领域、不同企业的 100+资深专家在现场带来前沿技术洞察和一线实践经验。\n查看更多详情可扫码或联系票务经理 18514549229 进行咨询。","image_url":"https://static001.infoq.cn/resource/image/47/96/47be681ca83cb093883aa2c7b676ae96.jpg","lang":"zh","published_at":"2026-09-30T12:54:36+00:00","fetched_at":"2026-09-30T15:15:10+00:00","status":"read","starred":0,"extract_state":"ok","summary_auto":"从「构建 AI」到「驾驭 AI」，100+ 实战案例拆解 AI Native 时代的工程新实践！\n将于 10 月 22 日—24 日举办，聚焦 Harness AI 时代的工程实践，围绕 AI Native 架构、Agent Runtime、AI Infra、Data Systems、Agent 安全与可观测、Loop Engineering、Vibe Coding、具身智能与世界模型、端云协同等前沿技术方向，邀请全球技术社区与产业一线的实践者，系统性分享前沿洞察与实战经验，共同探索 AI 从能力到系统、从实验到生产的真实路径。\n在这一背景下，2026 年 QCon 全球软件开发大会大会 · 上海站正式启动。本次大会将于 10 月 22 日—24 日举办，聚焦 Harness AI 时代的工程实践，围绕 AI Native 架构、Agent Runtime、AI Infra、Data Systems、Agent 安全与可观测、Loop Engineering、Vibe Coding、具身智能与世界模型、端云协同等前沿技术方向，邀请全球技术社区与产业一线的实践者，系统性分享前沿洞察与实战经验，共同探索 AI 从能力到系统、从实验到生产的真实路径。\n生数科技 & 解决方案负责人郑重已确认出席 “AIGC 内容工业化” 专题，并发表题为《AIGC 驱动的内容生产力变革--Vidu 多模态大模型的创新与实践》的主题分享。视频生成模型正在从“生成一段可看的视频”进入更复杂的阶段：它需要在多主体、多镜头、长时序和交互场景下保持一致性、可控性和实时响应能力。这些问题不仅决定了生成效果，也决定了视频 AIGC 能否真正进入专业内容生产和实时互动场景。\n本次分享将围绕视频生成中的关键技术挑战展开，包括角色与场景一致性、参考驱动生成、镜头与叙事控制、流式视频生成以及世界模型方向的探索。分享将结合 Vidu 在模型迭代和场景实践中的技术路径，讨论视频生成模型如何从离线生成工具，逐步演进为可控、可交互、可扩展的内容生产基础能力。\n郑重现任生数科技解决方案负责人，拥有 16 年 AI 大模型、多模态人工智能应用、营销智能领域从业经验，贯通 AI 底层技术体系与产业商业化落地全链路。历任字节跳动解决方案高级总监、百度智能云解决方案副总经理，具备深厚的企业级 AI 场景落地与产业服务经验。\n作为资深多模态 AI 领域专家，系统掌握视频生成大模型底层架构原理，深耕帧间一致性、推理加速、跨模态对齐等 AIGC 核心技术体系，具备通用多模态大模型全局技术认知与行业研判能力。立足各产业数字化升级的核心诉求，打造兼具技术创新性与场景适配性的 AIGC 产业解决方案。长期为英特尔、可口可乐、耐克、宝洁、联合利华、宝马等国际头部企业提供深度定制化 AI 服务，实现社交数字人、智能营销素材、AI 影视短剧工业化生成等场景的规模化落地。依托自研多模态视频大模型技术底座，构建稳定、高效、可规模化的 AIGC 内容生产体系，以前沿 AI 技术推动全域内容产业生产力与生产范式革新。他在本次会议的详细演讲内容如下：\n演讲大纲\n1. 总结：视频 AIGC 的技术演进路径\n回到整体技术路线，总结视频生成模型如何从“可生成”走向“可控生成”，再走向“实时交互”和“世界理解”。\n听众收益\n理解视频生成模型在一致性、可控性、长时序和实时交互上的核心难点。\n了解参考驱动生成、智能分镜、镜头控制、流式生成等能力背后的技术价值。\n获得视频 AIGC 从 Demo 走向专业内容生产场景时需要解决的问题框架。\n看到视频生成模型向世界模型、具身智能方向演进的技术趋势。\n除此之外，本次大会还策划了Loop Engineering、千行百业 Agent 创新实践、Agent 自主进化：从记忆到持续学习、Agent as a Service、Vibe Coding 时代的新质量债、理性驾驭 AI 的 SRE 可靠性工程、金融 AI Native工程实践：从研发提效到业务破局、AI Infra：算力效率决定规模化落地、AI Native 架构等 20 个专题论坛，届时将有来自不同行业、不同领域、不同企业的 100+资深专家在现场带来前沿技术洞察和一线实践经验。\n查看更多详情可扫码或联系票务经理 18514549229 进行咨询。","cluster_id":null,"extract_retries":0,"extract_error":null,"contract_version":"news_item.v1","format_contract_version":"news_item_formats.v1","dedup_url":"https://www.infoq.cn/article/OBQpdcB1xURrJMRlrJZ1","quality_profile":{"profile_version":"extraction_quality.v2","bucket":"high","confidence":0.9,"failure_kind":"none","retryable":false,"retry_after_attempts":0,"reason":"High confidence: full text extraction produced 2353 characters.","operator_guidance":{"severity":"ok","recommended_action":"trust_full_text","next_step":"Use the extracted full text as the primary article source.","operator_label":"Ready","can_retry":false,"can_use_summary":false,"diagnostics_required":false},"content_depth":{"contract_version":"content_depth.v1","category":"full_text","label":"Full text","has_full_text":true,"has_summary":true,"content_length":2353,"summary_length":1805,"usable_text_length":2353,"source_field":"content"},"legacy_collapsed":false,"signals":{"extract_state":"ok","extract_error":null,"extract_retries":0,"content_length":2353,"summary_length":1805}},"news_item":{"id":93626,"canonical_url":"https://www.infoq.cn/article/OBQpdcB1xURrJMRlrJZ1","source_url":"https://www.infoq.cn/article/OBQpdcB1xURrJMRlrJZ1","title":"AIGC 驱动的内容生产力变革 --Vidu 多模态大模型的创新与实践｜QCon 上海 - infoq.cn","source_name":"infoq.cn","author":null,"published_at":"2026-09-30T12:54:36+00:00","locale":"zh","topic":"ai","tags":[],"rss_summary":"<a href=\"https://news.google.com/rss/articles/CBMiXkFVX3lxTE9fOHlacUwwemFiWUZRWEdfeWgwM1N6VFBrRXNQNjBkek4wZzJuRGVDRXlYVkpHOUdxNzMzSjRQTXZldXQyZ2JtSjE2eUZlVnJwM2dYVmZ3UE1EM1llLVE?oc=5\" target=\"_blank\">AIGC 驱动的内容生产力变革 --Vidu 多模态大模型的创新与实践｜QCon 上海</a>&nbsp;&nbsp;<font color=\"#6f6f6f\">infoq.cn</font>","full_text":"从「构建 AI」到「驾驭 AI」，100+ 实战案例拆解 AI Native 时代的工程新实践！\n将于 10 月 22 日—24 日举办，聚焦 Harness AI 时代的工程实践，围绕 AI Native 架构、Agent Runtime、AI Infra、Data Systems、Agent 安全与可观测、Loop Engineering、Vibe Coding、具身智能与世界模型、端云协同等前沿技术方向，邀请全球技术社区与产业一线的实践者，系统性分享前沿洞察与实战经验，共同探索 AI 从能力到系统、从实验到生产的真实路径。\n在这一背景下，2026 年 QCon 全球软件开发大会大会 · 上海站正式启动。本次大会将于 10 月 22 日—24 日举办，聚焦 Harness AI 时代的工程实践，围绕 AI Native 架构、Agent Runtime、AI Infra、Data Systems、Agent 安全与可观测、Loop Engineering、Vibe Coding、具身智能与世界模型、端云协同等前沿技术方向，邀请全球技术社区与产业一线的实践者，系统性分享前沿洞察与实战经验，共同探索 AI 从能力到系统、从实验到生产的真实路径。\n生数科技 & 解决方案负责人郑重已确认出席 “AIGC 内容工业化” 专题，并发表题为《AIGC 驱动的内容生产力变革--Vidu 多模态大模型的创新与实践》的主题分享。视频生成模型正在从“生成一段可看的视频”进入更复杂的阶段：它需要在多主体、多镜头、长时序和交互场景下保持一致性、可控性和实时响应能力。这些问题不仅决定了生成效果，也决定了视频 AIGC 能否真正进入专业内容生产和实时互动场景。\n本次分享将围绕视频生成中的关键技术挑战展开，包括角色与场景一致性、参考驱动生成、镜头与叙事控制、流式视频生成以及世界模型方向的探索。分享将结合 Vidu 在模型迭代和场景实践中的技术路径，讨论视频生成模型如何从离线生成工具，逐步演进为可控、可交互、可扩展的内容生产基础能力。\n郑重现任生数科技解决方案负责人，拥有 16 年 AI 大模型、多模态人工智能应用、营销智能领域从业经验，贯通 AI 底层技术体系与产业商业化落地全链路。历任字节跳动解决方案高级总监、百度智能云解决方案副总经理，具备深厚的企业级 AI 场景落地与产业服务经验。\n作为资深多模态 AI 领域专家，系统掌握视频生成大模型底层架构原理，深耕帧间一致性、推理加速、跨模态对齐等 AIGC 核心技术体系，具备通用多模态大模型全局技术认知与行业研判能力。立足各产业数字化升级的核心诉求，打造兼具技术创新性与场景适配性的 AIGC 产业解决方案。长期为英特尔、可口可乐、耐克、宝洁、联合利华、宝马等国际头部企业提供深度定制化 AI 服务，实现社交数字人、智能营销素材、AI 影视短剧工业化生成等场景的规模化落地。依托自研多模态视频大模型技术底座，构建稳定、高效、可规模化的 AIGC 内容生产体系，以前沿 AI 技术推动全域内容产业生产力与生产范式革新。他在本次会议的详细演讲内容如下：\n演讲大纲\n1. 视频生成模型面临的关键挑战：\n从图像生成到视频生成，难点不只是增加时间维度，而是如何在连续画面中保持主体、场景、动作、风格和叙事逻辑的一致。分享将首先拆解当前视频生成在多主体一致性、长时序稳定性、动作控制、镜头语言和实时响应方面的主要瓶颈。\n2. 一致性：从随机生成到参考驱动生成\n视频内容生产需要模型稳定复现角色、商品、场景和风格。分享将介绍参考生视频、参考生图、主体保持等能力所解决的问题，以及它们如何降低多镜头、多场景创作中的断裂感。\n3. 可控性：从画面生成到镜头与叙事控制\n专业视频创作并不只是生成画面，还需要理解剧本、角色关系、情绪变化、动作节奏和镜头调度。分享将结合 AI 剧创作场景，讨论模型如何完成脚本理解、智能分镜、运镜规划和多镜头一致性控制。\n4. 实时性：从离线生成到流式交互\n传统视频生成通常是输入提示词后等待结果，难以支撑实时互动体验。分享将介绍 Vidu S1 流式视频生成模型的方向，重点讨论秒级响应、无限互动时长、双向感知、即时指令遵循和多模态输入输出对交互式内容生产的意义。\n5. 从世界生成到世界行动\n视频模型不仅生成画面，也在学习对时空、动作和物理世界的理解。分享将介绍生数科技在世界行动模型方向的探索，讨论视频生成、世界模型与具身智能之间的关系。\n6. 总结：视频 AIGC 的技术演进路径\n回到整体技术路线，总结视频生成模型如何从“可生成”走向“可控生成”，再走向“实时交互”和“世界理解”。\n听众收益\n理解视频生成模型在一致性、可控性、长时序和实时交互上的核心难点。\n了解参考驱动生成、智能分镜、镜头控制、流式生成等能力背后的技术价值。\n获得视频 AIGC 从 Demo 走向专业内容生产场景时需要解决的问题框架。\n看到视频生成模型向世界模型、具身智能方向演进的技术趋势。\n除此之外，本次大会还策划了Loop Engineering、千行百业 Agent 创新实践、Agent 自主进化：从记忆到持续学习、Agent as a Service、Vibe Coding 时代的新质量债、理性驾驭 AI 的 SRE 可靠性工程、金融 AI Native工程实践：从研发提效到业务破局、AI Infra：算力效率决定规模化落地、AI Native 架构等 20 个专题论坛，届时将有来自不同行业、不同领域、不同企业的 100+资深专家在现场带来前沿技术洞察和一线实践经验。\n查看更多详情可扫码或联系票务经理 18514549229 进行咨询。","excerpt":"从「构建 AI」到「驾驭 AI」，100+ 实战案例拆解 AI Native 时代的工程新实践！\n将于 10 月 22 日—24 日举办，聚焦 Harness AI 时代的工程实践，围绕 AI Native 架构、Agent Runtime、AI Infra、Data Systems、Agent 安全与可观测、Loop Engineering、Vibe Coding、具身智能与世界模型、端云协同等前沿技术方向，邀请全球技术社区与产业一线的实践者，系统性分享前沿洞察与实战经验，共同探索 AI 从能力到系统、从实验到生产的真实路径。\n在这一背景下，2026 年 QCon 全球软件开发大会大会 · 上海站正式启动。本次大会将于 10 月 22 日—24 日举办，聚焦 Harness AI 时代的工程实践，围绕 AI Native 架构、Agent Runtime、AI Infra、Data Systems、Agent 安全与可观测、Loop Engineering、Vibe Coding、具身智能与世界模型、端云协同等前沿技术方向，邀请全球技术社区与产业一线的实践者，系统性分享前沿洞察与实战经验，共同探索 AI 从能力到系统、从实验到生产的真实路径。\n生数科技 & 解决方案负责人郑重已确认出席 “AIGC 内容工业化” 专题，并发表题为《AIGC 驱动的内容生产力变革--Vidu 多模态大模型的创新与实践》的主题分享。视频生成模型正在从“生成一段可看的视频”进入更复杂的阶段：它需要在多主体、多镜头、长时序和交互场景下保持一致性、可控性和实时响应能力。这些问题不仅决定了生成效果，也决定了视频 AIGC 能否真正进入专业内容生产和实时互动场景。\n本次分享将围绕视频生成中的关键技术挑战展开，包括角色与场景一致性、参考驱动生成、镜头与叙事控制、流式视频生成以及世界模型方向的探索。分享将结合 Vidu 在模型迭代和场景实践中的技术路径，讨论视频生成模型如何从离线生成工具，逐步演进为可控、可交互、可扩展的内容生产基础能力。\n郑重现任生数科技解决方案负责人，拥有 16 年 AI 大模型、多模态人工智能应用、营销智能领域从业经验，贯通 AI 底层技术体系与产业商业化落地全链路。历任字节跳动解决方案高级总监、百度智能云解决方案副总经理，具备深厚的企业级 AI 场景落地与产业服务经验。\n作为资深多模态 AI 领域专家，系统掌握视频生成大模型底层架构原理，深耕帧间一致性、推理加速、跨模态对齐等 AIGC 核心技术体系，具备通用多模态大模型全局技术认知与行业研判能力。立足各产业数字化升级的核心诉求，打造兼具技术创新性与场景适配性的 AIGC 产业解决方案。长期为英特尔、可口可乐、耐克、宝洁、联合利华、宝马等国际头部企业提供深度定制化 AI 服务，实现社交数字人、智能营销素材、AI 影视短剧工业化生成等场景的规模化落地。依托自研多模态视频大模型技术底座，构建稳定、高效、可规模化的 AIGC 内容生产体系，以前沿 AI 技术推动全域内容产业生产力与生产范式革新。他在本次会议的详细演讲内容如下：\n演讲大纲\n1. 总结：视频 AIGC 的技术演进路径\n回到整体技术路线，总结视频生成模型如何从“可生成”走向“可控生成”，再走向“实时交互”和“世界理解”。\n听众收益\n理解视频生成模型在一致性、可控性、长时序和实时交互上的核心难点。\n了解参考驱动生成、智能分镜、镜头控制、流式生成等能力背后的技术价值。\n获得视频 AIGC 从 Demo 走向专业内容生产场景时需要解决的问题框架。\n看到视频生成模型向世界模型、具身智能方向演进的技术趋势。\n除此之外，本次大会还策划了Loop Engineering、千行百业 Agent 创新实践、Agent 自主进化：从记忆到持续学习、Agent as a Service、Vibe Coding 时代的新质量债、理性驾驭 AI 的 SRE 可靠性工程、金融 AI Native工程实践：从研发提效到业务破局、AI Infra：算力效率决定规模化落地、AI Native 架构等 20 个专题论坛，届时将有来自不同行业、不同领域、不同企业的 100+资深专家在现场带来前沿技术洞察和一线实践经验。\n查看更多详情可扫码或联系票务经理 18514549229 进行咨询。","extraction":{"state":"ok","confidence":0.9,"error":null,"explanation":"High confidence: full text extraction produced 2353 characters.","diagnostics_url":"/api/diagnose?url=https%3A//www.infoq.cn/article/OBQpdcB1xURrJMRlrJZ1","quality_profile":{"profile_version":"extraction_quality.v2","bucket":"high","confidence":0.9,"failure_kind":"none","retryable":false,"retry_after_attempts":0,"reason":"High confidence: full text extraction produced 2353 characters.","operator_guidance":{"severity":"ok","recommended_action":"trust_full_text","next_step":"Use the extracted full text as the primary article source.","operator_label":"Ready","can_retry":false,"can_use_summary":false,"diagnostics_required":false},"content_depth":{"contract_version":"content_depth.v1","category":"full_text","label":"Full text","has_full_text":true,"has_summary":true,"content_length":2353,"summary_length":1805,"usable_text_length":2353,"source_field":"content"},"legacy_collapsed":false,"signals":{"extract_state":"ok","extract_error":null,"extract_retries":0,"content_length":2353,"summary_length":1805}}},"display_formats":["compact","card","full","digest_section","json"]},"daily_stack_record":{"title":"AIGC 驱动的内容生产力变革 --Vidu 多模态大模型的创新与实践｜QCon 上海 - infoq.cn","url":"https://www.infoq.cn/article/OBQpdcB1xURrJMRlrJZ1","summary":"从「构建 AI」到「驾驭 AI」，100+ 实战案例拆解 AI Native 时代的工程新实践！\n将于 10 月 22 日—24 日举办，聚焦 Harness AI 时代的工程实践，围绕 AI Native 架构、Agent Runtime、AI Infra、Data Systems、Agent 安全与可观测、Loop Engineering、Vibe Coding、具身智能与世界模型、端云协同等前沿技术方向，邀请全球技术社区与产业一线的实践者，系统性分享前沿洞察与实战经验，共同探索 AI 从能力到系统、从实验到生产的真实路径。\n在这一背景下，2026 年 QCon 全球软件开发大会大会 · 上海站正式启动。本次大会将于 10 月 22 日—24 日举办，聚焦 Harness AI 时代的工程实践，围绕 AI Native 架构、Agent Runtime、AI Infra、Data Systems、Agent 安全与可观测、Loop Engineering、Vibe Coding、具身智能与世界模型、端云协同等前沿技术方向，邀请全球技术社区与产业一线的实践者，系统性分享前沿洞察与实战经验，共同探索 AI 从能力到系统、从实验到生产的真实路径。\n生数科技 & 解决方案负责人郑重已确认出席 “AIGC 内容工业化” 专题，并发表题为《AIGC 驱动的内容生产力变革--Vidu 多模态大模型的创新与实践》的主题分享。视频生成模型正在从“生成一段可看的视频”进入更复杂的阶段：它需要在多主体、多镜头、长时序和交互场景下保持一致性、可控性和实时响应能力。这些问题不仅决定了生成效果，也决定了视频 AIGC 能否真正进入专业内容生产和实时互动场景。\n本次分享将围绕视频生成中的关键技术挑战展开，包括角色与场景一致性、参考驱动生成、镜头与叙事控制、流式视频生成以及世界模型方向的探索。分享将结合 Vidu 在模型迭代和场景实践中的技术路径，讨论视频生成模型如何从离线生成工具，逐步演进为可控、可交互、可扩展的内容生产基础能力。\n郑重现任生数科技解决方案负责人，拥有 16 年 AI 大模型、多模态人工智能应用、营销智能领域从业经验，贯通 AI 底层技术体系与产业商业化落地全链路。历任字节跳动解决方案高级总监、百度智能云解决方案副总经理，具备深厚的企业级 AI 场景落地与产业服务经验。\n作为资深多模态 AI 领域专家，系统掌握视频生成大模型底层架构原理，深耕帧间一致性、推理加速、跨模态对齐等 AIGC 核心技术体系，具备通用多模态大模型全局技术认知与行业研判能力。立足各产业数字化升级的核心诉求，打造兼具技术创新性与场景适配性的 AIGC 产业解决方案。长期为英特尔、可口可乐、耐克、宝洁、联合利华、宝马等国际头部企业提供深度定制化 AI 服务，实现社交数字人、智能营销素材、AI 影视短剧工业化生成等场景的规模化落地。依托自研多模态视频大模型技术底座，构建稳定、高效、可规模化的 AIGC 内容生产体系，以前沿 AI 技术推动全域内容产业生产力与生产范式革新。他在本次会议的详细演讲内容如下：\n演讲大纲\n1. 总结：视频 AIGC 的技术演进路径\n回到整体技术路线，总结视频生成模型如何从“可生成”走向“可控生成”，再走向“实时交互”和“世界理解”。\n听众收益\n理解视频生成模型在一致性、可控性、长时序和实时交互上的核心难点。\n了解参考驱动生成、智能分镜、镜头控制、流式生成等能力背后的技术价值。\n获得视频 AIGC 从 Demo 走向专业内容生产场景时需要解决的问题框架。\n看到视频生成模型向世界模型、具身智能方向演进的技术趋势。\n除此之外，本次大会还策划了Loop Engineering、千行百业 Agent 创新实践、Agent 自主进化：从记忆到持续学习、Agent as a Service、Vibe Coding 时代的新质量债、理性驾驭 AI 的 SRE 可靠性工程、金融 AI Native工程实践：从研发提效到业务破局、AI Infra：算力效率决定规模化落地、AI Native 架构等 20 个专题论坛，届时将有来自不同行业、不同领域、不同企业的 100+资深专家在现场带来前沿技术洞察和一线实践经验。\n查看更多详情可扫码或联系票务经理 18514549229 进行咨询。","source":"infoq.cn","date":"2026-09-30T12:54:36+00:00","content":"从「构建 AI」到「驾驭 AI」，100+ 实战案例拆解 AI Native 时代的工程新实践！\n将于 10 月 22 日—24 日举办，聚焦 Harness AI 时代的工程实践，围绕 AI Native 架构、Agent Runtime、AI Infra、Data Systems、Agent 安全与可观测、Loop Engineering、Vibe Coding、具身智能与世界模型、端云协同等前沿技术方向，邀请全球技术社区与产业一线的实践者，系统性分享前沿洞察与实战经验，共同探索 AI 从能力到系统、从实验到生产的真实路径。\n在这一背景下，2026 年 QCon 全球软件开发大会大会 · 上海站正式启动。本次大会将于 10 月 22 日—24 日举办，聚焦 Harness AI 时代的工程实践，围绕 AI Native 架构、Agent Runtime、AI Infra、Data Systems、Agent 安全与可观测、Loop Engineering、Vibe Coding、具身智能与世界模型、端云协同等前沿技术方向，邀请全球技术社区与产业一线的实践者，系统性分享前沿洞察与实战经验，共同探索 AI 从能力到系统、从实验到生产的真实路径。\n生数科技 & 解决方案负责人郑重已确认出席 “AIGC 内容工业化” 专题，并发表题为《AIGC 驱动的内容生产力变革--Vidu 多模态大模型的创新与实践》的主题分享。视频生成模型正在从“生成一段可看的视频”进入更复杂的阶段：它需要在多主体、多镜头、长时序和交互场景下保持一致性、可控性和实时响应能力。这些问题不仅决定了生成效果，也决定了视频 AIGC 能否真正进入专业内容生产和实时互动场景。\n本次分享将围绕视频生成中的关键技术挑战展开，包括角色与场景一致性、参考驱动生成、镜头与叙事控制、流式视频生成以及世界模型方向的探索。分享将结合 Vidu 在模型迭代和场景实践中的技术路径，讨论视频生成模型如何从离线生成工具，逐步演进为可控、可交互、可扩展的内容生产基础能力。\n郑重现任生数科技解决方案负责人，拥有 16 年 AI 大模型、多模态人工智能应用、营销智能领域从业经验，贯通 AI 底层技术体系与产业商业化落地全链路。历任字节跳动解决方案高级总监、百度智能云解决方案副总经理，具备深厚的企业级 AI 场景落地与产业服务经验。\n作为资深多模态 AI 领域专家，系统掌握视频生成大模型底层架构原理，深耕帧间一致性、推理加速、跨模态对齐等 AIGC 核心技术体系，具备通用多模态大模型全局技术认知与行业研判能力。立足各产业数字化升级的核心诉求，打造兼具技术创新性与场景适配性的 AIGC 产业解决方案。长期为英特尔、可口可乐、耐克、宝洁、联合利华、宝马等国际头部企业提供深度定制化 AI 服务，实现社交数字人、智能营销素材、AI 影视短剧工业化生成等场景的规模化落地。依托自研多模态视频大模型技术底座，构建稳定、高效、可规模化的 AIGC 内容生产体系，以前沿 AI 技术推动全域内容产业生产力与生产范式革新。他在本次会议的详细演讲内容如下：\n演讲大纲\n1. 视频生成模型面临的关键挑战：\n从图像生成到视频生成，难点不只是增加时间维度，而是如何在连续画面中保持主体、场景、动作、风格和叙事逻辑的一致。分享将首先拆解当前视频生成在多主体一致性、长时序稳定性、动作控制、镜头语言和实时响应方面的主要瓶颈。\n2. 一致性：从随机生成到参考驱动生成\n视频内容生产需要模型稳定复现角色、商品、场景和风格。分享将介绍参考生视频、参考生图、主体保持等能力所解决的问题，以及它们如何降低多镜头、多场景创作中的断裂感。\n3. 可控性：从画面生成到镜头与叙事控制\n专业视频创作并不只是生成画面，还需要理解剧本、角色关系、情绪变化、动作节奏和镜头调度。分享将结合 AI 剧创作场景，讨论模型如何完成脚本理解、智能分镜、运镜规划和多镜头一致性控制。\n4. 实时性：从离线生成到流式交互\n传统视频生成通常是输入提示词后等待结果，难以支撑实时互动体验。分享将介绍 Vidu S1 流式视频生成模型的方向，重点讨论秒级响应、无限互动时长、双向感知、即时指令遵循和多模态输入输出对交互式内容生产的意义。\n5. 从世界生成到世界行动\n视频模型不仅生成画面，也在学习对时空、动作和物理世界的理解。分享将介绍生数科技在世界行动模型方向的探索，讨论视频生成、世界模型与具身智能之间的关系。\n6. 总结：视频 AIGC 的技术演进路径\n回到整体技术路线，总结视频生成模型如何从“可生成”走向“可控生成”，再走向“实时交互”和“世界理解”。\n听众收益\n理解视频生成模型在一致性、可控性、长时序和实时交互上的核心难点。\n了解参考驱动生成、智能分镜、镜头控制、流式生成等能力背后的技术价值。\n获得视频 AIGC 从 Demo 走向专业内容生产场景时需要解决的问题框架。\n看到视频生成模型向世界模型、具身智能方向演进的技术趋势。\n除此之外，本次大会还策划了Loop Engineering、千行百业 Agent 创新实践、Agent 自主进化：从记忆到持续学习、Agent as a Service、Vibe Coding 时代的新质量债、理性驾驭 AI 的 SRE 可靠性工程、金融 AI Native工程实践：从研发提效到业务破局、AI Infra：算力效率决定规模化落地、AI Native 架构等 20 个专题论坛，届时将有来自不同行业、不同领域、不同企业的 100+资深专家在现场带来前沿技术洞察和一线实践经验。\n查看更多详情可扫码或联系票务经理 18514549229 进行咨询。","confidence":0.9,"diagnostics_url":"/api/diagnose?url=https%3A//www.infoq.cn/article/OBQpdcB1xURrJMRlrJZ1","quality_bucket":"high","failure_kind":"none","retryable":false,"quality_reason":"High confidence: full text extraction produced 2353 characters.","quality_profile":{"profile_version":"extraction_quality.v2","bucket":"high","confidence":0.9,"failure_kind":"none","retryable":false,"retry_after_attempts":0,"reason":"High confidence: full text extraction produced 2353 characters.","operator_guidance":{"severity":"ok","recommended_action":"trust_full_text","next_step":"Use the extracted full text as the primary article source.","operator_label":"Ready","can_retry":false,"can_use_summary":false,"diagnostics_required":false},"content_depth":{"contract_version":"content_depth.v1","category":"full_text","label":"Full text","has_full_text":true,"has_summary":true,"content_length":2353,"summary_length":1805,"usable_text_length":2353,"source_field":"content"},"legacy_collapsed":false,"signals":{"extract_state":"ok","extract_error":null,"extract_retries":0,"content_length":2353,"summary_length":1805}},"tags":[]},"fallback_formats":["markdown","json","html"],"actions":{"read":"/item/93626","export_markdown":"/api/items/93626/export?format=markdown","export_json":"/api/items/93626/export?format=json","diagnose":"/api/diagnose?url=https%3A//www.infoq.cn/article/OBQpdcB1xURrJMRlrJZ1"},"formats":{"full":{"id":93626,"title":"AIGC 驱动的内容生产力变革 --Vidu 多模态大模型的创新与实践｜QCon 上海 - infoq.cn","url":"https://www.infoq.cn/article/OBQpdcB1xURrJMRlrJZ1","source":"infoq.cn","author":null,"published_at":"2026-09-30T12:54:36+00:00","locale":"zh","topic":"ai","tags":[],"excerpt":"从「构建 AI」到「驾驭 AI」，100+ 实战案例拆解 AI Native 时代的工程新实践！\n将于 10 月 22 日—24 日举办，聚焦 Harness AI 时代的工程实践，围绕 AI Native 架构、Agent Runtime、AI Infra、Data Systems、Agent 安全与可观测、Loop Engineering、Vibe Coding、具身智能与世界模型、端云协同等前沿技术方向，邀请全球技术社区与产业一线的实践者，系统性分享前沿洞察与实战经验，共同探索 AI 从能力到系统、从实验到生产的真实路径。\n在这一背景下，2026 年 QCon 全球软件开发大会大会 · 上海站正式启动。本次大会将于 10 月 22 日—24 日举办，聚焦 Harness AI 时代的工程实践，围绕 AI Native 架构、Agent Runtime、AI Infra、Data Systems、Agent 安全与可观测、Loop Engineering、Vibe Coding、具身智能与世界模型、端云协同等前沿技术方向，邀请全球技术社区与产业一线的实践者，系统性分享前沿洞察与实战经验，共同探索 AI 从能力到系统、从实验到生产的真实路径。\n生数科技 & 解决方案负责人郑重已确认出席 “AIGC 内容工业化” 专题，并发表题为《AIGC 驱动的内容生产力变革--Vidu 多模态大模型的创新与实践》的主题分享。视频生成模型正在从“生成一段可看的视频”进入更复杂的阶段：它需要在多主体、多镜头、长时序和交互场景下保持一致性、可控性和实时响应能力。这些问题不仅决定了生成效果，也决定了视频 AIGC 能否真正进入专业内容生产和实时互动场景。\n本次分享将围绕视频生成中的关键技术挑战展开，包括角色与场景一致性、参考驱动生成、镜头与叙事控制、流式视频生成以及世界模型方向的探索。分享将结合 Vidu 在模型迭代和场景实践中的技术路径，讨论视频生成模型如何从离线生成工具，逐步演进为可控、可交互、可扩展的内容生产基础能力。\n郑重现任生数科技解决方案负责人，拥有 16 年 AI 大模型、多模态人工智能应用、营销智能领域从业经验，贯通 AI 底层技术体系与产业商业化落地全链路。历任字节跳动解决方案高级总监、百度智能云解决方案副总经理，具备深厚的企业级 AI 场景落地与产业服务经验。\n作为资深多模态 AI 领域专家，系统掌握视频生成大模型底层架构原理，深耕帧间一致性、推理加速、跨模态对齐等 AIGC 核心技术体系，具备通用多模态大模型全局技术认知与行业研判能力。立足各产业数字化升级的核心诉求，打造兼具技术创新性与场景适配性的 AIGC 产业解决方案。长期为英特尔、可口可乐、耐克、宝洁、联合利华、宝马等国际头部企业提供深度定制化 AI 服务，实现社交数字人、智能营销素材、AI 影视短剧工业化生成等场景的规模化落地。依托自研多模态视频大模型技术底座，构建稳定、高效、可规模化的 AIGC 内容生产体系，以前沿 AI 技术推动全域内容产业生产力与生产范式革新。他在本次会议的详细演讲内容如下：\n演讲大纲\n1. 总结：视频 AIGC 的技术演进路径\n回到整体技术路线，总结视频生成模型如何从“可生成”走向“可控生成”，再走向“实时交互”和“世界理解”。\n听众收益\n理解视频生成模型在一致性、可控性、长时序和实时交互上的核心难点。\n了解参考驱动生成、智能分镜、镜头控制、流式生成等能力背后的技术价值。\n获得视频 AIGC 从 Demo 走向专业内容生产场景时需要解决的问题框架。\n看到视频生成模型向世界模型、具身智能方向演进的技术趋势。\n除此之外，本次大会还策划了Loop Engineering、千行百业 Agent 创新实践、Agent 自主进化：从记忆到持续学习、Agent as a Service、Vibe Coding 时代的新质量债、理性驾驭 AI 的 SRE 可靠性工程、金融 AI Native工程实践：从研发提效到业务破局、AI Infra：算力效率决定规模化落地、AI Native 架构等 20 个专题论坛，届时将有来自不同行业、不同领域、不同企业的 100+资深专家在现场带来前沿技术洞察和一线实践经验。\n查看更多详情可扫码或联系票务经理 18514549229 进行咨询。","full_text":"从「构建 AI」到「驾驭 AI」，100+ 实战案例拆解 AI Native 时代的工程新实践！\n将于 10 月 22 日—24 日举办，聚焦 Harness AI 时代的工程实践，围绕 AI Native 架构、Agent Runtime、AI Infra、Data Systems、Agent 安全与可观测、Loop Engineering、Vibe Coding、具身智能与世界模型、端云协同等前沿技术方向，邀请全球技术社区与产业一线的实践者，系统性分享前沿洞察与实战经验，共同探索 AI 从能力到系统、从实验到生产的真实路径。\n在这一背景下，2026 年 QCon 全球软件开发大会大会 · 上海站正式启动。本次大会将于 10 月 22 日—24 日举办，聚焦 Harness AI 时代的工程实践，围绕 AI Native 架构、Agent Runtime、AI Infra、Data Systems、Agent 安全与可观测、Loop Engineering、Vibe Coding、具身智能与世界模型、端云协同等前沿技术方向，邀请全球技术社区与产业一线的实践者，系统性分享前沿洞察与实战经验，共同探索 AI 从能力到系统、从实验到生产的真实路径。\n生数科技 & 解决方案负责人郑重已确认出席 “AIGC 内容工业化” 专题，并发表题为《AIGC 驱动的内容生产力变革--Vidu 多模态大模型的创新与实践》的主题分享。视频生成模型正在从“生成一段可看的视频”进入更复杂的阶段：它需要在多主体、多镜头、长时序和交互场景下保持一致性、可控性和实时响应能力。这些问题不仅决定了生成效果，也决定了视频 AIGC 能否真正进入专业内容生产和实时互动场景。\n本次分享将围绕视频生成中的关键技术挑战展开，包括角色与场景一致性、参考驱动生成、镜头与叙事控制、流式视频生成以及世界模型方向的探索。分享将结合 Vidu 在模型迭代和场景实践中的技术路径，讨论视频生成模型如何从离线生成工具，逐步演进为可控、可交互、可扩展的内容生产基础能力。\n郑重现任生数科技解决方案负责人，拥有 16 年 AI 大模型、多模态人工智能应用、营销智能领域从业经验，贯通 AI 底层技术体系与产业商业化落地全链路。历任字节跳动解决方案高级总监、百度智能云解决方案副总经理，具备深厚的企业级 AI 场景落地与产业服务经验。\n作为资深多模态 AI 领域专家，系统掌握视频生成大模型底层架构原理，深耕帧间一致性、推理加速、跨模态对齐等 AIGC 核心技术体系，具备通用多模态大模型全局技术认知与行业研判能力。立足各产业数字化升级的核心诉求，打造兼具技术创新性与场景适配性的 AIGC 产业解决方案。长期为英特尔、可口可乐、耐克、宝洁、联合利华、宝马等国际头部企业提供深度定制化 AI 服务，实现社交数字人、智能营销素材、AI 影视短剧工业化生成等场景的规模化落地。依托自研多模态视频大模型技术底座，构建稳定、高效、可规模化的 AIGC 内容生产体系，以前沿 AI 技术推动全域内容产业生产力与生产范式革新。他在本次会议的详细演讲内容如下：\n演讲大纲\n1. 视频生成模型面临的关键挑战：\n从图像生成到视频生成，难点不只是增加时间维度，而是如何在连续画面中保持主体、场景、动作、风格和叙事逻辑的一致。分享将首先拆解当前视频生成在多主体一致性、长时序稳定性、动作控制、镜头语言和实时响应方面的主要瓶颈。\n2. 一致性：从随机生成到参考驱动生成\n视频内容生产需要模型稳定复现角色、商品、场景和风格。分享将介绍参考生视频、参考生图、主体保持等能力所解决的问题，以及它们如何降低多镜头、多场景创作中的断裂感。\n3. 可控性：从画面生成到镜头与叙事控制\n专业视频创作并不只是生成画面，还需要理解剧本、角色关系、情绪变化、动作节奏和镜头调度。分享将结合 AI 剧创作场景，讨论模型如何完成脚本理解、智能分镜、运镜规划和多镜头一致性控制。\n4. 实时性：从离线生成到流式交互\n传统视频生成通常是输入提示词后等待结果，难以支撑实时互动体验。分享将介绍 Vidu S1 流式视频生成模型的方向，重点讨论秒级响应、无限互动时长、双向感知、即时指令遵循和多模态输入输出对交互式内容生产的意义。\n5. 从世界生成到世界行动\n视频模型不仅生成画面，也在学习对时空、动作和物理世界的理解。分享将介绍生数科技在世界行动模型方向的探索，讨论视频生成、世界模型与具身智能之间的关系。\n6. 总结：视频 AIGC 的技术演进路径\n回到整体技术路线，总结视频生成模型如何从“可生成”走向“可控生成”，再走向“实时交互”和“世界理解”。\n听众收益\n理解视频生成模型在一致性、可控性、长时序和实时交互上的核心难点。\n了解参考驱动生成、智能分镜、镜头控制、流式生成等能力背后的技术价值。\n获得视频 AIGC 从 Demo 走向专业内容生产场景时需要解决的问题框架。\n看到视频生成模型向世界模型、具身智能方向演进的技术趋势。\n除此之外，本次大会还策划了Loop Engineering、千行百业 Agent 创新实践、Agent 自主进化：从记忆到持续学习、Agent as a Service、Vibe Coding 时代的新质量债、理性驾驭 AI 的 SRE 可靠性工程、金融 AI Native工程实践：从研发提效到业务破局、AI Infra：算力效率决定规模化落地、AI Native 架构等 20 个专题论坛，届时将有来自不同行业、不同领域、不同企业的 100+资深专家在现场带来前沿技术洞察和一线实践经验。\n查看更多详情可扫码或联系票务经理 18514549229 进行咨询。","reading_time_min":1,"extraction":{"state":"ok","confidence":0.9,"error":null,"explanation":"High confidence: full text extraction produced 2353 characters.","diagnostics_url":"/api/diagnose?url=https%3A//www.infoq.cn/article/OBQpdcB1xURrJMRlrJZ1","quality_profile":{"profile_version":"extraction_quality.v2","bucket":"high","confidence":0.9,"failure_kind":"none","retryable":false,"retry_after_attempts":0,"reason":"High confidence: full text extraction produced 2353 characters.","operator_guidance":{"severity":"ok","recommended_action":"trust_full_text","next_step":"Use the extracted full text as the primary article source.","operator_label":"Ready","can_retry":false,"can_use_summary":false,"diagnostics_required":false},"content_depth":{"contract_version":"content_depth.v1","category":"full_text","label":"Full text","has_full_text":true,"has_summary":true,"content_length":2353,"summary_length":1805,"usable_text_length":2353,"source_field":"content"},"legacy_collapsed":false,"signals":{"extract_state":"ok","extract_error":null,"extract_retries":0,"content_length":2353,"summary_length":1805}}},"quality_profile":{"profile_version":"extraction_quality.v2","bucket":"high","confidence":0.9,"failure_kind":"none","retryable":false,"retry_after_attempts":0,"reason":"High confidence: full text extraction produced 2353 characters.","operator_guidance":{"severity":"ok","recommended_action":"trust_full_text","next_step":"Use the extracted full text as the primary article source.","operator_label":"Ready","can_retry":false,"can_use_summary":false,"diagnostics_required":false},"content_depth":{"contract_version":"content_depth.v1","category":"full_text","label":"Full text","has_full_text":true,"has_summary":true,"content_length":2353,"summary_length":1805,"usable_text_length":2353,"source_field":"content"},"legacy_collapsed":false,"signals":{"extract_state":"ok","extract_error":null,"extract_retries":0,"content_length":2353,"summary_length":1805}},"actions":{"read":"/item/93626","export_markdown":"/api/items/93626/export?format=markdown","export_json":"/api/items/93626/export?format=json","diagnose":"/api/diagnose?url=https%3A//www.infoq.cn/article/OBQpdcB1xURrJMRlrJZ1"}},"digest":{"id":93626,"title":"AIGC 驱动的内容生产力变革 --Vidu 多模态大模型的创新与实践｜QCon 上海 - infoq.cn","url":"https://www.infoq.cn/article/OBQpdcB1xURrJMRlrJZ1","source":"infoq.cn","topic":"ai","published_at":"2026-09-30T12:54:36+00:00","excerpt":"从「构建 AI」到「驾驭 AI」，100+ 实战案例拆解 AI Native 时代的工程新实践！ 将于 10 月 22 日—24 日举办，聚焦 Harness AI 时代的工程实践，围绕 AI Native 架构、Agent Runtime、AI Infra、Data Systems、Agent 安全与可观测、Loop Engineering、Vibe Coding、具身智能与世界模型、端云协同等前沿技术方向，邀请全球技术社区与产业一线的实践者，系统性分享前沿洞察与实战经验，共同探索 AI 从能力到系统、从实验到生产的真实路径。 在这一背景下，2026…","quality_bucket":"high","quality_reason":"High confidence: full text extraction produced 2353 characters.","reading_time_min":1,"cluster_id":null},"card":{"display_title":"AIGC 驱动的内容生产力变革 --Vidu 多模态大模型的创新与实践｜QCon 上海 - infoq.cn","subtitle":"infoq.cn · 2026-09-30","summary":"从「构建 AI」到「驾驭 AI」，100+ 实战案例拆解 AI Native 时代的工程新实践！ 将于 10 月 22 日—24 日举办，聚焦 Harness AI 时代的工程实践，围绕 AI Native 架构、Agent Runtime、AI Infra、Data Systems、Agent 安全与可观测、Loop Engineering、Vibe…","badges":["quality:high"],"links":{"read":"/item/93626","original":"https://www.infoq.cn/article/OBQpdcB1xURrJMRlrJZ1","diagnose":"/api/diagnose?url=https%3A//www.infoq.cn/article/OBQpdcB1xURrJMRlrJZ1"},"quality_warning":null},"export":{"title":"AIGC 驱动的内容生产力变革 --Vidu 多模态大模型的创新与实践｜QCon 上海 - infoq.cn","url":"https://www.infoq.cn/article/OBQpdcB1xURrJMRlrJZ1","summary":"从「构建 AI」到「驾驭 AI」，100+ 实战案例拆解 AI Native 时代的工程新实践！\n将于 10 月 22 日—24 日举办，聚焦 Harness AI 时代的工程实践，围绕 AI Native 架构、Agent Runtime、AI Infra、Data Systems、Agent 安全与可观测、Loop Engineering、Vibe Coding、具身智能与世界模型、端云协同等前沿技术方向，邀请全球技术社区与产业一线的实践者，系统性分享前沿洞察与实战经验，共同探索 AI 从能力到系统、从实验到生产的真实路径。\n在这一背景下，2026 年 QCon 全球软件开发大会大会 · 上海站正式启动。本次大会将于 10 月 22 日—24 日举办，聚焦 Harness AI 时代的工程实践，围绕 AI Native 架构、Agent Runtime、AI Infra、Data Systems、Agent 安全与可观测、Loop Engineering、Vibe Coding、具身智能与世界模型、端云协同等前沿技术方向，邀请全球技术社区与产业一线的实践者，系统性分享前沿洞察与实战经验，共同探索 AI 从能力到系统、从实验到生产的真实路径。\n生数科技 & 解决方案负责人郑重已确认出席 “AIGC 内容工业化” 专题，并发表题为《AIGC 驱动的内容生产力变革--Vidu 多模态大模型的创新与实践》的主题分享。视频生成模型正在从“生成一段可看的视频”进入更复杂的阶段：它需要在多主体、多镜头、长时序和交互场景下保持一致性、可控性和实时响应能力。这些问题不仅决定了生成效果，也决定了视频 AIGC 能否真正进入专业内容生产和实时互动场景。\n本次分享将围绕视频生成中的关键技术挑战展开，包括角色与场景一致性、参考驱动生成、镜头与叙事控制、流式视频生成以及世界模型方向的探索。分享将结合 Vidu 在模型迭代和场景实践中的技术路径，讨论视频生成模型如何从离线生成工具，逐步演进为可控、可交互、可扩展的内容生产基础能力。\n郑重现任生数科技解决方案负责人，拥有 16 年 AI 大模型、多模态人工智能应用、营销智能领域从业经验，贯通 AI 底层技术体系与产业商业化落地全链路。历任字节跳动解决方案高级总监、百度智能云解决方案副总经理，具备深厚的企业级 AI 场景落地与产业服务经验。\n作为资深多模态 AI 领域专家，系统掌握视频生成大模型底层架构原理，深耕帧间一致性、推理加速、跨模态对齐等 AIGC 核心技术体系，具备通用多模态大模型全局技术认知与行业研判能力。立足各产业数字化升级的核心诉求，打造兼具技术创新性与场景适配性的 AIGC 产业解决方案。长期为英特尔、可口可乐、耐克、宝洁、联合利华、宝马等国际头部企业提供深度定制化 AI 服务，实现社交数字人、智能营销素材、AI 影视短剧工业化生成等场景的规模化落地。依托自研多模态视频大模型技术底座，构建稳定、高效、可规模化的 AIGC 内容生产体系，以前沿 AI 技术推动全域内容产业生产力与生产范式革新。他在本次会议的详细演讲内容如下：\n演讲大纲\n1. 总结：视频 AIGC 的技术演进路径\n回到整体技术路线，总结视频生成模型如何从“可生成”走向“可控生成”，再走向“实时交互”和“世界理解”。\n听众收益\n理解视频生成模型在一致性、可控性、长时序和实时交互上的核心难点。\n了解参考驱动生成、智能分镜、镜头控制、流式生成等能力背后的技术价值。\n获得视频 AIGC 从 Demo 走向专业内容生产场景时需要解决的问题框架。\n看到视频生成模型向世界模型、具身智能方向演进的技术趋势。\n除此之外，本次大会还策划了Loop Engineering、千行百业 Agent 创新实践、Agent 自主进化：从记忆到持续学习、Agent as a Service、Vibe Coding 时代的新质量债、理性驾驭 AI 的 SRE 可靠性工程、金融 AI Native工程实践：从研发提效到业务破局、AI Infra：算力效率决定规模化落地、AI Native 架构等 20 个专题论坛，届时将有来自不同行业、不同领域、不同企业的 100+资深专家在现场带来前沿技术洞察和一线实践经验。\n查看更多详情可扫码或联系票务经理 18514549229 进行咨询。","source":"infoq.cn","date":"2026-09-30T12:54:36+00:00","content":"从「构建 AI」到「驾驭 AI」，100+ 实战案例拆解 AI Native 时代的工程新实践！\n将于 10 月 22 日—24 日举办，聚焦 Harness AI 时代的工程实践，围绕 AI Native 架构、Agent Runtime、AI Infra、Data Systems、Agent 安全与可观测、Loop Engineering、Vibe Coding、具身智能与世界模型、端云协同等前沿技术方向，邀请全球技术社区与产业一线的实践者，系统性分享前沿洞察与实战经验，共同探索 AI 从能力到系统、从实验到生产的真实路径。\n在这一背景下，2026 年 QCon 全球软件开发大会大会 · 上海站正式启动。本次大会将于 10 月 22 日—24 日举办，聚焦 Harness AI 时代的工程实践，围绕 AI Native 架构、Agent Runtime、AI Infra、Data Systems、Agent 安全与可观测、Loop Engineering、Vibe Coding、具身智能与世界模型、端云协同等前沿技术方向，邀请全球技术社区与产业一线的实践者，系统性分享前沿洞察与实战经验，共同探索 AI 从能力到系统、从实验到生产的真实路径。\n生数科技 & 解决方案负责人郑重已确认出席 “AIGC 内容工业化” 专题，并发表题为《AIGC 驱动的内容生产力变革--Vidu 多模态大模型的创新与实践》的主题分享。视频生成模型正在从“生成一段可看的视频”进入更复杂的阶段：它需要在多主体、多镜头、长时序和交互场景下保持一致性、可控性和实时响应能力。这些问题不仅决定了生成效果，也决定了视频 AIGC 能否真正进入专业内容生产和实时互动场景。\n本次分享将围绕视频生成中的关键技术挑战展开，包括角色与场景一致性、参考驱动生成、镜头与叙事控制、流式视频生成以及世界模型方向的探索。分享将结合 Vidu 在模型迭代和场景实践中的技术路径，讨论视频生成模型如何从离线生成工具，逐步演进为可控、可交互、可扩展的内容生产基础能力。\n郑重现任生数科技解决方案负责人，拥有 16 年 AI 大模型、多模态人工智能应用、营销智能领域从业经验，贯通 AI 底层技术体系与产业商业化落地全链路。历任字节跳动解决方案高级总监、百度智能云解决方案副总经理，具备深厚的企业级 AI 场景落地与产业服务经验。\n作为资深多模态 AI 领域专家，系统掌握视频生成大模型底层架构原理，深耕帧间一致性、推理加速、跨模态对齐等 AIGC 核心技术体系，具备通用多模态大模型全局技术认知与行业研判能力。立足各产业数字化升级的核心诉求，打造兼具技术创新性与场景适配性的 AIGC 产业解决方案。长期为英特尔、可口可乐、耐克、宝洁、联合利华、宝马等国际头部企业提供深度定制化 AI 服务，实现社交数字人、智能营销素材、AI 影视短剧工业化生成等场景的规模化落地。依托自研多模态视频大模型技术底座，构建稳定、高效、可规模化的 AIGC 内容生产体系，以前沿 AI 技术推动全域内容产业生产力与生产范式革新。他在本次会议的详细演讲内容如下：\n演讲大纲\n1. 视频生成模型面临的关键挑战：\n从图像生成到视频生成，难点不只是增加时间维度，而是如何在连续画面中保持主体、场景、动作、风格和叙事逻辑的一致。分享将首先拆解当前视频生成在多主体一致性、长时序稳定性、动作控制、镜头语言和实时响应方面的主要瓶颈。\n2. 一致性：从随机生成到参考驱动生成\n视频内容生产需要模型稳定复现角色、商品、场景和风格。分享将介绍参考生视频、参考生图、主体保持等能力所解决的问题，以及它们如何降低多镜头、多场景创作中的断裂感。\n3. 可控性：从画面生成到镜头与叙事控制\n专业视频创作并不只是生成画面，还需要理解剧本、角色关系、情绪变化、动作节奏和镜头调度。分享将结合 AI 剧创作场景，讨论模型如何完成脚本理解、智能分镜、运镜规划和多镜头一致性控制。\n4. 实时性：从离线生成到流式交互\n传统视频生成通常是输入提示词后等待结果，难以支撑实时互动体验。分享将介绍 Vidu S1 流式视频生成模型的方向，重点讨论秒级响应、无限互动时长、双向感知、即时指令遵循和多模态输入输出对交互式内容生产的意义。\n5. 从世界生成到世界行动\n视频模型不仅生成画面，也在学习对时空、动作和物理世界的理解。分享将介绍生数科技在世界行动模型方向的探索，讨论视频生成、世界模型与具身智能之间的关系。\n6. 总结：视频 AIGC 的技术演进路径\n回到整体技术路线，总结视频生成模型如何从“可生成”走向“可控生成”，再走向“实时交互”和“世界理解”。\n听众收益\n理解视频生成模型在一致性、可控性、长时序和实时交互上的核心难点。\n了解参考驱动生成、智能分镜、镜头控制、流式生成等能力背后的技术价值。\n获得视频 AIGC 从 Demo 走向专业内容生产场景时需要解决的问题框架。\n看到视频生成模型向世界模型、具身智能方向演进的技术趋势。\n除此之外，本次大会还策划了Loop Engineering、千行百业 Agent 创新实践、Agent 自主进化：从记忆到持续学习、Agent as a Service、Vibe Coding 时代的新质量债、理性驾驭 AI 的 SRE 可靠性工程、金融 AI Native工程实践：从研发提效到业务破局、AI Infra：算力效率决定规模化落地、AI Native 架构等 20 个专题论坛，届时将有来自不同行业、不同领域、不同企业的 100+资深专家在现场带来前沿技术洞察和一线实践经验。\n查看更多详情可扫码或联系票务经理 18514549229 进行咨询。","confidence":0.9,"diagnostics_url":"/api/diagnose?url=https%3A//www.infoq.cn/article/OBQpdcB1xURrJMRlrJZ1","quality_bucket":"high","failure_kind":"none","retryable":false,"quality_reason":"High confidence: full text extraction produced 2353 characters.","quality_profile":{"profile_version":"extraction_quality.v2","bucket":"high","confidence":0.9,"failure_kind":"none","retryable":false,"retry_after_attempts":0,"reason":"High confidence: full text extraction produced 2353 characters.","operator_guidance":{"severity":"ok","recommended_action":"trust_full_text","next_step":"Use the extracted full text as the primary article source.","operator_label":"Ready","can_retry":false,"can_use_summary":false,"diagnostics_required":false},"content_depth":{"contract_version":"content_depth.v1","category":"full_text","label":"Full text","has_full_text":true,"has_summary":true,"content_length":2353,"summary_length":1805,"usable_text_length":2353,"source_field":"content"},"legacy_collapsed":false,"signals":{"extract_state":"ok","extract_error":null,"extract_retries":0,"content_length":2353,"summary_length":1805}},"tags":[],"format_contract_version":"news_item_formats.v1"}}}