AI视频生成技术解析:从扩散模型原理到Stable Video Diffusion实战部署
最近在技术社区看到不少开发者讨论AI视频生成工具时提到一个有趣的现象一些早期对Sora这类模型持观望甚至质疑态度的人发现它并未如某些预测般“昙花一现”反而在持续迭代和开放测试。这让我联想到技术选型和项目落地中的一个常见心态——对新工具、新框架的“抗议”或抵触有时可能源于对其原理、应用场景和长期价值的认知不足。今天我们不谈商业八卦而是从一名开发者的视角系统性地拆解一下当我们面对一项像“AI视频生成”这样看似颠覆性的技术时该如何超越表面的“惊讶”或“质疑”去理解其背后的技术栈、评估其工程可行性并思考它对我们现有工作流可能带来的实际影响。本文将围绕AI视频生成的核心技术概念、当前主流实现方案、一个简化的本地实验环境搭建以及在实际项目中引入此类技术时需要规避的“坑”和最佳实践进行展开。无论你是对多模态AI感兴趣的后端工程师还是希望在前端集成动态内容的产品开发者都能从中获得一套可操作的评估框架和避坑指南。1. 背景与核心概念从“惊讶”到理解在深入代码之前我们有必要厘清几个基本概念这能帮助我们把对技术趋势的情绪化反应转化为理性的技术评估。1.1 什么是AI视频生成简单来说AI视频生成是指利用深度学习模型根据文本描述Text、静态图像Image或其他模态的输入自动生成一段连贯的视频序列。它与传统的图形渲染或视频剪辑有本质区别其核心是“生成”而非“编辑”模型需要理解时空连续性预测每一帧的像素变化。Sora、Runway Gen-2、Pika等都是这一领域的代表性产品或模型。1.2 核心技术原理简述当前主流方案大多基于扩散模型Diffusion Models的变体并结合了Transformer架构来处理时空信息。扩散模型 通过一个“加噪-去噪”的过程学习数据分布。对于视频模型需要同时在空间单帧图像和时间帧间运动维度上进行扩散和重建。时空注意力机制 这是理解视频生成的关键。模型不仅要关注一幅图像内部各个部分的关系空间注意力还要关注不同帧之间同一物体的运动轨迹和状态变化时间注意力。可以把它想象成模型同时在看一张“时空立方体”。条件控制 为了让生成的视频符合我们的要求需要引入条件信息最常见的就是文本编码通过CLIP等模型将文本转化为向量。更高级的控制还包括深度图、骨骼姿态、参考图像等。1.3 为什么开发者需要关注抛开炒作从工程角度看这项技术可能带来新的可能性内容创作提效 快速生成产品演示、教程视频、社交媒体素材的原型。数据增强 为计算机视觉模型如目标检测、行为识别生成稀缺或难以采集的训练数据。交互式应用 结合游戏引擎或实时渲染创建动态的、由自然语言驱动的虚拟环境或角色。技术储备 理解其原理有助于应对未来可能集成此类能力的云服务或中间件。理解这些我们就不再停留在“它会不会被关停”的层面而是可以思考“它的技术成熟度如何”、“集成成本多高”、“适合我的哪个业务场景”。2. 环境准备与版本说明由于直接运行类似Sora的顶级模型需要巨大的算力资源数千张GPU对于大多数开发者和团队而言并不现实。因此我们的实战将聚焦于一个轻量级的、可在消费级GPU甚至CPU但较慢上运行的开源视频生成模型旨在理解整个技术流程和接口。我们选择Stable Video Diffusion (SVD)它是Stability AI开源的图像到视频生成模型相对易于入门。实验环境说明操作系统 Ubuntu 20.04 / Windows 10 (WSL2推荐) / macOS (仅限CPU推理速度慢)Python版本 3.8 - 3.10深度学习框架 PyTorch 2.0GPU 推荐 NVIDIA GPU显存至少8GB运行SVD-XT版本需要约14GB。显存不足时可尝试量化版本或使用CPU。包管理 使用conda或venv创建独立的Python环境。关键依赖transformers,diffusers,accelerate,opencv-python等。重要提示 以下所有版本和命令均为示例AI领域迭代极快请务必以项目官方GitHub仓库的最新文档为准。本文重点在于演示流程和核心代码逻辑。3. 核心流程与代码拆解一个完整的AI视频生成Pipeline通常包含以下步骤环境配置、模型加载、预处理、推理生成、后处理与保存。我们将结合代码逐一讲解。3.1 创建项目环境与安装依赖首先创建一个干净的项目目录并设置虚拟环境。# 创建项目目录 mkdir ai_video_demo cd ai_video_demo # 创建并激活conda环境以conda为例 conda create -n svd_demo python3.9 -y conda activate svd_demo # 安装PyTorch请根据你的CUDA版本到PyTorch官网获取对应命令 # 例如对于CUDA 11.8 pip install torch torchvision torchaudio --index-url https://download.pytorch.org/whl/cu118 # 安装Diffusers库及其他依赖 pip install diffusers transformers accelerate opencv-python imageio[ffmpeg] pip install -U xformers --index-url https://download.pytorch.org/whl/cu118 # 可选用于优化注意力计算提升速度并降低显存3.2 编写核心生成脚本接下来我们创建一个Python脚本generate_video.py实现从单张图像生成短视频的功能。# generate_video.py import torch from diffusers import StableVideoDiffusionPipeline from diffusers.utils import export_to_video from PIL import Image import argparse def main(): # 1. 参数解析 parser argparse.ArgumentParser(description使用Stable Video Diffusion从图像生成视频。) parser.add_argument(--input_image, typestr, requiredTrue, help输入图像路径) parser.add_argument(--output_video, typestr, defaultgenerated_video.mp4, help输出视频路径) parser.add_argument(--num_frames, typeint, default25, help生成视频的帧数) parser.add_argument(--num_inference_steps, typeint, default25, help去噪步数影响质量与速度) parser.add_argument(--seed, typeint, default42, help随机种子用于复现结果) args parser.parse_args() # 2. 检查设备 device cuda if torch.cuda.is_available() else cpu dtype torch.float16 if device cuda else torch.float32 # GPU上使用半精度节省显存 print(f使用设备: {device}, 数据类型: {dtype}) # 3. 加载模型管道 # 模型ID stabilityai/stable-video-diffusion-img2vid-xt # 首次运行会从Hugging Face Hub下载模型请确保网络通畅。 print(正在加载模型首次加载可能需要几分钟...) pipe StableVideoDiffusionPipeline.from_pretrained( stabilityai/stable-video-diffusion-img2vid-xt, torch_dtypedtype, variantfp16 if dtype torch.float16 else None, ) pipe.to(device) pipe.enable_model_cpu_offload() # 如果显存紧张启用CPU卸载 # 如果安装了xformers可以启用内存高效注意力 try: pipe.enable_xformers_memory_efficient_attention() except: print(xformers未安装或不可用将继续使用标准注意力。) # 4. 加载并预处理输入图像 input_image Image.open(args.input_image) # 模型对输入图像尺寸有要求需要调整 # SVD-XT模型期望输入图像的长边为1024像素且宽高能被64整除 width, height input_image.size max_size 1024 if max(width, height) max_size: scale max_size / max(width, height) new_width int(width * scale) new_height int(height * scale) # 确保能被64整除 new_width (new_width // 64) * 64 new_height (new_height // 64) * 64 input_image input_image.resize((new_width, new_height), Image.Resampling.LANCZOS) print(f调整后图像尺寸: {input_image.size}) # 5. 设置生成参数并推理 generator torch.Generator(devicedevice).manual_seed(args.seed) print(开始生成视频...) frames pipe( input_image, decode_chunk_size8, # 解码块大小影响内存使用 num_framesargs.num_frames, num_inference_stepsargs.num_inference_steps, generatorgenerator, motion_bucket_id127, # 控制运动强度值越大运动越剧烈 noise_aug_strength0.02, # 噪声增强强度影响生成多样性 ).frames[0] # 输出是一个列表取第一个也是唯一一个结果 # 6. 保存视频 print(f视频生成完成正在保存至: {args.output_video}) export_to_video(frames, args.output_video, fps7) # SVD模型通常以7fps生成 print(完成) if __name__ __main__: main()3.3 代码关键点解析模型加载 (StableVideoDiffusionPipeline.from_pretrained): 这是Hugging Facediffusers库的核心抽象它封装了模型、调度器、编码器等所有组件。指定variant“fp16”可以加载半精度权重显著减少GPU显存占用。CPU卸载 (pipe.enable_model_cpu_offload()): 一个非常重要的优化技巧。它会自动将暂时不用的模型子模块移出GPU显存放到CPU内存中需要时再加载回来。这对于在有限显存如8GB上运行大模型至关重要。图像预处理: 模型的输入尺寸有严格要求。直接输入任意尺寸的图片会导致错误或效果不佳。这里我们实现了将图像长边缩放到1024像素并确保宽高是64的倍数。生成参数:num_frames: 生成的视频总帧数。帧数越多视频越长所需显存和计算时间也越多。num_inference_steps: 扩散模型去噪的步数。步数越多生成质量可能越高但速度越慢。25是一个常用的平衡点。motion_bucket_id:这是控制视频“动感”的核心参数。值越大物体在视频中的运动幅度和速度通常越大。需要根据输入图像内容调整。noise_aug_strength: 对输入图像添加的噪声强度。轻微噪声可以增加生成视频的多样性但过大会偏离原图。3.4 运行与验证准备一张清晰的图片例如my_image.jpg在终端中运行脚本python generate_video.py --input_image ./my_image.jpg --output_video ./my_output.mp4 --num_frames 14 --seed 123参数说明:--num_frames 14: 生成14帧的视频对于SVD模型这大约对应2秒7fps。--seed 123: 固定随机种子确保每次运行生成的结果一致便于调试。预期结果: 如果一切顺利你会看到终端中打印模型加载、图像调整、生成过程等信息最终在当前目录下生成一个名为my_output.mp4的视频文件。用播放器打开你应该能看到基于输入图像生成的、带有动态效果的短视频例如水流动、云飘动、镜头轻微移动等。4. 常见问题与排查思路 (FAQ)在实际操作中你几乎一定会遇到各种问题。下面是一个排查清单问题现象可能原因解决思路CUDA out of memory(OOM)GPU显存不足。1.减少num_frames(如从25减到14)。2.启用CPU卸载: 确保调用了pipe.enable_model_cpu_offload()。3.使用半精度: 检查torch_dtypetorch.float16。4.安装xformers: 并启用enable_xformers_memory_efficient_attention()。5.使用更小的模型变体(如果有)。“The size of tensor a (xxx) must match the size of tensor b (yyy)”等形状错误输入图像尺寸不符合模型要求。严格按照代码中的预处理逻辑调整图像尺寸确保宽高能被64整除。可以使用PIL或OpenCV先打印和调整尺寸。生成的视频静止不动或运动怪异motion_bucket_id参数设置不当输入图像内容不适合生成运动。1.调整motion_bucket_id 尝试在50-255范围内调整默认127。值越大运动越强。2.更换输入图像 选择包含自然运动元素水、火、云、烟、行走的人的图片效果更好。纯静态风景或人像特写可能运动不明显。模型下载极慢或失败网络连接Hugging Face Hub不畅。1.使用国内镜像(如阿里云、清华源)。2.手动下载模型文件 到Hugging Face模型页手动下载model.safetensors等文件放到本地目录然后使用from_pretrained(“/your/local/path”)加载。3. 配置环境变量HF_ENDPOINThttps://hf-mirror.com。视频质量差有大量噪声或扭曲num_inference_steps太少模型本身局限性。1.增加num_inference_steps 尝试增加到50步观察质量提升但会显著增加生成时间。2.理解模型边界 当前开源模型在复杂场景、长时序一致性、精细控制上仍有局限需降低预期。在Mac M系列芯片上运行报错或极慢ARM架构兼容性问题未使用MPS后端。1.确保PyTorch是支持MPS的版本。2.将设备指定为mps:device “mps” if torch.backends.mps.is_available() else “cpu”。3. 注意MPS支持仍在完善中可能遇到不稳定情况CPU回退是备选方案。5. 最佳实践与工程化思考将实验性代码转化为可工程化应用需要考虑更多因素1. 资源管理与成本控制推理服务化 在生产环境不应在Web服务器进程中直接加载模型。应使用模型服务化框架如Triton Inference Server, TensorFlow Serving或简单的FastAPI封装将模型部署为独立的服务通过API调用。这便于资源隔离、水平扩展和版本管理。队列与异步处理 视频生成耗时较长数十秒到数分钟必须采用异步任务队列如Celery Redis/RabbitMQ,或Django Q。用户提交请求后立即返回一个任务ID后端异步处理处理完成后通过WebSocket或轮询通知用户。成本监控 监控GPU实例的利用率、推理时长。对于低频需求可以考虑使用Serverless GPU如AWS SageMaker, GCP AI Platform Predictions按需付费避免闲置成本。2. 输入与输出的健壮性处理输入验证 对用户上传的图片进行严格检查文件格式、大小、尺寸、内容安全鉴黄鉴暴。预处理环节缩放、裁剪需要有容错机制。参数边界检查 对用户传入的num_frames,motion_bucket_id等参数设置合理的上下限防止极端参数导致OOM或生成失败。输出标准化 统一输出视频的编码格式如H.264 MP4、分辨率、帧率方便前端播放和后续处理。提供视频缩略图生成功能。3. 性能与质量优化模型量化与蒸馏 研究并使用模型的量化版本INT8可以大幅减少显存占用和提升推理速度对质量损失通常可控。缓存策略 对于热门或重复的生成请求例如同一张经典图片被多次请求生成视频可以将结果缓存到对象存储如S3并设置TTL直接返回缓存结果。A/B测试与参数调优 建立简单的评估流程对不同参数motion_bucket_id,noise_aug_strength生成的结果进行主观或客观评估积累最佳参数组合的经验。4. 伦理、安全与合规内容过滤 必须在Pipeline的输入端集成内容安全过滤器拒绝生成涉及暴力、色情、政治敏感、伪造名人等内容的请求。可以结合商业内容审核API或开源NLP/视觉模型。水印与溯源 考虑在生成的视频中嵌入不可见或可见的数字水印标明其为AI生成便于溯源和防止恶意滥用。用户协议 明确告知用户生成内容的使用权利和限制避免法律纠纷。5. 技术选型评估清单当你的团队考虑引入AI视频生成能力时可以对照以下清单提问需求匹配度 我们的核心需求是“创意原型”、“数据增强”还是“产品功能”现有开源模型的能力是否足够满足集成复杂度 是采用云API如Runway/Stability AI的API还是自建模型服务前者快但成本高、可控性低后者技术挑战大但长期可控。算力储备 我们是否有稳定的GPU算力资源推理的延迟和吞吐量要求是多少团队技能 团队中是否有成员熟悉深度学习模型部署、维护和调试合规风险 业务场景是否存在较高的内容安全风险我们是否有应对方案回到开头的现象一项技术能否持续发展不在于它是否曾引发争议或质疑而在于它是否解决了真实问题、是否构建了足够深的技术壁垒、以及是否有活跃的开发者生态在推动其进步。作为开发者我们的任务不是急于“站队”或“抗议”而是深入技术腹地亲手搭建、测试、评估用代码和逻辑来形成自己的判断。通过本文的实践你应该已经能够超越“惊讶”开始从工程视角理性地审视AI视频生成这项技术。下一步你可以尝试探索更高级的控制方式如ControlNet for Video或者将其集成到一个完整的Web应用中去。记住最好的学习永远是动手构建。

相关新闻

领域专用AI智能体:如何自动生成高性能Neuron Kernel

领域专用AI智能体:如何自动生成高性能Neuron Kernel

1. 从“通用”到“专用”:为什么我们需要领域微调的Agent来生成Neuron Kernel?最近在搞一些高性能计算和AI推理加速的项目,一个绕不开的痛点就是如何让模型在特定硬件上跑得更快。大家可能都听说过“算子优化”或者“内核(Kernel&…

2026/8/21 3:57:29 阅读更多 →
双屏KVM切换器选购指南:接口版本、带宽需求与实战避坑

双屏KVM切换器选购指南:接口版本、带宽需求与实战避坑

这次我们来看一个非常实际的问题:如何为你的双屏工作站选择一台合适的KVM切换器。如果你正在为多台电脑共用两套显示器、键盘和鼠标而烦恼,或者担心买错HDMI和DP版本导致无法支持高分辨率和高刷新率,那么这篇文章就是为你准备的。 KVM切换器…

2026/8/21 3:57:29 阅读更多 →
象棋连线工具5分钟上手:让中国象棋AI自动走棋,把摆棋的时间还给你

象棋连线工具5分钟上手:让中国象棋AI自动走棋,把摆棋的时间还给你

象棋连线工具5分钟上手:让中国象棋AI自动走棋,把摆棋的时间还给你 【免费下载链接】VinXiangQi Xiangqi syncing tool based on Yolov5 / 基于Yolov5的中国象棋连线工具 项目地址: https://gitcode.com/gh_mirrors/vi/VinXiangQi 这是一篇写给普通…

2026/8/21 3:57:29 阅读更多 →

最新新闻

Python爬虫构建招聘信息可视化推荐系统实战

Python爬虫构建招聘信息可视化推荐系统实战

1. 项目背景与核心价值最近帮学弟调试毕业设计时,接触到一个挺有意思的课题——用Python爬虫构建招聘信息可视化推荐系统。这个项目完美结合了数据采集、清洗分析和可视化呈现三个技术模块,特别适合作为Python全栈开发的实战案例。不同于简单的数据展示&…

2026/8/21 6:04:09 阅读更多 →
试了 CodeArts 一周:本以为是又一个 Cursor,结果我把开发团队搬进了飞书

试了 CodeArts 一周:本以为是又一个 Cursor,结果我把开发团队搬进了飞书

前言 大家好,我是 niaonao。 进入 2026 年以来,越来越多智能体应用真的走进日常工作了。想想这半年 Claude Code、OpenClaw、Hermes、Codex、DeepSeek Harness,非常滴哇塞,我必须给到夯,每款产品出来,都给…

2026/8/21 6:04:09 阅读更多 →
多智能体仿真在考古移动性研究中的应用与实践

多智能体仿真在考古移动性研究中的应用与实践

1. 项目概述:当考古学遇见多智能体仿真如果你研究过古代人类的迁徙路线,或者试图理解一个史前聚落为何会出现在某个特定的山坳里,你可能会对传统考古学方法感到一丝无力。地图上的直线距离、现代的地形数据,往往难以还原古人在复杂…

2026/8/21 6:04:09 阅读更多 →
Mac Mouse Fix使用指南:如何让一只99元的鼠标在macOS上逼近触控板体验

Mac Mouse Fix使用指南:如何让一只99元的鼠标在macOS上逼近触控板体验

Mac Mouse Fix使用指南:如何让一只99元的鼠标在macOS上逼近触控板体验 【免费下载链接】mac-mouse-fix Mac Mouse Fix - Make Your $10 Mouse Better Than an Apple Trackpad! 项目地址: https://gitcode.com/GitHub_Trending/ma/mac-mouse-fix 从Windows跳到…

2026/8/21 6:04:09 阅读更多 →
从被退回三次到一次过审:《经济研究》LaTeX模板上手指南

从被退回三次到一次过审:《经济研究》LaTeX模板上手指南

从被退回三次到一次过审:《经济研究》LaTeX模板上手指南 【免费下载链接】Chinese-ERJ 《经济研究》杂志 LaTeX 论文模板 - LaTeX Template for Economic Research Journal 项目地址: https://gitcode.com/gh_mirrors/ch/Chinese-ERJ 小林是国内某高校的经济…

2026/8/21 6:04:09 阅读更多 →
美赛软件准备:从工具熟练到团队协同的实战指南

美赛软件准备:从工具熟练到团队协同的实战指南

1. 从“会用”到“精通”:美赛软件准备的底层逻辑每年一月底到二月初,全球数万支队伍都会为同一个目标熬夜奋战——美国大学生数学建模竞赛。如果你问一个刚结束比赛的老队员,最大的教训是什么,十有八九会提到软件工具。不是他们不…

2026/8/21 6:03:09 阅读更多 →

日新闻

机场边检旅客定位系统国产化白皮书:算法、硬件、底座平台全程自主

机场边检旅客定位系统国产化白皮书:算法、硬件、底座平台全程自主

前言随着国家数字基础设施信创替代、关键技术自主可控战略持续深化,口岸智慧安防、边检智能管控领域正全面进入国产化、自主化、安全可控升级周期。当前国内机场边检旅客识别与定位体系长期依赖国外商用视觉算法、进口成像硬件、闭源通用计算平台,存在核…

2026/8/21 0:00:42 阅读更多 →
别再把“数字孪生”当空间智能了!镜像视界揭开四维时空的真正面纱

别再把“数字孪生”当空间智能了!镜像视界揭开四维时空的真正面纱

别再把“数字孪生”当空间智能了!镜像视界揭开四维时空的真正面纱当下数字化建设浪潮中,很多项目将三维可视化、视频贴图叠加的数字孪生等同于空间智能。传统数字孪生更多停留在三维场景复刻,擅长把物理世界“画出来、展示出来”,…

2026/8/21 0:00:42 阅读更多 →
105、车载温度范围-40°C到85°C的影像质量一致性——ISP参数温漂补偿与产线标定策略

105、车载温度范围-40°C到85°C的影像质量一致性——ISP参数温漂补偿与产线标定策略

105、车载温度范围-40C到85C的影像质量一致性——ISP参数温漂补偿与产线标定策略 去年冬天在北方某车厂做A样评审,凌晨四点的黑河试验场,零下三十三度。客户拿了一台冷启动的车,中控屏上倒车影像全是雪花噪点,暗部细节直接糊成一片。我第一反应是sensor温度没上来,暗电流…

2026/8/21 0:00:42 阅读更多 →

周新闻

基于阿里云与通义千问(Qwen)构建AI应用:从模型调用到生产部署的完整实践指南

基于阿里云与通义千问(Qwen)构建AI应用:从模型调用到生产部署的完整实践指南

如果你是一名开发者,最近可能已经感受到了AI大模型正在从“玩具”变成“生产力工具”的强烈信号。从代码补全到智能Agent,从本地部署到云端API,我们正处在一个技术栈快速重构的节点。然而,面对层出不穷的模型、框架和工具&#xf…

2026/8/21 3:21:33 阅读更多 →
工业通信系统底层逻辑:04 反射——高频能量撞墙之后会发生什么?

工业通信系统底层逻辑:04 反射——高频能量撞墙之后会发生什么?

第四篇:反射——高频能量撞墙之后会发生什么? —— 你以为信号已经过去了,其实它正在回来打你 老Q的现场笔记 第五季,我们正式进入工业神经系统层。这里不再是单个设备的战斗,而是整个工厂“经脉”层面的秩序之战。从这一篇开始,你将第一次看清:看似简单的信号传播,背…

2026/8/21 0:02:09 阅读更多 →
【文章复现】非线性值迭代自适应动态规划(ADP):离散时间非线性系统的策略迭代自适应动态规划算法研究附Matlab代码

【文章复现】非线性值迭代自适应动态规划(ADP):离散时间非线性系统的策略迭代自适应动态规划算法研究附Matlab代码

✅作者简介:热爱科研的Matlab仿真开发者,擅长毕业设计辅导、数学建模、数据处理、建模仿真、程序设计、完整代码获取、论文复现及科研仿真。🍎 往期回顾关注个人主页:Matlab科研工作室👇 关注我领取海量matlab电子书和…

2026/8/19 11:55:16 阅读更多 →

月新闻

免费解锁百度网盘SVIP加速:macOS用户必备的下载提速终极指南

免费解锁百度网盘SVIP加速:macOS用户必备的下载提速终极指南

免费解锁百度网盘SVIP加速:macOS用户必备的下载提速终极指南 【免费下载链接】BaiduNetdiskPlugin-macOS For macOS.百度网盘 破解SVIP、下载速度限制~ 项目地址: https://gitcode.com/gh_mirrors/ba/BaiduNetdiskPlugin-macOS 还在为百度网盘macOS版的龟速下…

2026/8/20 6:11:08 阅读更多 →
终极ncmdump指南:3分钟实现网易云NCM音乐解密与格式转换

终极ncmdump指南:3分钟实现网易云NCM音乐解密与格式转换

终极ncmdump指南:3分钟实现网易云NCM音乐解密与格式转换 【免费下载链接】ncmdump 项目地址: https://gitcode.com/gh_mirrors/ncmd/ncmdump 还在为网易云音乐下载的NCM格式文件无法在其他播放器播放而烦恼吗?ncmdump解密工具帮你轻松解决这个困…

2026/8/20 21:46:49 阅读更多 →
HarmonyOS 应用开发《掌上英语》第81篇: 智能体卡片:为英语学习 App 打造桌面级学习助手

HarmonyOS 应用开发《掌上英语》第81篇: 智能体卡片:为英语学习 App 打造桌面级学习助手

AgentCard 智能体卡片:为英语学习 App 打造桌面级学习助手适用平台:HarmonyOS 7.0 (API 26 Beta)一、引言 HarmonyOS 7.0(API 26 Beta)新增了 AgentCard 智能体卡片能力,这是继 HMAF(鸿蒙智能体框架&#x…

2026/8/21 0:14:22 阅读更多 →