单选题 DeepSeek-Janus-Pro-7B/1B具备哪项核心能力?( )
A、文生视频与文生3D
B、文本生成图像以及视觉理解能力
C、语音识别与合成
D、图生视频与视频编辑
单选题 具身智能区别于无体智能的关键特征是什么?( )
A、能进行围棋对弈
B、具有物理身体并能与环境交互
C、依赖云端计算资源
D、仅处理文本与图像数据
单选题 字节跳动Kimi-K2主要面向哪种应用场景?( )
A、工业自动化与机器人控制
B、政务系统与公共服务
C、社交与创作等C端应用
D、金融风控与智能投顾
单选题 以下哪个模型是开源多模态模型,支持图像描述、视觉问答、OCR等任务?( )
A、阿里Qwen2.5-Omni-7B/3B
B、DeepSeek-Janus-Pro-7B/1B
C、32B/7B/3B
D、腾讯混元大模型
单选题 腾讯混元大模型支持下列哪项生成能力?( )
A、文生音频与图生音频
B、文生图、文生视频、文生3D、图生视频
C、语音转文字与视频剪辑
D、3D建模与物理仿真
单选题 阿里Qwen2.5-Omni-7B/3B作为开源多模态模型,其处理的模态包括哪些?( )
A、仅文字与图像
B、文字、图像、音频和视频
C、图像与音频
D、文本与视频
单选题 OpenAI-Sora作为海外多模态大模型,其核心能力是?( )
A、文生图与图生图
B、视频生成能力
C、语音合成与识别
D、OCR与文本提取
单选题 CompVis-StableDiffusion支持的多模态能力是?( )
A、文生视频与图生视频
B、文生3D与音频生成
C、文生图、图生图
D、语音转文字与OCR