Seaweed APT2Seaweed APT2 是 ByteDance 最新推出的实时交互式视频生成模型,采用 自回归对抗后训练(AAPT) 技术,实现单 GPU 24 fps、长视频流式生成,支持虚拟人物与世界漫游互动。
Vidu Q3Vidu Q3 是由生数科技(Shengshu Technology)推出的新一代 AI 视频生成模型,可直接生成最高 16 秒、1080p 分辨率、音视频同步的视觉内容,结合文本或图像提示实现多镜头叙事、音频配合与语言文字渲染,适用于短剧、广告、自媒体等多种视觉内容创作场景。
GPT Image 1.5OpenAI 发布的最新图像生成与编辑 AI 模型,作为 ChatGPT Images 的核心引擎,它以 最高达 4× 更快的生成速度、更强的指令执行力、精细细节保留与创意转换能力 为特性,支持创意图像生成、照片编辑与视觉工作流自动化。
ACE-Step 1.5ACE-Step 1.5 是一个开源 AI 音乐生成基础模型,采用混合架构支持快速生成整首音乐、歌词对齐、多语言支持及灵活编辑功能,输出结构化内容资产聚焦音乐生成能力、用例及用户指南。
SoulX-FlashTalkSoulX-FlashTalk 是 Soul AI Lab 开源的实时数字人生成模型,基于 14B 参数级别架构,通过自纠正双向蒸馏和全栈推理加速技术实现亚秒级延迟(0.87s)和持续 32 FPS 实时视频生成,主要用于音频驱动的虚拟形象交互、长时生成流式输出和多语言驱动应用场景。
MiMo-V2-Flash小米开源的高效混合专家(MoE)大语言模型,具备 3090亿参数、150亿激活参数、150 tokens/s 超高速推理、256K 超长上下文支持,在推理、代码生成与智能体任务上表现出色。