Mulan – AI视频创作平台,实现视频批量生成,小白也能轻松上手在这个AI视频生成技术日新月异的时代,一个国产新平台——Mulan AI,以其独特的差异化突围。Mulan AI不仅仅是一个简单的文生视频模型,更是一个智能聚合的神奇工具,它彻底打破了传统的工作流程...发现资讯9个月前07230
GDPVAL – OpenAI开源的AI模型经济价值评估框架,衡量 AI 模型在真实经济价值任务上的表现OpenAI发布一项名为GDPval的创新AI评估基准。该基准旨在评估前GDPval的创新之处在于,它通过自上而下的方法,系统性地覆盖了对经济贡献最大的多个行业和职业,确保了任务的代表性和广度,模型在...发现资讯11个月前07210
混元2.0 – 腾讯混元最新推出的智能语言模型,支持256K上下文窗口腾讯发布了自研大模型的最新版本 混元2.0(Tencent HY2.0)。包括Tencent HY 2.0 Think和Tencent HY 2.0 Instruct两个版本。该模型采用混合专家(Mo...发现资讯9个月前07180
Music 2.0 – MiniMax推出的新一代音乐创作模型,支持多种唱法与风格切换MiniMax正式发布新一代音乐生成模型MiniMax Music 2.0。这一模型在音乐理解与声学表现能力上实现升级,能够精准捕捉人声情绪与器乐动态,为用户提供专业级音乐创作体验。在人声表现上接近真...发现资讯10个月前07180
GPT Image 1.5 – OpenAI最新推出的图像生成模型,指令精准修改图像GPT-image-1.5 是 OpenAI 的最新前沿图像生成模型。 它改进了性能、质量、编辑控制和面部保存。能够更好地遵循指令、以特定方式编辑照片,并且生成结果的速度比之前的图像生成模型提升了四倍...发现资讯9个月前07170
FLM-Audio – 智源研究院开源的全双工音频对话模型,支持本地部署与二次开发flm-audio 是由北京智源人工智能研究院联合 spin matrix 与新加坡南洋理工大学共同推出的原生全双工音频对话大模型,支持中文和英文双语交互。该模型采用创新的原生全双工架构,能够在每一个...发现资讯11个月前07170
GLM-OCR – 智谱开源的轻量级多模态OCR模型,仅 0.9B 参数智谱正式发布并开源 GLM-OCR。据介绍,该模型仅 0.9B 参数规模,支持 vLLM、SGLang 和 Ollama 部署,模型基于GLM-V架构,集成自研CogViT视觉编码器与轻量跨模态连接层...发现资讯5个月前07140
LuxReal – 群核科技推出的AI 3D视频创作平台,快速生成高质量群核科技发布基于3D技术所打造的AI内容创作工具——LuxReal,基于图像、3D 模型等多模态输入,快速生成主体一致、画面可控的视频内容,适用电商、影视、广告等行业。“LuxReal通过构建3D渲染...发现资讯9个月前07140
FlowithOS – Flowith推出的全球首个智能体操作系统,自动执行复杂任务flowithOS 是全球首个为 Agent 原生设计的智能体操作系统,可以根据用户们发出的任务指令,进行多网页搜索,通过“代码+视觉”的方式来理解用户屏幕画面,并进行自主地思考与执行,完成各种操作...发现资讯10个月前07130
Wan-Move – 阿里联合清华等开源的运动可控视频生成框架,满足高质量视频创作需求Wan-Move是由阿里巴巴通义实验室等多机构联合开源的运动可控视频生成框架。该框架以独特的潜在轨迹引导技术为基础,成功实现了视频运动的高质量控制。该框架能够生成长达5秒、分辨率为480p的视频,并且...发现资讯9个月前07120