DeepSeek R1T2 – TNG推出的改进型AI语言模型,推理速度显著提升DeepSeek R1T2 Chimera 是 TNG 基于 DeepSeek 开源生态打造的高性能推理优化模型,通过权重融合技术实现速度飞跃,在智能与成本间取得突破性平衡,该模型在数学、编程...发现资讯1年前01,1040
小米开源的图像编辑框架–Lego-Edit ,能完成多种复杂的图像编辑任务Lego-Edit是一个为通用基于指令的图像编辑设计的框架。它使用Builder(一个MLLM)来调用Bricks(模型级工具)以实现灵活性,并采用强化学习(RL)来增强Builder的推理和工具组合...发现资讯11个月前01,1020
MindVideo AI – 免费AI视频生成器,支持文本或图像转化为高质量视频MindVideo AI是一款先进的在线AI视频生成器,利用人工智能算法快速将文本或图像转化为高质量视频。用户只需输入文字描述或上传图片,就能在几秒钟内生成高质量视频,支持高达4K分辨率。特色包括丰富...发现9个月前01,1010
FramePackLoop – AI视频生成工具,无限生成符合特定要求的循环视频FramePackLoop是一个基于 FramePack 的开源工具,旨在简化视频制作工作流程。专门用于生成无缝循环视频。该工具利用模块化架构实现帧序列打包、时间对齐和无缝循环合成。具体而言,它将光流...发现资讯12个月前01,1000
Wav2Lip – 开源的高保真唇形同步工具,自动生成与语音同步的口型动画Wav2Lip 是一个 口型同步技术开源项目,可以在任意语音对任意说话的脸部视频进行口型同步。旨在提升视频中唇部同步的保真度。此项目通过 Wav2Lip 实现精确的唇动匹配,再利用 Real-ESRG...发现资讯12个月前01,0990
Mistral 3 – Mistral AI推出的最新多模态大模型系列,同时处理文本和图像输入Mistral 3 是由 mistral ai 正式发布的全新一代开源人工智能模型系列,支持256k超长上下文窗口,可轻松处理百万字长文档、模型支持多模态(文本和图像)与多语言功能。Mistral 3...发现资讯9个月前01,0980
gpt-oss – OpenAI开源的推理模型系列,支持本地微调和定制,满足特定任务需求OpenAI终于放出其传闻已久的开源模型:gpt-oss-120b和gpt-oss-20b。这两款模型均采用MoE架构,与DeepSeek的多款模型类似。这两款模型已经与OpenAI的Response...发现资讯1年前01,0950
MiroFlow – 多Agent系统开发框架,支持高并发处理,能灵活处理复杂任务。Miroflow 是一个多agent系统开发框架,它支持高并发处理,主要用于构建复杂的分布式系统。在软件开发中,多agent系统通常涉及到多个独立运行的实体(agents),每个实体可以代表一个独立的...发现资讯1年前01,0940
SkyReels-A3 – 昆仑万维推出的数字人视频生成模型,支持长达60秒的单分镜视频输出昆仑万维首先发布了SkyReels-A3,这款音频驱动的人像视频生成模型通过简单的操作,可以生成逼真的视频效果。该模型通过上传一张照片并为其配音,便能实现人物的口型、表情和动作的精准匹配。可以为现有视...发现资讯1年前01,0940
Hailuo 2.3 – MiniMax推出的AI视频生成模型,支持复杂肢体动作生成上海ai独角兽企业minimax稀宇极智正式推出新一代视频生成模型hailuo 2.3(海螺2.3)。该模型支持文本和图像输入生成高品质视频,标志着AI在动态视觉效果上的又一突破,尤其适用于电影制作...发现资讯10个月前01,0890