Wan-Move – 阿里联合清华等开源的运动可控视频生成框架wan-move 是由阿里巴巴通义实验室等单位联合推出的开源运动可控视频生成框架,依托潜在空间中的轨迹引导机制,实现高精度、高保真的视频运动调控。该框架能够生成长达5秒、分辨率为480p的视频,并且其...发现8个月前08410
MyDetector – AI内容检测平台,对文本进行语法检查和逻辑分析MyDetector 是一款面向学术、媒体、企业与内容创作领域的全能型 AI 内容真实性与质量检测平台,MyDetector 核心功能包括 AI 内容检测、抄袭检查、语法与逻辑分析,以及文本“人类化...发现资讯8个月前08400
NewBie-image-Exp0.1 – NewBieAi Lab开源的图像生成模型,能生成高质量动漫图像NewBie-image-Exp0.1是一个开源的文本到图像生成模型,专为动漫风格内容创作设计,拥有35亿参数,结合了Lumina与Next-DiT双架构。采用 Google/Gemma3-4b-it...发现资讯9个月前08380
手把手教你本地部署 ComfyUI,轻松玩转 AI 视频生成一、本地玩AI的前提条件 想本地折腾的同学先看这里:1、首先,你要有一张英伟达的显卡,AMD显卡用户看到这里可以放弃了。2、想在本地跑 AI 模型,显存容量的大小是首要门槛——它决定了你的电脑能不能跑...发现# comfyui11个月前08370
清华联合巨人网络开源的多方言语音合成大模型框架DiaMoE-TTS巨人网络AI Lab与清华大学电子工程系SAT Lab的研究团队联合首创多方言语音合成大模型框架DiaMoE-TTS,并宣布将数据、代码、方法全方位开源,旨在推动方言语音合成的公平与普惠。该框架基于国...发现资讯10个月前08340
Meta Ray-Ban Display – Meta推出的首款带显示屏的AI眼镜,为用户提供便捷的智能交互体验Meta Ray-Ban Display是Meta首款搭载高解析度显示屏的消费级设备,其主要设计特点是在右镜片内嵌半透明抬头显示屏(HUD),亮度达5000尼特,可在户外强光环境下清晰显示信息,且从外...发现资讯11个月前08340
Skywork MindLink – 昆仑万维发布最新推理大模型昆仑万维正式发布并开源了其最新推理大模型Skywork MindLink,同时公布了72B模型权重、技术报告及代码仓库链接,这套全新的推理范式,能够根据任务难度自适应整合推理和非推理的生成回复,极大减...发现资讯1年前08340
最新推出的语音模型一GPT-realtime,支持多种语言和语音风格GPT-realtime是一个专用于语音AI Agent的多模态模型,能够生成更加自然流畅的语音,完美模仿人类丰富多样的语调、情感以及语速,支持图像理解并将其与语音或文本对话相结合使用,而且这个模型是...发现资讯1年前08330
Jetson Thor – 英伟达推出的机器人AI计算平台,兼容多种生成式AI框架,能构建丰富生态系统。英伟达正式发布机器人专用计算平台Jetson Thor,其AI算力达到前代产品的7.5倍(即提升6.5倍),能效提高3.5倍。 开发者套件售价3499美元,量产模组批量采购价低至2999美元。Jets...发现资讯1年前08330
SpatialLM 1.5 – 群核科技发布空间大语言模型,助力解决机器人训练数据难题。SpatialLM 1.5是一款基于大语言模型训练的空间语言模型,支持用户通过对话交互系统SpatialLM-Chat进行可交互场景的端到端生成。可根据文字描述、参考图像和3D空间布局,生成具有时空一...发现资讯1年前08320