火山引擎推出的AI视频生成模型– 1.0 pro fast ,速度提升约3倍,成本降低72%火山引擎正式上线豆包视频生成模型 1.0profast。该模型在继承 Seedance1.0pro 模型核心优势的基础上,实现了显著的效率突破:生成速度最高提升约 3 倍,价格直降 72%。pro f...发现资讯10个月前08070
Veo 3.1 – 谷歌推出的AI视频生成模型,能快速生成高质量的视频谷歌正式发布最新一代AI视频生成模型 Veo 3.1,该模型支持生成4秒、6秒或8秒的720P或1080P视频片段并自带音轨,可通过文本提示、图像或视频片段输入生成内容,提供首尾帧插值、场景延展及多图...发现资讯10个月前08040
Lumine – 字节跳动推出的3D开放世界通用AI智能体,提升自主思考和操作能力字节推出的Lumine框架,能在3D开放世界中进行实时推理与感知,为探索未知领域提供了强大的技术支持。该智能体基于qwen2-vl-7b-base模型构建,采用类人交互方式,将视觉感知、逻辑思考与操作...发现9个月前08030
Neovate Code – 蚂蚁集团开源的AI编程助手,支持开发者用自然语言描述编程需求neovate code 是由蚂蚁集团推出的开源智能编程助手,致力于全面提升开发效率。该工具具备深度理解代码库的能力,能够遵循项目现有的编码风格,支持通过插件系统灵活扩展功能。目前以命令行工具(cli...发现资讯11个月前08020
VibeVoice – 微软推出的开源文本转语音模型,支持动态对话和交互式应用近日,微软研究院提出了一种全新的语音生成模型 VibeVoice。它能够将文字脚本直接转化为流畅、自然的长对话音频。创作者无需再为音色匹配、语速调整、对话间隔等细节问题耗费精力,只需提供一份带角色标注...发现资讯1年前08010
Voost – 创新的双向虚拟试穿和试脱AI模型,增强服装与身体的关系推理能力。NXN Labs的研究团队开发了一个叫做Voost的人工智能系统,旨在提升虚拟试衣和试脱技术的表现。就像是一个超级聪明的"换衣魔法师"。这个系统最神奇的地方在于,它不仅能让你"试穿"任何衣服,还能从穿...发现资讯1年前07990
FastVLM – 苹果开源的视觉语言模型,能够准确理解和生成与图像内容FastVLM是一款专为高分辨率图像处理优化的视觉语言模型,基于苹果自研的MLX框架开发,专为Apple Silicon设备量身定制。FastVLM支持完全本地化处理,无需依赖云端上传数据,完美契合苹...发现资讯1年前07980
Sidekick – AI流程自动化平台,帮助用户快速实现常见任务的自动化Sidekick是一款基于AI的智能流程自动化平台,让用户无需安装额外软件即可与本地大语言模型(LLM)对话,并能结合Mac上的文件、文件夹和网站信息生成回应,Sidekick支持文本生成图像,无需额...发现资讯11个月前07970
RynnRCP – 阿里达摩院首次开源的机器人上下文协议达摩院将MCP(模型上下文协议)理念引入具身智能,首次提出并开源RCP(Robotics Context Protocol)协议,推出一套完整的机器人服务协议和框架RynnRCP。旨在推动具身智能开发...发现资讯1年前07970
深度赋能,化繁为简:用deepfig工作流自动化重塑企业运营效率deepfig是什么? deepfig是一款强大的智能流程自动化(IPA)平台。它的核心使命是打破企业内部的“数据孤岛”和“系统壁垒”,通过无需代码的可视化方式,将那些原本需要人工在不同软件、平台之间...发现资讯1年前07960