Code Wiki – Google推出的AI代码文档生成工具,自动化生成和更新代码文档Google 推出 Code Wiki,一款 AI 代码文档生成工具,能够自动分析 GitHub 代码仓库并生成结构化的 Wiki 文档。该工具自动绘制调用关系和组件关系图,并在代码更新时同步更新文档...发现7个月前07340
可灵2.6 – 快手可灵推出音画同出的AI视频生成模型,支模型持文生音画和图生音画两种模式可灵推出视频生成2.6模型,该模型提供了里程碑式的“音画同出”能力,彻底改变了传统AI视频生成模型“先无声画面、后人工配音”的工作流程,用户仅需输入一段文字或一张图片,即可自动产出融合自然语音、精准音...发现资讯7个月前07330
Infography – 自动将文本内容转化可视化图表生成平台Infography是一款由专业团队开发的AI工具,能将复杂的数据或文本内容转化为直观的视觉呈现,主要面向市场营销人员、产品经理、教育工作者以及任何需要将复杂信息以视觉化方式呈现的用户。Infogra...发现资讯6个月前07310
Devstral 2 – Mistral AI开源的新一代编程模型系列,支持在大型代码库中进行复杂的代码修改和重构Mistral AI 推出新一代编程模型家族 Devstral 2,支持端到端自动化编程,相比参数规模更大的闭源模型,其成本效率高达7倍以上,特别适合大规模自动化编码任务,其核心优势在于支持跨文件协同...发现资讯7个月前07300
AudioFly – 科大讯飞开源的文生音效模型,支持本地部署、推理和微调。主要介绍 AudioFly是科大讯飞推出的开源文生音效模型,基于潜在扩散模型(LDM)架构,能够根据文本描述生成高质量音频。该模型支持44.1kHz采样率,在文本与音效的匹配度上表现优异,适用于短视频...发现资讯9个月前07270
Qianfan-VL – 百度开源的视觉理解模型,最高支持4K分辨率输入百度智能云千帆正式推出全新视觉理解模型 ——Qianfan-VL,共推出了3B、8B和70B三个版本,参数量覆盖从小到大的范围,能够灵活适应从边缘计算到云端推理的各类应用场景,并全面开源。 Qianf...发现资讯9个月前07270
360集团推出的L4级智能体系统升级为–-多智能体蜂群360集团正式宣布纳米AI升级为“多智能体蜂群”。这标志着纳米AI成为全球首个真正迈入L4级别的智能体系统,颠覆了以往智能体的工作范式——它实现了智能体从“单兵作战”到“群体协同”的物种级进化,像蜂群...发现资讯11个月前07270
EchoMimicV3 – 蚂蚁集团推出的多模态数字人视频生成框架,实现高效的模型训练和快速的动画生成。EchoMimicV3 是由蚂蚁集团研发的一款高效、多模态、多任务的数字人视频生成框架。该模型拥有 13 亿参数,采用任务混合与模态混合的创新范式,结合独特的训练与推理策略,能够在多种输入条件下实现快...发现资讯10个月前07260
InfinityStar – 字节跳动推出的高效视频生成模型,5秒视频时间缩短至仅58秒字节跳动宣布推出全新 InfinityStar 框架,采用统一的时空自回归架构,能够实现高分辨率图像与动态视频的快速合成。该框架显著提升了视频生成效率,将生成5秒720p 视频的时间缩短至仅58秒。这...发现7个月前07250
MemMachine – 开源AI记忆系统,实现高效记忆管理MemMachine是解决AI Agent长期记忆问题的开源项目,通过双层记忆系统实现真正的记忆功能,而非简单的RAG检索。MemMachine通过情景记忆、语义记忆和用户画像记忆,帮助AI应用学习...发现资讯7个月前07230