Talo – AI实时语音翻译工具,打破语言障碍,增强沟通效果Talo是一款专为视频通话设计的实时AI翻译工具,旨在打破语言障碍,让全球范围内的无障碍沟通。它利用先进的AI技术,提供即时、准确的语音翻译,用户只需将会议链接粘贴到Talo界面并选择所需语言,即可开...发现资讯9个月前08770
VeOmni – 字节跳动开源的全模态深度学习框架VeOmni 是字节跳动(ByteDance)开发的一个全模态深度学习框架,旨在支持多模态数据融合的场景,特别是在计算机视觉和自然语言处理(NLP)领域。全模态指的是能够处理多种类型的数据,例如文本...发现资讯1年前08770
Deepfig – AI驱动设计到代码一站式平台Deepfig一个基于中文开源技术开发的智能语言模型,具备多种功能和应用场景。可以为您提供的服务: 自然语言理解与生成 理解用户输入的中文文本并进行准确的语义分析。 生成流畅、符合语境的中文回复。 支...发现科技1年前08770
Spark Chemistry-X1-13B – 科大讯飞开源的化学模型,助力化学研究和药物设计科大讯飞正式宣布讯飞星火化学大模型 Spark Chemistry-X1-13B 与讯飞文生音频模型 AudioFly 全面开源,在论文研读、专业学术翻译、英文润色及文献综述生成等能力上表现优异,助力...发现资讯11个月前08760
Popi.art – AI动画短片制作平台,提供动态帧布局与实时效果Pika Art是一个使用AI技术生成和编辑视频的平台,用户只需输入一句话描述,系统就会自动完成从分镜生成、角色场景创建、画面渲染到配音配乐的全流程,输出最长可达1000秒的连贯动漫视频。 Popi...发现资讯10个月前08700
阿里通义最新开源的–Qwen3-Coder-Flash 高性能编程模型,开发者的代码助手阿里旗下通义千问团队正式发布了最新的开源编程模型 Qwen3-Coder-Flash,全称为 Qwen3-Coder-30B-A3B-Instruct。这款新品主打高性能与高效率,定位于开发者友好、轻...发现资讯1年前08700
Glyph – 智谱联合清华开源的视觉文本压缩框架,实现高效的上下文压缩Glyph 是一个通用的长上下文建模框架,旨在让任何长文本任务都能受益于视觉压缩,Glyph通过视觉压缩技术实现长上下文文本理解的规模化扩展。该框架可将长文本转化为紧凑图像,并通过视觉-语言模型进行处...发现资讯10个月前08680
Colorify AI – AI图像上色工具,上传照片后可立即看到上色效果ColorifyAI 是一款利用人工智能技术将文本或照片迅速转化为高质量填色页的AI工具。开发者通过 proprietary large-model 技术有效地识别语义或照片轮廓,从而快速生成用户所需...发现资讯1年前08650
Gemini3 DeepThink – 谷歌推出的超强推理模型,具备专家级的处理能力谷歌正式发布迄今最强大人工智能(AI)模型Gemini 3。谷歌转手又扔出一重磅炸弹——Gemini 3 Deep Think。Gemini 3 Deep Think可以同时从多个思路进攻高难度数学和...发现资讯9个月前08640
NemoVideo – AI视频编辑工具,快速生成爆款视频,支持多种流行风格及动态字幕效果NemoVideo 是一款为视频创作者提供基于 AI 的“爆款仿剪Agent工具”,工具通过 AI 技术实现自动剪辑,如消除静音、加字幕等,能根据用户需求生成创意简报和脚本,帮助快速制作爆款视频。帮助...发现9个月前08640