DeepFig一键生成图文视频,多模态内容创作平台深夜1点,小李的第5杯咖啡早已凉透。 屏幕上的剪映工程文件、Canva设计稿、Word脚本挤满了桌面,她正第8次调整图文笔记的封面色调——前7版因风格不统一被粉丝吐槽“像拼凑的广告”。 新买的粉底液在...发现科技1年前09500
dots.ocr – 小红书hi lab开源的文档解析模型dots.ocr 是小红书 hi lab 开源的多语言文档解析模型,能高效地进行文档布局检测和内容识别,保持良好的阅读顺序。dots.ocr 在 OmniDocBench 上表现出色,文本、表格和阅读...发现资讯1年前09470
WebSailor – 阿里通义实验室开源的网络智能体,具备较强的推理和检索能力阿里通义正式开源了其网络智能体 WebSailor,该智能体具备强大的推理和检索能力。 WebSailor 不仅提升了国产 AI Agent 的技术标准化,还降低了企业的接入门槛,WebSailor网...发现资讯1年前09450
Youtu-agent – 腾讯优图推出的开源智能体框架,提供智能体能调用的各种工具Youtu-Agent是一个面向实际应用的开源框架,覆盖文件管理、数据分析、学术研究和信息综述等多个应用场景。该框架以极简设计和高性能表现为核心,旨在为研究人员和开发者提供高效、易用、可复现的智能体开...发现资讯1年前09440
Intern-S1-mini – 上海AI Lab开源的轻量级科学多模态推理模型,适合在资源受限的设备上快速部署InternLM 团队正式发布了其开源的轻量级多模态推理模型 ——Intern-S1-mini。该模型参数仅为8B,结合了先进的 Qwen3-8B 语言模型与0.3B 视觉编码器 InternViT...发现资讯1年前09440
LTX-2 – Lightricks推出的AI视频生成模型,推理效率比前代模型快2 – 3倍Lightricks推出开源AI视频模型LTX-2,支持原生4K分辨率与同步音频生成。LTX-2模型采用原生4K生成技术,无需后期放大即可输出50fps高帧率视频,生成速度超越播放速度,实现"6秒视频...发现资讯10个月前09430
DeepFig——学术论文辅助助手,您的智能文献管理与格式校正专家DeepFig是什么? DeepFig是一款基于人工智能技术的下一代学术文献智能管理助手。它专为科研工作者、高校学生和学术写作者设计,旨在彻底解决文献管理中最耗时、最易错的“引用格式校正”与“参考文献...发现资讯1年前09430
Qwen3-Max – 阿里通义推出的超大规模模型,支持灵活调用外部工具完成复杂任务阿里通义旗舰模型Qwen3 - Max重磅登场,性能超过GPT5、Claude Opus4等,位居全球前三,Qwen3-Max 能在几秒内完成成熟程序员大半天才能实现的编程任务,展现出卓越的指令理解和...发现资讯11个月前09360
阿里通义实验室发布HumanOmniV2 – 多模态推理模型,精准全面推理人类意图阿里通义实验室发布了HumanOmniV2,这是一款旨在深化AI多模态理解能力的模型。该模型通过“上下文总结+逻辑推理”创新机制,克服传统模型在全局上下文理解和捷径推理中的不足。HumanOmniV2...发现资讯1年前09350
OpenAI最新推出-GPT-5,免费开放,博士级推理能力OpenAI 最新发布的 GPT-5 在 AI 领域引发了巨大轰动,被誉为“迄今最智能、最快速、最实用的 AI 模型”。它不仅大幅提升了核心性能,还在多个关键领域实现了突破性进展,使其成为当前最先进的...发现资讯1年前09340