Mini-o3 – 字节联合港大推出的视觉推理模型,支持多轮交互推理自字节跳动和香港大学的研究团队推出了 Mini-o3,一个旨在复现OpenAI强大但未公开的o3模型能力的开源系统。Mini-o3的核心目标是扩展模型与工具的交互能力,使其能够执行长达数十步的深度推理...发现资讯12个月前06900
LLaVA-OneVision-1.5 – EvolvingLMMS-Lab开源的多模态框架,实现跨模态的信息检索LLaVA-OneVision-1.5 是由 EvolvingLMMS-Lab 开发的全开源多模态框架,旨在通过高效训练和高质量数据实现多模态任务的高性能和低成本。该模型支持基于文本查询图像或基于图像...发现资讯11个月前06880
SpikingBrain-1.0 – 中国科学院推出的类脑脉冲大模型,能实现数量级的效率提升近日,中国科学院自动化研究所科研团队成功研发出首款类脑脉冲大模型SpikingBrain-1.0。SpikingBrain-1.0在多个性能方面实现突破:实现极低数据量高效训练、实现推理效率数量级提升...发现资讯1年前06850
Seedream 4.5 – 字节跳动推出的AI图像创作模型,增强画面的立体感、光影效果字节跳动最新发布的AI图像生成模型Seedream 4.5在火山引擎上线。新模型在图像生成主体一致性、指令遵循精准度、空间逻辑理解及美学表现力等方面实现迭代,进一步提升了的整体质量与稳定性。面向广告...发现资讯9个月前06800
Anthropic最新推出的AI编程模型–Claude Sonnet 4.5 ,能专注工作超 30 小时Anthropic 公司推出了一款名为 Claude Sonnet 4.5 的新一代前沿模型,该模型在编码、计算机操作及满足实际业务需求方面能力更强,同时在网络安全、金融、科研等专业领域表现突出。 C...发现资讯11个月前06800
JoySafety – 京东开源的大模型安全框架,支持通过 API 动态调整安全策略京东正式推出了其开源的大模型安全框架 ——JoySafety。框架支持每日超过亿次的调用,拥有高达95% 以上的攻击拦截率,确保用户在享受高效服务的同时,数据安全和用户隐私也得到了有力保障。 JoyS...发现资讯11个月前06750
StepAudio R1 – 阶跃星辰推出的全球首个开源原生音频推理模型,真正实现深度推理。StepAudio R1 是阶跃星辰团队推出的全球首个开源原生音频推理模型。模型通过创新的模态锚定推理蒸馏(MGRD)框架,解决了传统音频模型在复杂推理中性能下降的问题,真正实现基于声学特征的深度推理...发现资讯9个月前06730
白嫖党狂喜!GPT Plus / Business 免费试用 1 个月来啦!很多人想体验 GPT Plus,却一直舍不得开会员。现在机会来了! 官方放福利:GPT Plus 和 Business 会员限时免费试用一个月! Plus:更快更强,写论文、写代码效率直接翻倍。 Bu...资讯# GPT Plus1年前06730
万相2.6 – 阿里通义推出的新一代视频生成系列模型,首个支持角色扮演模型阿里通义推出万相2.6系列模型,支持音画同步、多镜头生成及声音驱动等功能。旨在实现生成视频在画面与声音上的整体一致性。其分镜控制功能可依据语义理解,将原始素材构建为包含多镜头切换的专业叙事段落。该版本...发现资讯9个月前06700
FLUX.2 – Black Forest Labs开源的AI图像生成与编辑模型,支持同时参考多达10张图片视觉智能实验室 Black Forest Labs 推出了其新一代图像生成模型 FLUX.2,该模型专为实际创作工作流程设计。该模型在细节生成、风格一致性、文本渲染和复杂指令遵循方面均有显著提升。模...资讯9个月前06700