up导航
  • blog
  • 网站提交
  • 2fa工具
  • 全球地址生成
  • ui工具
      • 未登录
        登录后即可体验更多功能
    • ai工具
    • blog
    • 网站提交
    未登录
    登录后即可体验更多功能

    发现

    共 433 篇文章
    发现科技资讯
    排序
    发布更新浏览点赞
    GPT Image 1.5 – OpenAI最新推出的图像生成模型,指令精准修改图像

    GPT Image 1.5 – OpenAI最新推出的图像生成模型,指令精准修改图像

    GPT-image-1.5 是 OpenAI 的最新前沿图像生成模型。 它改进了性能、质量、编辑控制和面部保存。能够更好地遵循指令、以特定方式编辑照片,并且生成结果的速度比之前的图像生成模型提升了四倍...
    发现资讯
    8个月前
    07130
    Depth Anything 3 – 字节跳动推出的视觉空间重建模型,可重建完整3D场景

    Depth Anything 3 – 字节跳动推出的视觉空间重建模型,可重建完整3D场景

    自字节跳动(ByteDance Seed)的研究团队推出—Depth Anything 3 (DA3)视觉空间重建模型,旨在打破3D视觉任务之间的壁垒,实现一个“大一统”的视觉几何模型。DA3的核心思...
    发现资讯
    9个月前
    07110
    Wan-Move – 阿里联合清华等开源的运动可控视频生成框架,满足高质量视频创作需求

    Wan-Move – 阿里联合清华等开源的运动可控视频生成框架,满足高质量视频创作需求

    Wan-Move是由阿里巴巴通义实验室等多机构联合开源的运动可控视频生成框架。该框架以独特的潜在轨迹引导技术为基础,成功实现了视频运动的高质量控制。该框架能够生成长达5秒、分辨率为480p的视频,并且...
    发现资讯
    8个月前
    07090
    GPT-5.2-Codex – OpenAI推出的智能体编程模型,能高效生成高质量的代码

    GPT-5.2-Codex – OpenAI推出的智能体编程模型,能高效生成高质量的代码

    gpt-5.2-codex 是 openai 推出的面向智能体编程任务的专业级模型,聚焦于高复杂度软件工程实践与防御型网络安全场景。其核心突破在于引入了“上下文压缩”技术,让其在处理代码重构、迁移等长...
    发现资讯
    8个月前
    07080
    FlowithOS – Flowith推出的全球首个智能体操作系统,自动执行复杂任务

    FlowithOS – Flowith推出的全球首个智能体操作系统,自动执行复杂任务

    flowithOS 是全球首个为 Agent 原生设计的智能体操作系统,可以根据用户们发出的任务指令,进行多网页搜索,通过“代码+视觉”的方式来理解用户屏幕画面,并进行自主地思考与执行,完成各种操作...
    发现资讯
    10个月前
    07080
    FS-DFM – 苹果联合俄亥俄州立大学推出的扩散语言模型,速度提升128倍

    FS-DFM – 苹果联合俄亥俄州立大学推出的扩散语言模型,速度提升128倍

    苹果提出 FS-DFM 扩散模型,仅需 8 轮快速迭代,即可生成与传统模型上千轮迭代质量相媲美的文本,且写入速度比同类模型最多可提高 128 倍。FS-DFM 在扩散模型的基础上进行了进一步简化,目标...
    发现资讯
    10个月前
    07080
    GLM-OCR – 智谱开源的轻量级多模态OCR模型,仅 0.9B 参数

    GLM-OCR – 智谱开源的轻量级多模态OCR模型,仅 0.9B 参数

    智谱正式发布并开源 GLM-OCR。据介绍,该模型仅 0.9B 参数规模,支持 vLLM、SGLang 和 Ollama 部署,模型基于GLM-V架构,集成自研CogViT视觉编码器与轻量跨模态连接层...
    发现资讯
    5个月前
    07060
    LuxReal – 群核科技推出的AI 3D视频创作平台,快速生成高质量

    LuxReal – 群核科技推出的AI 3D视频创作平台,快速生成高质量

    群核科技发布基于3D技术所打造的AI内容创作工具——LuxReal,基于图像、3D 模型等多模态输入,快速生成主体一致、画面可控的视频内容,适用电商、影视、广告等行业。“LuxReal通过构建3D渲染...
    发现资讯
    8个月前
    07050
    HunyuanOCR – 腾讯混元推出的端到端OCR视觉语言模型,仅1B参数,

    HunyuanOCR – 腾讯混元推出的端到端OCR视觉语言模型,仅1B参数,

    腾讯正式推出其全新开源模型 HunyuanOCR,参数量仅为1B。该模型基于腾讯独创的混元多模态架构设计,已在多个行业标准的 OCR 应用中取得了 SOTA(最先进水平)的佳绩。HunyuanOCR ...
    发现
    9个月前
    07050
    Seedance 1.5 Pro – 字节推出的音画同步多模态视频模型,整体效果自然流畅。

    Seedance 1.5 Pro – 字节推出的音画同步多模态视频模型,整体效果自然流畅。

    字节跳动推出的Seedance 1.5 Pro模型,具备原生音画同步能力的多模态视频生成模型。该模型可实现精准音画同步,实现较高的视听一致性,且支持多种语言和地方方言口音,能够捕捉其独有的语音韵律与情...
    发现资讯
    8个月前
    07040
    加载更多
    up导航
    OneNav 一为导航主题,集网址、资源、资讯于一体的 WordPress 导航主题,简约优雅的设计风格,全面的前端用户功能,简单的模块化配置,欢迎您的体验

    友链申请免责声明广告合作关于我们

    扫码加QQ群up导航
    扫码加QQ群
    扫码加微信up导航
    扫码加微信
    Copyright © 2026 up导航 由 OneNav 强力驱动 
    网址
    网址文章软件书籍