跳至内容
每时AI

每时AI

  • 资讯
  • 国际
  • 分享
  • 大模型
  • 学术
  • 开源
  • 机器人
  • 关于我们

视觉生成模型

ICLR 2025|一个 Transformer 统一多模态理解和生成!Show-o:LLM 自回归做理解,MaskGIT做生成

上午8时 2025/05/31 作者 极市干货

生成任务相统一的Transformer模型
Show-o,它通过结合自回归和离散扩散建模,创新性地用

分类 学术 标签 Frechet Inception Distance、 LlamaGen、 Masked Generative Image Transformer、 扩散模型、 自回归、 视觉生成模型 发表评论

Runway上新Gen-4,角色、场景一致性顶尖,我们小测了下可灵1.6

下午2时 2025/04/02 作者 AI先锋官

今年以来,各类AI产品和模型层出不穷。近日,Runway发布了其最新研发的Gen-4 AI视频生成模型,实现了高保真度、一致性及指令遵循度的显著提升,并能保持角色、物体和场景的一致性。

分类 资讯 标签 Gen-4、 Runway公司、 有限表现、 物体生成、 视觉生成模型、 角色一致性 发表评论

Runway Gen-4震撼上线,逼真场景暴击电影圈!好莱坞导演集体失业?

上午11时 2025/04/01 作者 新智元

Runway发布Gen-4,大幅提升图像生成能力。它能精确创建人物、场景和物体,并保持一致的世界观和视觉风格,让电影级画面成为可能。

分类 资讯 标签 Gen-4、 Runway、 卓越的动作效果、 惊人的一致性、 精确的角色和物体一致性、 视觉生成模型 发表评论

无需引导采样,清华大学提出视觉模型训练新范式

下午11时 2025/02/09 作者 机器之心

清华大学提出的新算法Guidance-Free Training(GFT)实现了原生无需引导采样的视觉模型训练,与CFG效果相当但成本减半。GFT简单高效且通用,可广泛应用于多种视觉生成模型。

分类 学术、 资讯 标签 机器学习、 深度学习、 清华大学、 视觉生成模型、 采样成本、 陈华玉 1 条评论

2025年 AGI AI AI技术 Anthropic ChatGPT Claude DeepSeek DeepSeek-R1 DeepSeek R1 GitHub GPT-4o LLM Manus Meta OpenAI Python Sam Altman 人工智能 人形机器人 具身智能 大型语言模型 大模型 大语言模型 字节跳动 开源 强化学习 微软 扩散模型 技术创新 智能体 木易 机器学习 深度学习 清华大学 生成式AI 用户体验 百度 腾讯 自然语言处理 英伟达 谷歌 阿里云 阿里巴巴 马斯克

近期文章

  • Claude Code 首席工程师揭秘 AI 如何重塑开发日常!
  • 对话智源王仲远:具身智能“小组赛”才刚刚开打,机器人需要“安卓”而非 iOS
  • 中外六大AI出战高考作文!实测结果出炉
  • 他山科技开源触觉模拟仿真,引领机器人触觉技术迭代方向
  • 成立四个月获三轮融资?机器人触觉技术研发商「猿声科技」完成新一轮战略融资

分类

  • 分享
  • 国际
  • 大模型
  • 学术
  • 开源
  • 机器人
  • 资讯
2025 年 6 月
一 二 三 四 五 六 日
 1
2345678
9101112131415
16171819202122
23242526272829
30  
« 5 月    

归档

  • 2025 年 6 月
  • 2025 年 5 月
  • 2025 年 4 月
  • 2025 年 3 月
  • 2025 年 2 月
  • 2025 年 1 月
  • 2024 年 12 月
  • 2024 年 11 月

AI新闻 | X平台 | APK反编译 | 京ICP备2024096144号 |
© 2025 每时AI • Built with GeneratePress
 下载我们的APP,AI秒送达!  立即下载
×