跳至内容
每时AI

每时AI

  • 资讯
  • 国际
  • 分享
  • 大模型
  • 学术
  • 开源
  • 机器人
  • 关于我们

真实世界

o3被曝「无视」前成果?华人学者实名指控,谢赛宁等大牛激烈争辩

下午11时 2025/04/21 作者 新智元

人成果?OpenAI研究人员对此回应:不存在。
在视觉感知方面,o3和o4-mini在思维链中进行图

分类 资讯 标签 FrontierMath、 o3模型、 优化后、 基准测试、 真实世界、 质疑 发表评论

AI应用创业公司:大模型最近的突破,全是作弊

下午4时 2025/04/18 作者 机器之心

。
「AI 大模型自去年 8 月以来就没有太大进步」。这是一位 AI 创业者在近期的一篇博客中发表的

分类 学术、 资讯 标签 伦理原则、 复杂性任务、 大语言模型、 标准化测试、 真实世界、 误导性反馈 发表评论

OpenAI 姚顺雨:在 o3 发布之际,我们更该重新思考 AI 的意义

下午2时 2025/04/17 作者 硅星GenAI

的能力边界持续扩展,从文本生成、代码撰写,到多模态理解和自主行动,OpenAI 最新发布的推理模型

分类 分享 标签 交互任务、 人工智能、 复杂环境、 新型应用、 真实世界、 评估机制 发表评论

Grok还没热,OpenAI就来新基准:百万美元测试,Claude竟拿下40万!

下午2时 2025/02/19 作者 AI进修生

OpenAI发布SWE-Lancer测试基准,评估AI代码能力。该基准基于真实项目任务,涵盖软件工程全栈开发和管理任务,价值100万美元。Claude 3.5 Sonnet表现最佳,但远不及人类开发者水平。

分类 分享 标签 41万美元、 Claude 3.5、 OpenAI、 SWE-Lancer、 人工智能、 真实世界 发表评论

2025年 AGI AI AI技术 Anthropic ChatGPT Claude DeepSeek DeepSeek-R1 DeepSeek R1 GitHub GPT-4o LLM Meta OpenAI Python Sam Altman 人工智能 人形机器人 具身智能 大型语言模型 大模型 大语言模型 字节跳动 开源 强化学习 微软 扩散模型 技术创新 智能体 木易 机器学习 深度学习 清华大学 生成式AI 用户体验 百度 腾讯 自然语言处理 英伟达 谷歌 阿里云 阿里巴巴 马斯克 黄仁勋

近期文章

  • 欧洲AI公司发布会自称「SOTA」,却翻车成网友寻找千问现场
  • Sam Altman美国国会发言:DeepSeek让我感到紧张,AI竞争最终是中美的能源竞争
  • 解读理想VLA司机大模型:你不用付费的专属“代驾”
  • YC合伙人吐槽:今天的AI应用不行,不是AI的问题,而是产品设计能力不行
  • 小红书“撕毁”了竞业协议,但整个行业却在越陷越深

分类

  • 分享
  • 国际
  • 大模型
  • 学术
  • 开源
  • 机器人
  • 资讯
2025 年 5 月
一 二 三 四 五 六 日
 1234
567891011
12131415161718
19202122232425
262728293031  
« 4 月    

归档

  • 2025 年 5 月
  • 2025 年 4 月
  • 2025 年 3 月
  • 2025 年 2 月
  • 2025 年 1 月
  • 2024 年 12 月
  • 2024 年 11 月

AI新闻 | X平台 | APK反编译 | 京ICP备2024096144号 |
© 2025 每时AI • Built with GeneratePress
 下载我们的APP,AI秒送达!  立即下载
×