发展挑战」共找到 2508 篇相关文章

新闻资讯7

GPT-5终于来了!在惊喜不多的时代,它是否值得我们的等待?|甲子光年

北京时间8月8日凌晨1点,OpenAI正式发布新模型GPT-5。它是目前最强通用模型,在多方面全面进化,将成ChatGPT默认模型。不过它虽有进步,但未掀起革命,GPT系列或难有飞跃,而OpenAI仍规划了未来发展

甲子光年
新闻资讯7

全网苦等GPT-5,超级对齐团队遗作成重要线索,奥特曼发话「惊喜很多」

AI圈聚焦GPT - 5,相关爆料多但模型未现。奥特曼称有很多惊喜。GPT - 5疑似技术通用验证器源于OpenAI论文,或代表AI发展进入新的架构突破时代。此外,有博主用疑似GPT - 5创作,效果惊人。

机器之心
算法论文7

逆强化学习全新视角的大模型对齐技术

文章从逆强化学习(IRL)视角回顾LLM对齐进展。先介绍强化学习基础及挑战,将LLM生成过程化为MDP,探讨无奖励函数的MDP,说明需神经奖励模型,还阐述通过奖励建模实现IRL及多种优化方法。

PaperAgent
推荐文章8

120页深度报告,搞懂今年大模型和应用的现状与未来

Innovation Endeavors合伙人Davis Treybig发布《State of Foundation Models》(2025),从七个维度剖析AI产业现状与趋势。报告指出,AI发展迅速,模型成本高且迭代快,应用渗透各行业,智能体崛起,市场结构变革,公司运作方式也在重塑。

Founder Park
新闻资讯7

o3-pro正式推出!说声“嗨”就花了80美元,思考1+1用时16分钟

OpenAI推出推理模型o3 - pro,同时o3降价80%。官方测评o3 - pro表现佳,但价格贵、响应慢。o3‘是否降智’引争议,奥特曼发小作文探讨AI对人类社会影响,还透露公开权重模型推迟。

量子位
产品应用7

高考数学全卷重赛!一道题难倒所有大模型,新选手Gemini夺冠,豆包DeepSeek并列第二

因网友质疑上次测评不严谨,此次用六款大模型挑战含解答题的全套高考数学题。结果Gemini 2.5 Pro夺冠,Doubao和DeepSeek R1并列第二。解答题是失分重灾区,图像题难倒多模态大模型。

机器之心
新闻资讯7

推理能力大比拼,《推理模型综合测评报告 2025 》正式发布

过去半年,推理能力成大模型新分水岭。InfoQ研究中心评测八款热门模型,围绕五大维度,用超90%原创试题。发现各模型在不同维度表现有差异,推理模型发展正从‘一个大脑’变为‘带工具的多能智能体’。

InfoQ
新闻资讯7

初稿出炉:首部AI数据标注合规标准,欢迎参与起草与研讨

数据标注影响大模型性能,国家正推进数据标注产业发展,但行业合规问题突出。智合标准中心启动《面向人工智能的数据标注合规指南》团体标准研制,初稿已出,邀多方参与起草,标准将助AI企业解决合规难题。

AI工程化
算法论文7

一张俯视图,竟然能生成完整3D小镇?

获取高质量3D场景成本高、耗时长,现有3D生成模型扩展到完整场景生成时问题多。加州大学提出无需训练的3DTown框架,能从单张俯视图合成真实连贯3D场景,虽有挑战但表现优于基线方法。

带你学AI
新闻资讯7

Next.js 真有那么好用吗?Netlify 谈他们遇到的六个现实问题

Netlify 部署大量 Next.js 网站时遇到诸多挑战。如无适配器支持、无生产级无服务器部署文档、存在未文档化行为、未基于开放 Web 标准、缺乏路线图可见性和发布可预测性等,并提出应对办法与展望。

InfoQ