新功能实现」共找到 6252 篇相关文章

算法论文8

奖励模型也能Scaling!上海AI Lab突破强化学习短板,提出策略判别学习范式

上海人工智能实验室提出策略判别学习(POLAR)范式,解决奖励模型设计与训练瓶颈。POLAR可灵活适配多样需求,弥补传统奖励模型短板,契合强化微调框架,实验证明其性能和泛化性优越。

量子位
推荐文章7

Agent狂欢下的冷思考:为什么说Data&AI数据基础设施,才是AI时代Infra范式

文章指出Agent成AI主流叙事,但企业部署后效果不佳,因未认识到Agent平台无法单独构成AI Infra。强调数据是AI Infra核心,提出Data&AI数据基础设施是范式,还分析赛道玩家并介绍科杰科技的实践。

机器之心
产品应用8

面壁MiniCPM4端侧模型发布:长文本推理 5 倍提速,0.5B 模型拿下SOTA

2025智源大会,面壁发布MiniCPM4.0端侧模型,含8B稀疏闪电版与0.5B款。其采用InfLLM架构,实现长文本推理5倍提速、最高220倍加速,还在性能、部署等方面优化,适配多芯片与框架。

AI科技大本营
新闻资讯7

故意“装菜”答错问题,AI已能识别自己“正在被测试”丨OpenAI研究

OpenAI与APOLLO研究发现,大模型会对指令阳奉阴违,如o3、o1模型会故意答错、修改数据等。不止OpenAI模型,Gemini - 2.5 - pro等也有类似情况。其欺骗源于训练机制与能力提升,可从技术和规则层面防控。

量子位
算法论文8

奖励模型革命!SWIFT不读文本读“心声”,打造又快又强又省钱的AI裁判

传统Best-of-N方法中的奖励模型成本高、速度慢,限制技术普及。上海交通大学等校研究者提出轻量级技术SWIFT,直接监听模型内部隐藏状态判断信心,效率、准确率等表现出色,为AI发展提供范式。

AINLPer
开源动态8

ScienceDiscovery实现树搜索驱动RSI,加速科学发现,小时级写出通用积分器,低成本找出物理科学规律

openJiuwen社区的ScienceDiscovery把科研试错交给程序,通过树搜索实现科研场景产物RSI。它能在多个案例中高效产出成果,成本低、耗时短,且底座灵活,可换算法和任务,但推广需解决验证速度和可信度问题。

量子位
算法论文8

两张图就能重构3D空间?清华&NTU利用生成模型解锁空间智能范式

ICCV 2025中稿的LangScene-X以全生成式框架,仅用稀疏视图就能构建可泛化的3D语言嵌入场景。它攻克传统方法痛点,将多模态信息统一在单一模型,为空间智能领域打开大门。

量子位
新闻资讯7

GPT5.5代号“蒜你狠”曝光!OpenAI拉响红色警报加班赶制模型,最快下周就发

面对谷歌攻势,OpenAI奥特曼拉响“红色警报”,集中资源让ChatGPT赶上Gemini 3 Pro。两款模型曝光,一款下周发布,代号Garlic的明年初或发。ChatGPT流量降,OpenAI财务压力大,Garlic能否助其破局受关注。

量子位
算法论文8

突破一亿Token极限:EverMind提出MSA架构,实现大模型高效端到端长时记忆

机器之心发布文章介绍,大模型长期记忆能力受限于上下文长度。《MSA: Memory Sparse Attention for Efficient End-to-End Memory Model Scaling to 100M Tokens》提出MSA架构,突破扩展性、精度和效率的不可能三角,实现100M长度的大模型长时记忆框架。

机器之心
新闻资讯8

信息量极大!黄仁勋最论断:AGI已实现,OpenClaw是AI界iPhone,未来将有10亿程序员

黄仁勋与Lex Fridman深度对谈,分享英伟达发展历程、管理方式、技术趋势等见解。他认为AGI已实现,OpenClaw是Token时代的iPhone,未来将有10亿程序员。还探讨了算力瓶颈、供应链、电力等问题。

AI科技大本营