混元世界模型1.5」共找到 9371 篇相关文章

推荐文章9

和一线研究员的闭门讨论:蒸馏变难后,下一步的重点是什么?

本文整理拾象邀请多家头部模型厂商一线AI研究员的线下闭门讨论,围绕大模型前沿方向分享业内共识与分歧,涵盖Computer Use、RSI、模型蒸馏、训练数据、数据生意等核心议题,干货密度高。

海外独角兽
新闻资讯7

黄仁勋倡议的开源联名信,Anthropic 为何不愿签名?

黄仁勋分享支持开放权重模型的联名信,NVIDIA、Google等公司联署,Anthropic缺席遭网友讨伐。Anthropic研究人员回应引争议,这场讨论或存在错位,分歧关键在于发布前评测能否支持模型权重长期外授。

AI科技评论
开源动态8

外卖公司也能搞AI?

昨天凌晨美团悄悄开源560B参数的MoE大模型LongCat-Flash-Chat,引发国外网友疑惑。该模型推理速度超100 tokens/秒,基准测试表现出色,多项设计解决实际问题,贴合美团业务需求。

AGI Hunt
新闻资讯7

LLM总是把简单任务复杂化,Karpathy无语:有些任务无需那么多思考

随着推理大模型和思维链普及,大模型有了‘深度思考’能力,但现在有些偏科,简单任务也复杂化。AI大牛Andrej Karpathy发长文指出该现象,认为是基准测试优化所致,大模型发展不能只追求分数。

机器之心
推荐文章7

上下文工程的崛起:提示工程已是过去式

模型应用从简单问答转向复杂智能体系统,技术焦点正从提示工程转向上下文工程。上下文工程核心是为大模型提供恰当信息与工具,其重要性日益凸显,且与提示词工程有明显区别。

AI工程化
新闻资讯7

DSpark推理速度提升80%后,OpenAI宣布新方法将推理成本降低了一半

近日,OpenAI 工程师开发优化技术,将模型推理成本降一半。业内猜测或基于公开成果,也有人认为是模型量化。此前 DeepSeek 推出 DSpark,使 V4 模型推理速度提升 60%-85%,还引入峰谷定价机制。

AI科技评论
新闻资讯7

35天,版本之子变路人甲:AI榜单太残酷!

LMSYS榜单揭示大模型残酷现实,如Claude 3 Opus从榜首暴跌,大模型“霸主保质期”仅35天,这对应用层开发者是降维打击,未来生存要么做“游击队”,要么挖掘模型无法碾压之物。

新智元
算法论文8

爆火论文颠覆RL认知!「错误奖励」让LLM推理暴涨24.6%,学界惊了

最新爆火论文颠覆传统RL训练认知,华盛顿大学等团队证实「伪奖励」可让LLM推理性能提升。研究设置多种伪奖励形式实验,发现其对Qwen模型有效,但并非对所有模型都有效。

新智元
新闻资讯8

爆火一周后,Jev正式全面开放:一个“不会说话”的AI,为何风靡硅谷?

本文报道爆火硅谷一周的AI模型Jev正式全面开放,该模型由前OpenAI研究员团队打造,不同于传统大模型,不聊天不生成文本,仅做结构化判断,主打低成本快决策,引发开发者圈热议。

DeepTech深科技
开源动态8

全景视觉的Depth Anything来了!Insta360推出DAP,200万数据打造全场景360°空间智能新高度

Insta360等团队推出全景度量深度基础模型DAP,构建200万量级全景数据引擎,设计三阶段伪标签管线,在模型架构上也有创新,在多项测试中效果优异,项目代码与模型已开源。

机器之心