新模型Spud」共找到 9274 篇相关文章

新闻资讯7

Pony Alpha模型炸场!全球「猜爹大赛」开启

2月7日深夜,OpenRouter悄悄上线匿名模型Pony Alpha,其编程、推理等体验出色,外网瞬间疯传。全球开启‘猜爹大赛’,Claude、DeepSeek、Grok、GLM各派开吵,还凸显了‘匿名盲测式发布’打法。

新智元
推荐文章8

Efficiency Law, 物理精确世界模型,及世界模型引擎驱动的具身智能学习范式

2025年秋具身智能赛道火热,特斯拉、英伟达动作不断,数据问题成落地症结。跨维智能贾奎、港中大(深圳)刘桂良探讨突破具身智能学习枷锁的方法,提出Efficiency Law和GS - World世界模型引擎及学习范式。

机器之心
开源动态8

8B模型任务击败GPT-5?阶跃星辰开源Deep Think框架,小模型解锁百万Token测试时计算

阶跃星辰推出并行协同推理框架PaCoRe,让大模型突破上下文窗口和处理速度限制。基于此框架,小模型能解锁百万级Token测试时计算。PaCoRe - 8B在数学基准测试中超越GPT - 5,还具备前沿性能、“综合”能力涌现等优势。

机器之心
算法论文8

脸谱心智陆弘远团队ACL 2026作:别再给模型叠加「高级词」了!模型更爱听「大白话」

脸谱心智与香港中文大学科研人员中稿 ACL 2026 的工作提出 Adam’s Law,即文本频率定律,揭示文本频率对模型训练及推理的重要性,还给出工程解法,实验效果显著,为行业带来思路。

机器之心
新闻资讯8

阿里一口气发了N款模型,让我们向源神致敬。

阿里云栖大会发布众多模型,有Qwen3 - Max、Wan2.5等。Qwen3 - Max对标顶尖模型;Wan2.5支持音画同出;Qwen3 - VL是强大视觉语言模型且已开源;Qwen3 - Omni是全模态模型。此外还有多个模型,构建全场景生态。

开源星探
算法论文8

LeCun有了证据!大模型思考与人类思考存在本质差别

Yann LeCun参与的研究用信息论揭示大语言模型与人类在‘理解世界’上的本质差异。研究引入量化框架,分析主流大模型,发现AI与人类在‘理解’上有三大核心差异,对当前AI发展趋势提出挑战。

AI工程化
新闻资讯7

Kimi模型数学反超DeepSeek!北大校友刘征瀛等领衔

Kimi定理证明模型超越DeepSeek,基于Qwen2.5 - 72B打造,采用Kimi k1.5强化学习训练流程。有两大技术创,还有精简版本,官方有Demo。双方此前比赛就打得有来有回。

量子位
推荐文章7

AI领域并无真正的想法,只有的数据集

作者Jack Morris认为AI虽进步明显,但范式转变级突破不多。大语言模型四次关键突破底层理论早已有之,在于数据。改变数据比调整模型或算法作用更明显,推动AI进步应找数据,如YouTube或具身化数据。

宝玉AI
新闻资讯8

Claude模型危险,鲍威尔召集华尔街紧急开会!全美安全股暴跌2万亿

Anthropic的模型Mythos能力超强,被指或对金融业造成重大风险。鲍威尔和贝森特紧急召集华尔街开会预警。消息传出,美国软件板块暴跌,SaaS领域近2万亿美元市值蒸发。Anthropic拒绝向公众发布该模型,启动防御项目。

新智元
算法论文8

VLA模型为何忽视语言?破解指令跟随幻觉,分布外场景泛化突破

当前VLA模型常依赖视觉线索而非语言指令,导致场景表现不佳。论文提出LangForce方法,引入对数似然比损失,强化模型对语言的依赖,提升分布外泛化能力,还保留语言核心功能。

新智元