推理榜单」共找到 2607 篇相关文章

7

AI女歌手攻占美!格莱美天后崩溃:人类嗓音不值钱了

近日,AI歌手Xania Monet登上Billboard电台,签300万美元合约,引发争议。格莱美天后SZA等抵制,认为其贬低音乐;也有歌手觉得可接受。AI降低创作门槛,但也带来版权等问题,其艺术性存争议。

新智元
产品应用8

马斯克挖不动的清华学霸,一年造出 “反内卷 AI”!0.027B 参数硬刚思维链模型,推理完爆 o3-mini-high

新加坡 Sapient Intelligence 推出小型模型 HRM,参数仅 2700 万却能解决复杂推理难题,其不依赖“思维链”,借鉴人类大脑工作方式。该模型准确率超先进思维链模型,推理能力强,具经济性,可提升任务效率。

InfoQ
开源动态8

DeepSeek倒逼vLLM升级!芯片内卷、MoE横扫千模,vLLM核心维护者独家回应:如何凭PyTorch坐稳推理“铁王座”

本文介绍了vLLM的发展,自开源后成科技公司首选推理引擎。因DeepSeek发布,团队转向其模型特性优化;还参与各芯片支持工作。vLLM靠PyTorch支持多硬件,同时拓展到多模态推理,面临竞争仍保持优势。

InfoQ
新闻资讯7

全球最大AI塌房!52%高分答案全是胡扯,硅谷大厂集体造假?

2025年底,《LMArena is a cancer on AI》一文引发关注,其指出LMArena这个权威大模型评测平台问题严重。Surge AI调查发现,52%获胜回答事实错误,39%投票结果与事实相悖,Meta还曾为优化模型。

新智元
新闻资讯7

卡帕西李飞飞辛顿都投了的Transformer专用芯片,签下10亿美元大

Etched是只做Transformer专用芯片的创业公司,获卡帕西、李飞飞、辛顿投资。它宣布流片成功,筹集8亿美元,获10亿美元客户大,还推出一整套面向前沿模型推理的集群系统。

量子位
算法论文8

AAAI 2026 Oral | 大模型「爱你在心口难开」?深度隐藏认知让推理更可靠

合肥工业大学团队提出大模型存在‘隐藏的真伪认知’,论文让模型用此给推理‘打分’,过滤错误推理链。通过多层注意力头探测、构建预测器和新推理扩展策略,提升了推理链稳定性,实验效果优异。

机器之心
算法论文8

「Thinking with Images」推理速度太慢?「Zooming without Zooming」 让AI不调用工具也能「明察秋毫」!

上海交通大学与蚂蚁集团联合团队发布多模态大模型成果“Zooming without Zooming”。该研究提出R2I方法,将“缩放”转为训练目标,使模型次前向传播实现细粒度感知,团队开源的ZwZ模型家族达开源SOTA性能。

AI科技评论
开源动态7

The Batch: 948 | GLM 5.1:面向长时任务的能力提升

Z.ai将旗舰开源权重大语言模型升级为GLM - 5.1,可在个任务自主运行八小时。它专为编程和智能体任务设计,有推理等特性,在多表现佳,但推理和数学能力落后闭源模型,价格有提升。

DeeplearningAI
开源动态8

DeepSeek-R1-0528 打、20+案例全面实测,全球网友狂点赞:实力堪称R2!

DeepSeek 上新的 DeepSeek - R1 - 0528 让 AI 圈沸腾。它在 LiveCodeBench 飙升至第 4 位,性能逼近 OpenAI 的 o3 高级版。全球网友实测后好评如潮,其在多方面能力出色,且完全开源,引发对 R2 的期待。

AGI Hunt
新闻资讯8

a16z 发布百大【生成式AI】消费级应用排行第五版

a16z发布第五版百大生成式AI消费级应用,揭示普通人使用AI习惯的演变,生态趋于稳定。谷歌多款产品上,Grok与Meta加入战局,中国本土赢家崛起,“凭感觉编程”催生真实用户,还公布“全明星”阵容。

宝玉AI