AI大模型」共找到 14013 篇相关文章

开源动态8

模型“看视频写网页”,GPT-5仅得36.35分!上海AI Lab联合发布首个video2code基准

上海人工智能实验室等机构提出IWR - Bench评测基准,从“image - to - code”迈向“video - to - code”,对28个主流模型测试,最佳模型GPT - 5仅36.35分,指出当前模型短板,为研究指明方向。

量子位
算法论文8

好看不等于会交互!阿里发布基于交互的世界模型基准

阿里等联合推出 Omni - WorldBench 评估框架,指出多数高颜值 AI 视频在物理规律和交互逻辑上有缺陷。该框架含提示词套件和量化评估框架,对 18 款模型测评,为 4D 世界模型研发指明方向。

AIGC开放社区
新闻资讯7

计算机科学专业第三次衰退?原因:AI

近日,风险投资人Deedy Das称计算机科学专业迎来第三次重衰退。2025年秋季,该专业在校生人数降幅,排名下跌。历史上该专业有两次衰退,这次AI成主因,不过部分学生转向相关细分专业。

机器之心
算法论文8

字节Seed新作:模型合并如何改变模型预训练范式

字节跳动Seed团队在arXiv发表论文,提出预训练模型平均(PMA)技术。该技术将模型合并引入预训练阶段,可提升性能、预测衰减阶段表现,还能解决训练问题。不过,高学习率影响和强化学习应用待研究。

机器之心
算法论文8

GUI 精准定位新 SoTA:LASER 让模型从“看全图”走向“锁重点”

多模态模型在高分辨率、元素密集的 GUI 场景易误判。苏州学 OpenNLG 团队提出 LASER 方法,让模型学会主动推理,通过关键区域聚焦等提升定位精度,在基准测试中表现出色。

深度学习自然语言处理
新闻资讯8

刚刚,AMD、OpenAI联合发布超强AI芯片,推理提升35倍

今天凌晨,AMD举办2025全球AI发展会,与OpenAI联合发布Instinct MI400、Instinct MI350系列超强AI芯片。MI350推理性能提升35倍,MI400内存配置幅提升。AMD还开源ROCm7平台,7AI平台与其合作。

AIGC开放社区
新闻资讯8

英伟达:RLP 让 AI 在预训练时就学会思考

英伟达研究团队发布 RLP 技术,与传统语言模型训练不同,它在预训练阶段就让模型学会'先想后说'。通过奖励机制自我监督,实验效果惊人,性能提升显著,不挑数据,打破了模型训练范式。

AI工程化
产品应用8

不拼参数,拼认知:工业AI的边界与深水区 | 甲子光年

如今AI渗透工业各环节,形成“小协同”格局,但面临场景复杂、数据孤岛等挑战。西门子凭借深厚积累构建工业体系,其Industrial Copilot等产品落地中国,还自研基础模型突破瓶颈,围绕‘AI for Real’理念布局。

甲子光年
开源动态8

1M 参数干翻 200M!时序预测选模型,你可能一直都选错了

近期时序预测领域新模型频出,作者开源的 QuitoBench 显示,参数量仅 1M 的 CrossFormer 击败模型夺冠。它还揭示模型选择与历史数据长度有关,且数据边际收益高于参数。

AINLPer
算法论文8

GPT-5刷屏吊胃口之际,英伟达发出暴论:小型语言模型才是未来

英伟达新论文指出,未来属于小型语言模型(SLM),挑战了智能体需用型语言模型(LLM)的假设。SLM参数量低于100亿,有低延迟、低成本等优势,还给出从LLM到SLM迁移路线图。

AGI Hunt