「AI模型性能」共找到 13755 篇相关文章
硬核「吵」了30分钟:这场大模型圆桌,把AI行业的分歧说透了
在WAIC 2025大模型论坛的“模型之问”圆桌中,多位行业大佬围绕大模型展开辩论,话题涉及训练范式、模型架构、数据、开闭源等核心问题,不同观点碰撞,深入探讨大模型技术演进与发展之路。
印奇这次要“从0重做”智驾模型!首谈阶跃和千里双公司布局:中国AI商业闭环要靠车跑出来
智能驾驶行业激战正酣,千里科技与阶跃星辰合作打造“原生智驾基座模型”。印奇首谈双公司布局,认为中国AI商业闭环要靠车跑出来。千里科技收入、利润双增,智驾装机规模将超百万辆,还布局Robotaxi和超级智能体。
硅谷的企业级AI正在这样赚钱|2025人工智能现状报告
ICONIQ Capital发布的2025年人工智能现状报告聚焦企业级AI变现。报告基于对300名软件公司高管的调查,分析了模型选择、支出、工具使用等情况,指出AI产品战略进入新阶段,定价策略在重塑等。
只训练数学,却在物理化学生物战胜o1!新强化学习算法带来显著性能提升,还缓解训练崩溃问题
上海创智学院、上海AI Lab的MM - Eureka系列工作提出新强化学习算法CPGD,缓解训练崩溃问题,提升性能。还构建多模态强化学习框架,推出MMK12数据集和MM - PRM模型,开源相关成果。
上下文工程又进化了:Harness实现AI完全自主化
近期Harness Engineering讨论火热,Harness是围绕AI模型的支撑架构,Anthropic用其突破AI局限,解决AI完成复杂任务时的偷懒问题,还通过多智能体架构用于前端设计、软件开发,经实战检验效果良好,后续还对其进行简化。
AI 设计9个月就能媲美Blackwell?OpenAI “辣芯”绕开英伟达正面战场,但老黄的GPU大盘不稳了
OpenAI 展示与博通联合打造的定制 AI 芯片 Jalapeño,性能媲美英伟达 Blackwell 或谷歌 TPU。计划年底部署,是多代芯片开发首步。它专为大模型推理设计,设计周期短,成本低,OpenAI 借此扩展全栈能力。
Meta超级智能实验室又发论文,模型混一混,性能直接SOTA
大语言模型训练依赖算力和时间,传统模型 Souping 多采用均匀平均。Meta 等研究者提出类专家 Soup(SoCE),利用基准测试类别构成选最优模型,非均匀加权平均,实验显示其提升了模型效果与稳健性,在排行榜获 SOTA 成绩。
刚刚,AI大牛刘威视频创业公司Video Rebirth,完成5000万美元融资
AI视频初创公司Video Rebirth完成5000万美元融资,由刘威博士创立,致力于打造“视频原生的世界模型”。融资用于视频模型迭代等,解决行业痛点,其核心创新机制让模型表现突出。
Agent 框架热潮褪去,大模型开发已经进入“生死局”?
蚂蚁开源发布《2025 ⼤模型开源开发⽣态全景与趋势》报告,涵盖 19 个技术领域 135 个项目,解读七大趋势。当下大模型开发生态如黑客松,项目兴衰快速,AI Search 式微、AI Coding 火热,三大技术领域也有变化。
《时代》2025重塑世界的五大AI进展
本文讲述2025年AI重大进展。中国Deepseek R1开源模型冲击全球格局,AI具备思考能力,特朗普政府推“星际之门计划”,AI公司支出逼近1万亿美元,同时AI与人类关系更复杂,引发风险思考。