评估优化」共找到 1857 篇相关文章

7

前两天刚被群嘲,ChatGPT转头就解决了一个数学难题

前些天,OpenAI研究员宣称GPT - 5‘发现’数学难题解法被指只是检索文献引群嘲。但加州大学洛杉矶分校教授用ChatGPT解决凸优化未决问题,还有教授用其发现命题反例,甚至要将其列为论文一作,AI正成研究伙伴。

机器之心
开源动态8

自回归因果注意力也能并行解码?上交联合UCSD突破LLM推理瓶颈,模型代码全开源

大语言模型推理速度是应用瓶颈,传统方法各有弊端。上交和UCSD团队提出Jacobi Forcing方案,无需重构架构,将AR模型转为并行解码器,提速显著且质量损失小,核心优势多,技术路线全链路优化,实测表现优。

机器之心
开源动态8

抖音&LV-NUS开源多模态新模,以小博大刷新SOTA,8B推理比肩GPT-4o

抖音SAIL团队与LV - NUS Lab联合推出多模态大模型SAIL - VL2,以中小参数规模在106个数据集实现性能突破。该模型从架构、数据、训练三方面创新,后经全链路优化,在多数据集验证中表现卓越。

量子位
开源动态8

英伟达韩松团队新作:具有后神经架构搜索的高效语言模型

英伟达韩松团队推出基于后神经架构搜索的高效语言模型Jet - Nemotron,在基准测试中表现出色,准确率与Qwen3等相当甚至更优,生成吞吐量大幅加速。模型构建经多步骤优化,代码和预训练模型将开源。

量子位
开源动态8

腾讯Kuikly框架进一步开源,新增支持Web,开启一码五端新体验!

腾讯Kuikly框架进一步开源,新增Web版支持H5和微信小程序。该框架基于Kotlin Multiplatform,已被20+业务深度使用。与主流框架对比,它在产物大小、加载速度等方面优势明显,还将持续优化和拓展。

腾讯技术工程
产品应用7

半年研发、1周上线,1秒200行代码爆发?美团研发负责人:靠小团队奇袭,模型和工程能力突破是核心

6月10日美团推出首款AI Coding Agent产品NoCode。美团基础研发平台工程效率负责人程大同在访谈中解答诸多问题,如模型性能优化、产品竞争力、用户使用难点等,还提及产品未来规划和对行业发展的看法。

AI前线
新闻资讯7

大模型IMO25数学竞赛成绩公布了

大模型挑战IMO 2025成绩出炉,Gemini 2.5 Pro以超30%总成绩断崖式领先,超出第二名89%。测试由MathArena组织,采用统一环境和双人匿名评估。还介绍了测试模型、题目及模型表现,人类版结果预计本周六发布。

量子位
新闻资讯8

OpenAI重回巅峰:GPT‑5.5全球SOTA,碾压Opus 4.7

OpenAI发布GPT - 5.5,定位为‘为真实工作而生的新一代智能’。它在编码、科研、办公等多领域表现出色,能力重心转向‘自主完成任务’,在多项评估中成绩优异,还能加速生物医学研究,且Token效率大幅提升。

AIGC开放社区
新闻资讯7

6位前DeepMind老将打造「AI指挥官」,一半成本刷新SOTA

6名前Google DeepMind成员创立Poetiq,搭建元系统让前沿大模型自动生成解决特定任务的策略和模型组合,降低推理成本。其Gemini 3 Pro优化技术在ARC - AGI - 2上创SOTA,成本仅为之前最优方法一半。

新智元
产品应用8

32倍加速,58秒搞定720p视频!字节发布离散自回归框架,统一视觉生成和长视频生成

字节发布InfinityStar框架,将5秒720p视频生成时间从30多分钟缩至58秒,还支持多样任务。它基于对视频本质思考设计时空金字塔模型,将时空分离,通过多项技术优化,性能表现出色,不过也存在一些技术局限。

AIGC开放社区