「速度和准确性」共找到 7302 篇相关文章
告别微调!斯坦福提出Agentic上下文工程
当前微调大语言模型成本高、不灵活,‘上下文适应’方法有短板。斯坦福大学等提出ACE框架,将上下文变为动态‘战术手册’,解决现有问题。论文通过实验验证其在性能、成本和效率上优势,为大模型发展指明新方向。
让大模型学会“像人一样”查证真伪
伊利诺伊大学香槟分校等校研究团队提出训练框架Veri - R1,为大模型提供“在线查证”新范式。它借助在线强化学习、精细化奖励机制和高质量数据,让模型学会像人一样查证,在多数据集上表现出色。
刚刚,GPT-5首次通过「哥德尔测试」!破解三大数学猜想
GPT - 5首次通过「哥德尔测试」,破解三大组合优化猜想。研究由海法大学和思科主导,团队设计五项测试任务,GPT - 5在三个简单问题上近乎完美,还推导出不同解法,标志AI从「学习数学」迈向「做数学」。
仅需0.7秒单图像实时3D重建,开源扩散模型
单图像3D重建是计算机视觉难题,传统基于回归和生成式方法各有局限。Stability - AI开源SPAR3D模型,融合两种方法规避局限,仅0.7秒完成单图实时3D重建,实验显示性能显著优于其他基线方法。
十二大顶尖大模型决战华尔街与量化投资
文章解读重磅论文,该研究汇聚五家顶级AI厂商十二个大模型,在标普500指数十一大板块构建投资组合并测试。结果表明,混合智能策略是稳健收益最佳路径,未来量化投资是人机和量化模型三元融合。
人类记忆 vs 大模型记忆,到底差在哪?
这篇发表于 2025 年 10 月《Trends in Cognitive Sciences》的文章,探讨用人类“情景记忆”研究成果改进记忆增强型大语言模型。指出现有 AI 记忆系统存用数据低效,呼吁构建“类人情景记忆”AI,还剖析差异并给出评估方法和展望。
从今天起,开源前五,全!是!中!国!大!模!型!
短短一年,LMArena开源模型榜单前五全被中国大模型占领,智谱Z.ai登顶,阿里、DeepSeek等紧随其后。LMArena是权威评测平台,盲测机制保证排名真实。中国模型性价比高,正用开源和低价占领市场。
PRF | 宾州州立、南科大杨翔、张雯等:粗糙壁湍流的低维建模新范式
传统粗糙壁湍流低维建模依赖经验参数,泛化与精度不足。该研究提出新思路,将粗糙面形貌压缩到低维流形,用自动编码器和前馈神经网络建模,重构效果好、预测准,有生成与泛化性。
直播预约 | SwS: 强化学习训练能否不依赖外部知识优化模型的弱点?
该论文提出强化学习场景下的启发式数据合成流程(SwS),利用模型自我感知弱点驱动自动化问题生成,弥补推理缺陷。对其扩展后适应性更广,在多基准测试集和模型上验证有效,性能提升显著。
拳打可灵,脚踢 Veo 3,谁是物理世界的「懂王」?
多模态视频生成大模型是复杂系统工程,多为巨头游戏。MiniMax的Hailuo 02发布,ELO得分超谷歌Veo 3和快手Kling 2.0。它能呈现复杂运动,处理物理关系,提升训练推理效率,成本低,后续还将更新。