大模型测试」共找到 9729 篇相关文章

新闻资讯8

奥特曼爆料:GPT-5重构彻底一切!一人顶五个团队

GPT-5的发布或是一场技术变革。奥特曼在对谈中给出未来清单,谈到年轻人学习方向、创业思路等。他认为GPT-5是飞跃,年轻人要掌握AI工具,还提出评估模型智力新指标等。

新智元
新闻资讯7

智能流体力学青年学者论坛第28讲:伦敦城市学Manolis Gavaises教授

智能流体力学青年学者论坛第28讲于2025年12月4日9点至12点在航空楼A110举办。多位学者分享成果,如Manolis Gavaises用机器学习建模多相流;方波李研究超临界流体湍流;陈杰石提出涡模拟子网格模型等。

力学与人工智能
新闻资讯8

银河通用完成25亿元新一轮融资,具身智能“头号玩家”现身|甲子光年

2026年初具身智能公司融资热起,银河通用完成25亿元新一轮融资,估值超200亿。其自主研发具身智能数据体系与模型,春晚亮相后产品畅销,在工业和服务端均有成果,具身智能迈向产业化。

甲子光年
推荐文章8

概是我见过最通俗易懂的AI发展历程科普详文了

文章从历史时间线出发,介绍AI诞生、发展历程,涉及细分技术模块。结合案例说明AI在不同阶段的应用,如早期机器翻译、垃圾邮件过滤。还探讨AI模型、智能体等概念,分析调优方法和‘幻觉’问题,展望其未来前景。

腾讯技术工程
新闻资讯7

deepseek v4.1? 梁圣的端午礼物突袭。

群里小伙伴称deepseek官方灰度新模型,手机和web端Flash模型思考模式变,典型bug修复。测试发现幻觉严重,知识库截止概25年6月。同时,deepseek获500亿首轮融资,梁文锋自掏200亿,投资方无投票权,五年锁定期。

探索AGI
算法论文8

ICCV 2025 | EPD-Solver:西湖学发布并行加速扩散采样算法

扩散模型成生成任务主流技术,但逐步去噪机制致推理延迟。西湖学提出 EPD - Solver 算法,融合三类加速思路优势,可减少积分误差、提升生成质量,还能作插件集成,突破扩散模型速度与质量权衡瓶颈。

机器之心
算法论文8

CVPR 2026 | ReFTA:打破张量化PEFT的「权重重建」瓶颈

随着模型发展,全参数微调成本高,参数高效微调(PEFT)成主流。常见基于矩阵低秩分解的PEFT方法有局限,张量化PEFT虽有优势但存在权重重建问题。本文提出ReFTA方法解决该问题,有工程和理论优势。

机器之心
算法论文7

基于Memory Bank的Cursor长会话记忆内存库理论研究与实践

文章围绕Memory Bank展开,介绍其为解决模型长会话记忆瓶颈而设计的机制,包括存储、检索、更新模块。阐述其在编程和知识库建设的应用,还评测了Codelf等工具,指出Memory Bank是AI迈向智能的重要一步。

阿里云开发者
产品应用8

不卷速度卷验证,陈天桥MiroMind精准预测15天后黄金价格

陈天桥带队的MiroMind发布新一代重型推理智能体MiroThinker-1.7和MiroThinker-H1,在基准测试中表现优异,超越众多顶尖模型。该模型不仅通用任务强,在科技金融等专业领域也表现亮眼,还能承担真实长链条智力任务。

量子位
推荐文章7

刚刚,Thinking Machines Lab博客提出在策略蒸馏,Qwen被cue 38次

Thinking Machines Lab发布《在策略蒸馏》博客,提出在策略蒸馏可结合强化学习纠错与SFT奖励密度,成本低且能让小模型有强性能。该成果受Qwen团队启发,量用Qwen3模型。还对比了不同训练方法。

机器之心