「超参数调优」共找到 2664 篇相关文章
记忆罗盘:大模型智能体记忆的表征、操作与演进航向 | 直播预约
记忆对基于大语言模型的智能体迈向通用人工智能至关重要。来自多所高校及华为的研究团队分析超30000篇论文,提出记忆表征与操作分类坐标系,绘制记忆罗盘指明演进航向。2025.12.24有相关直播。
奖励模型新革命!SWIFT不读文本读“心声”,打造又快又强又省钱的AI裁判
传统Best-of-N方法中的奖励模型成本高、速度慢,限制技术普及。上海交通大学等校研究者提出轻量级技术SWIFT,直接监听模型内部隐藏状态判断信心,效率、准确率等表现出色,为AI发展提供新范式。
追剧不断网,可能背后有个AI在加班,故障诊断准度破91.79%
中兴通讯和中国移动团队针对电信网络故障诊断难题,提出 TN - RCA530 基准和 Auto - RCA 框架。测试多个大模型,初始准确率低,经框架优化后,Gemini - 2.5 - Pro 准确率从 58.99% 升至 91.79%,超人工水平。
空间智能率先落地国民APP!实测:时空决策很顺滑,直达千人N面出行体验
空间智能虽前沿,但在有场景和业务优势时能快速落地。高德地图2025版内测,其“小高老师”智能体按需提供出行和生活建议,AI导航有超视距感知能力,是迈向空间智能的国民APP。
带图推理碾压同类开源模型!港中文微软等开源OpenThinkIMG框架,教AI学会使用视觉工具
港中文、微软等联合推出OpenThinkIMG开源框架,解决AI使用视觉工具面临的集成难、缺数据、适应差等问题,还公开核心技术V - ToolRL。该框架在图表推理任务上表现超GPT - 4.1,为下一代AI智能体提供基础。
诺奖得主刚走,Gemini两大核心叛逃Anthropic!
谷歌人才流失严重,一周内五名顶级研究员出走,Gemini两大核心将入职Anthropic。同时,Gemini 3.5 Pro延期至7月。Alphabet股价下跌,市值蒸发超2000亿美元。原因或是上市期权诱惑和算力分配问题。
Claude Mythos官宣!性能碾压Opus 4.6,因太危险遭「囚禁」
Anthropic官宣最强模型Claude Mythos预览版,性能全方位碾压Opus 4.6。但它存在致命缺陷,攻击安全漏洞能力超多数黑客。Anthropic暂不向公众开放,联合巨头开展安全计划,称需各方共筑网络安全。
Claude全球宕机,机房爆炸!美财政部全面停用,恐遭英伟达断供
Claude深夜宕机近10小时,波及平台与多款模型。原因或为亚马逊AWS数据中心被‘不明物体’击中。美财政部停用Claude,硅谷CEO联名反击。ChatGPT日卸载量飙涨,Claude日下载量超它,Anthropic融资或受影响。
AI4S又一瓶颈被攻克:两个AI「吵架」,让科研代码部署成功率突破95%
科学软件大多难直接运行,制约AI4S与Agentic Science发展。Deploy - Master应运而生,是一站式自动化工作流。Search Agent筛选工具,Build Agent用双模型辩论机制使部署成功率超95%,为科学智能体交互打基础。
“75亿元投资理财”?摩尔线程回应
近期,摩尔线程拟将IPO募集的不超75亿元闲置资金用于现金管理引关注。公司称募投项目分阶段投入,此举为提高资金使用效率,不影响项目推进。12月20 - 21日将举办开发者大会。