「稀疏混合专家模型」共找到 754 篇相关文章
Data Agent 落地挑战:忽略技术框架、语义能力和运营体系,投入可能打水漂
Data Agent 看似易上手,落地却充满挑战。腾讯数据工程专家虎兴龙指出,90% 难点源于软件工程,统一语义层建设是关键。企业若忽略相关要点,投入或打水漂,掌握关键要素可提升数据智能化效率。
40年后,Dijkstra算法极限再被突破,清华段然团队更快最短路径算法摘STOC最佳论文
清华交叉信息研究院段然团队研究出全新算法,改进图灵奖得主等人1984年提出的算法,跳过不必要排序,专注重要点间最短距离,缩短计算时间。该研究在STOC 2025获最佳论文奖。
推理路径的动态调控:让大模型学会“恰到好处”的思考
当前大模型推理路径存在冗余问题,本文提出测试时提示干预框架PI(π),通过《When/How/Which》三模块协同,将人类专家经验融入推理过程,在多个STEM基准测试中缩减推理步骤、提升准确率。
重塑浏览器!微软在Edge加入AI Agent,自动化搜索、预测、整合
今天凌晨微软官网宣布在浏览器Edge中加入Copilot模式,它像多层级混合智能体,能自动执行搜索、整合等操作,有标签筛选等创新功能,可提升效率,还保障隐私安全,已免费开放。
MSSP | 西北工业大学马启悦,高传强等:融合激波位置的跨声速抖振气动载荷辨识
本文提出融合激波位置的跨声速抖振气动载荷辨识方法,从时序流场提取激波特征,用稀疏辨识构建参数化代数方程,增强预测精度与泛化能力,为准确预测跨声速气动载荷提供新思路。
Anthropic总想摔碎程序员饭碗,甩出了“以后只招两种人”名单。
昨天Anthropic发布新产品Claude Tag,被Karpathy赞为LLM交互第三范式。Claude Tag与之前的Claude Code远程插件有4方面差别。产品负责人Fiona Fung分享,Anthropic人均代码交付量剧增,招人只看两类人。
全国大学生,苦 AIGC 检测久矣
央视报道,多位高校学生毕业论文被 AIGC 检测系统误判,甚至《滕王阁序》《出师表》也被标为高风险。检测原理主要依赖「AI 困惑度」和「突发性」。毕业季检测算法升级致结果大幅波动,引发学生不满。
哈佛《Science》研究:大模型已碾压人类医生!
哈佛医学院等团队让OpenAI o1系列大模型与数百位医生在多项测试中较量,大模型在各项诊断和管理推理任务上全面超越人类专家,不过当下模型处理非文本信号有局限。
首个实时端侧部署世界模型,20万小时人类视频,BeingBeyond实现「两级跃迁」
4月14日,BeingBeyond发布具身世界模型Being - H0.7,将人类视频规模扩至20万小时,采用隐式推理范式,6项权威评测综合第一。还率先实现端侧实时部署,打通数据闭环,推动模型通用与专家能力跃迁。
奥特曼点名「AGI最后一块拼图」!记忆,才是硅谷2026新共识
2026年,AI竞争焦点从Scaling转向记忆。奥特曼押注记忆,预计ChatGPT产品线未来一年有进展。AI记忆能力成新共识,提升其记忆成巨头竞争核心,不过距完善记忆系统还远。