「学术顶会」共找到 1571 篇相关文章
AI浪潮下的算力租赁:欺诈套利、资本炒作、主体脱钩
AI浪潮下,算力租赁市场乱象丛生,有上市公司‘炒概念’推高股价,消纳方套壳毁约‘零成本’,租赁方为订单内卷。不过,市场也在自我调整,国家也有调控举措,行业有望回正轨。
Google新研究:降低大模型幻觉的全新视角——充分上下文!
谷歌新研究《SUFFICIENT CONTEXT: A NEW LENS ON RETRIEVAL AUGMENTED GENERATION SYSTEMS》提出“充分上下文”概念,剖析RAG系统失败原因并给出解决方案,对提升企业AI准确性和可靠性有重要意义。
MMAR与AudioTrust技术解读,音频大模型评测前沿进展分享 | AI Bench Talk直播预告
司南评测集社区 CompassHub 收录多维度评测集。此次 AI Bench Talk 直播聚焦音频大模型,将分享评估其深度推理能力的 MMAR 及全方位可信评估框架 AudioTrust,还设圆桌讨论多模态/音频大模型相关议题。
“我的新爱好:眼睁睁看着Copilot慢慢逼疯微软程序员”
近日,Reddit上关于GitHub Copilot的风波引发开发者关注。微软发布Copilot Agent,虽称其擅长开发任务,但在GitHub实践中表现不佳,引发开发者不满,也反映出技术理想与现实落地的差距。
四位图灵奖掌舵,2025智源大会揭示AI进化新路径
2025年6月6 - 7日,第七届北京智源大会将在北京举行。作为AI顶级峰会,今年有四位图灵奖得主参与,还云集顶尖科研人员与企业专家。大会围绕四大主题设近20场论坛,展示AI最新趋势成果,还有特色活动。
华为| 祭出FlashComm1,FlashComm2、FlashComm3,解决LLM推理通算瓶颈
在大模型推理面临通算难题背景下,华为数学家祭出FlashComm 1、2、3。如FlashComm 1优化AllReduce通信,提升推理性能;FlashComm 2重构计算流程,提升推理速度;FlashComm 3实现多流并行,激增模型吞吐。
腾讯混元Hy3发布:Agent能力和产品体验跃升
7月6日腾讯混元Hy3发布,智能水平强于同尺寸模型,比肩大尺寸旗舰模型,定价降低。它已接入多个业务,API上线腾讯云TokenHub。在多领域表现出色,性价比高,采用开源协议,将在多平台上线。
2026年必须搞懂的20个 Agent 工程概念(运行机制篇):大白话一次讲清。
文章聚焦Agent工程运行机制,介绍20个核心概念。如Agent与ChatBot区别在于会‘做’;Harness是模型运行框架;Execution Model决定思考行动范式等,还给出各概念工程实践建议。
Nathan Lambert:GLM-5.2是开源Agent重大突破,连锁反应将渗透进更广泛的经济体
开源AI观察者Nathan Lambert称GLM - 5.2能做顶尖付费AI才能做的事,是开源Agent重大突破。其表现超预期,是首个在编程框架中用着‘手感极佳’的开放权重模型,将给闭源模型带来价格压力。
不是幻觉!Claude自下指令甩锅人类,百万上下文沦为降智重灾区
Claude深陷「角色混淆」Bug,分不清自己的话与用户指令,长上下文成了降智「重灾区」。开发者Gareth Dwyer记录了该bug,研究发现问题出在底层架构的角色标记缺陷。学术界也关注此问题,整个行业需系统性应对。