「训练推理协同」共找到 3877 篇相关文章
幻觉的根源找到了:大模型说谎,是为了讨好你
清华大学OpenBMB团队研究发现,大模型胡说八道根源是想讨好用户。他们识别出负责产生幻觉的H - Neurons,占比不到0.1%,其本质是‘过度服从’,在预训练阶段形成,为构建可靠模型提供新视角。
NeurIPS 2025 | ARGRE框架实现高效LLM解毒:自回归奖励引导,安全对齐更快、更准、更轻
北航等机构研究提出自回归奖励引导表征编辑(ARGRE)框架,在LLM潜在表征空间可视化毒性变化路径,实现测试阶段高效“解毒”。实验显示其降低毒性、缩短推理时间,不影响模型能力,优于基线方法。
GPT-5「降智」真相曝光:不是变笨,而是五个超级开关没激活
新智元报道,OpenAI最新提示工程指南揭秘调教GPT - 5的方法。通过调整自主探索倾向、推理深度等五个开关,可让GPT - 5从偶尔靠谱变全能,还介绍了元提示小技巧解锁其潜力。
离开大厂后,“中国自动驾驶第一人”输了两次 | 甲子光年
曾被誉为“中国自动驾驶第一人”的王劲,离开大厂后创业两次皆失败。他先创办景驰科技,后因百度诉讼离开;又成立中智行,坚持车路协同技术,却因落地难、管理问题等破产。
九天大模型大变身:性能狂飙35%!还能一键P大象
7月26日,中国移动在2025世界人工智能大会发布「九天」基础大模型3.0,端到端技术全面升级,复杂推理能力提升35%,智能体调用效率提升21%,还推出代码、数学等专项大模型,多模态能力也焕新。
GraphRAG还在持续进化,FlowRAG让证据链自己流起来
上海AI Lab和华东师大论文提出FlowRAG,它是GraphRAG变体,把RAG检索从按相似度排文本块推向沿证据流找推理路径。在多数据集上表现不错,虽平均Relevance低于LinearRAG,但更能保证证据链完整。
狂揽4万星!换掉OpenClaw太爽了,5美元就能养个AI打工人
Hermes Agent是NousResearch推出的开源Agent神器,上线后在GitHub超4万星。它运行在用户服务器,有六大核心特性,能跨平台对话。技能自维护,形成记忆 - 技能 - 训练数据闭环,应用场景丰富,演进注重安全、稳定与智能。
“商业的HTTP”来了:谷歌CEO劈柴官宣 UCP,Agent 直接“剁手”下单,将倒逼淘宝京东“拆家式重构”?
谷歌CEO近日宣布开放标准UCP,目标是让Agent在线购物,将购物流程拆解成可复用组件。风险投资人认为其想成商业领域的“HTTP”,不少行业人士看好。它还能与其他协议协同,发布首日吸引众多伙伴。
100万亿Token看懵硅谷!全球一半算力写代码,另一半在「搞颜色」 ?
OpenRouter和a16z联合发布报告,基于100万亿Token实证数据揭秘2025年AI发展。开源模型流量占比达30%,推理模型成主流,编程和角色扮演是主要使用场景,亚洲付费使用量翻倍,中文成全球第二大交互语言。
41个榜单SOTA!智谱最新开源GLM-4.5V实测:看图猜地址、视频秒变代码
智谱基于GLM - 4.5打造的开源多模态视觉推理模型GLM - 4.5V,在42个公开榜单中41项夺得SOTA。其功能丰富,玩法升级,还为企业与开发者提供高性价比方案,是100B参数级SOTA标杆。