「大数据」共找到 6668 篇相关文章
首个多轮LLM Router问世, Router-R1可让大模型学会「思考–路由–聚合」
在大语言模型种类爆炸的时代,如何智能分配任务成新挑战。伊利诺伊大学香槟分校团队发布 Router - R1,让 LLM 学会‘思考–路由–聚合’,用强化学习平衡性能与成本,在七大基准测试表现出色。
没博士没论文,这些人靠什么「野路子」杀进OpenAI等顶级AI大厂?
OpenAI资深研究科学家Noam Brown分享几个真实故事,展示无传统学术履历者进顶级AI大厂的途径,如改进他人论文、发起公开项目、自行发表论文等,还提及本科生机会及薪酬等问题。
1万tokens是检验长文本的新基准,超过后18款大模型集体失智
Chroma团队研究发现,将上下文扩展至1万tokens,18款主流大模型集体“失智”,“智商”非均匀下降,在一些节点会断崖式下跌。研究还设计四项对照实验,证明LLMs性能随输入长度增加显著且非均匀下降。
因果发现进入基础模型时代:CDFM 如何从数据中推断因果结构 | GAIR Paper 120
因果发现正从“手工挑选算法”走向“大模型统一零样本推断”范式。广东工业大学等团队提出CDFM,能统一处理多种情况,解决传统方法痛点,在多方面展现良好性能,是因果发现基础模型时代的重要起步。
给企业应用注入AI:架构师需关注的3大工程挑战与9种设计模式
文章指出企业常将AI引入现有应用,集成时要考虑系统风险。介绍架构师需关注的3大工程挑战及9种设计模式,含可用性、性能、安全增强相关模式,助企业让AI应用从“能用”变“好用”。
RL Infra 行业全景:环境和 RLaaS 如何加速 RL 的 GPT-3 时刻
文章指出RL Scaling正推动AI从“人类数据时代”迈向“Agent体验时代”,RL Infra可弥合模拟与现实差距。梳理了RL环境、RLaaS、数据/评估三大模块,分析代表公司案例,探讨RL未来趋势与投资策略。
大模型自信心崩塌!谷歌DeepMind证实:反对意见让GPT-4o轻易放弃正确答案
谷歌DeepMind携手伦敦大学研究发现,GPT - 4o、Gemma 3等大语言模型有“固执己见”和“被质疑就动摇”并存的冲突行为,原因与训练、决策逻辑、记忆机制有关。研究还通过两轮实验证实。
刚刚,马斯克Grok4干翻谷歌Gemini!o3杀入首届大模型对抗赛决战
首届大模型国际象棋对抗赛第二轮结果出炉,o3以4比0击败o4 - mini,Grok 4在加赛中战胜Gemini 2.5 Pro,二者挺进决赛。8月7日将迎来终局之战,国际象棋冠军将解说。
Kimi K2.5登顶开源第一!15T数据训练秘籍公开,杨植麟剧透K3
Kimi K2.5登上Hugging Face热榜榜首,下载超5.3万。它主打Agent能力,成绩超GPT - 5.2等闭源模型,性价比高。官方技术报告公开其用15T数据训练,还搭载Agent Swarm架构,团队还剧透了Kimi K3。
英伟达发布了跨 AI、机器人和自动驾驶的开放模型、数据集和工具
英伟达发布涵盖多领域的开放模型、数据集和开发工具,扩展多个模型家族。代理式AI领域扩展Nemotron;机器人技术引入Cosmos;自动驾驶有Alpamayo;医疗保健有Clara相关模型。均开放许可,可经GitHub等访问。