「个人多模型时代」共找到 8799 篇相关文章
物理学「AlphaGo时刻」?40年未竟之事被AI一举攻破,顶尖物理学家集体傻眼
AI主导设计的物理实验方案让顶尖科学家看不懂却成功了,它设计新颖光学元件布局使LIGO灵敏度提升10% - 15%。此外,AI还在量子纠缠实验设计、解析实验结果等方面展现强大能力,辅助物理学发现的新时代或已到来。
阿里+清华发现80/20法则:LLM只靠20%的token就能学会Reasoning
阿里与清华研究发现,训练大语言模型(LLM)推理时,真正关键的是20%的高熵token,其余80%低熵token几乎无用。仅用20%高熵token做强化学习,效果超全量训练,还提出RLVR训练策略提升效率。
Meta 打造“组织第二大脑”智能体的设计思路
Meta介绍了一款名为"组织第二大脑"的AI智能体设计思路,旨在捕获存储领域专家专业知识,架构结合结构化可审计知识与自改进闭环,无需重训模型即可更新,最初用于合规领域,可推广至多个领域。
算力极限下,OpenAI 急着做什么?
OpenAI联合创始人兼总裁Greg Brockman接受专访,就产品战略收拢、新基座模型Spud等议题给出内部判断,回应业界质疑。他称产品调整是算力硬约束下的优先级排序,还透露了产品核心方向和Spud进展。
拓宽百年奥运「赛场边界」,阿里云AI让人人皆可上场
阿里云作为2026年米兰冬奥会官方云服务合作伙伴,联合发起全球AIGC大赛,用万相大模型生成冬奥视频参赛。万相Wan2.6性能出色,在画质、叙事等方面表现成熟,让普通人也能在奥运体验中当主角。
让 AI 自己打怪升级,Meta用Self-play RL把Coding推向超级智能
Meta FAIR、Meta TBD Lab等朝着“超级智能软件工程Agent”迈出第一步。SSR让大模型零人类标注,靠自生成Bug和自修复稳定碾压人类数据基线,新旧范式对比优势明显,还介绍方法、实验结果与理论洞察。
黄仁勋台上最强GPU炸场,台下感叹“中国芯片爆发”,瞄准6G投资诺基亚
英伟达发布会上,黄仁勋官宣新GPU Vera Rubin,还谈及中国芯片爆发,夸中国模型成果显著。此外,英伟达公布量子计算、6G通信等领域布局,与诺基亚合作入局6G并投资,不过各领域均面临竞争。
AI三问:Agent、LLM、RAG,一文厘清!
文章介绍大语言模型(LLM)、检索增强生成(RAG)和AI智能体(Agent)三种架构。阐述其概念、工作原理、应用场景、优缺点,还做了横向对比,给出选用建议,最后提及混合架构与未来趋势。
腾讯云与 Gartner 联合发布“Data+AI”白皮书,各行业领军企业分享最佳实践
6月27日,腾讯云联合Gartner发布《Data+AI,下一代数智平台建设指南》白皮书。指出GenAI时代数据变化大,腾讯云打造原生一体化Data+AI平台DIaaS,多位技术大咖分享其赋能企业数智化转型实践。
相比层出不穷的 Agent 框架,不变的 Agent Protocol 是什么
文章围绕 Agent Protocol 展开,指出框架更迭但生产级 Agent 系统问题不变。以 Agent Protocol 为主线拆分 Agent Runtime,探讨其核心、稳定对象、执行模型等,还对比各框架在多维度的表现并给出设计建议。