「人大高瓴团队」共找到 3522 篇相关文章
建模世界偏好:偏好建模中的Scaling Laws
研究首次揭示人类偏好建模遵循Scaling Law,从论坛收集数据在Qwen 2.5模型训练,发现测试损失随训练规模指数增长线性下降。提出建模世界偏好,论文和模型已开源,还探讨了偏好建模可扩展性等问题。
一分钟做3D音符版“跳一跳”,Flowith成通用Agent新“必玩王者”丨TIP 003
Flowith作为较早出海的AI产品,以自由画布+通用Agent组合出圈。其Neo版本技术功能强,产品服务有亮点,如不限DeepResearch任务、以人为主的智能代理、回答速度快等,虽有不足但未来值得关注。
200K上下文突破:AI编程新星Augment崛起
AI编程新星Augment以65.4%的SWE - bench评分登顶榜首,估值超128亿美元。它能理解海量代码上下文,支持多环境集成。但新式AI编程工具存在安全风险,如Agent Memory恶意攻击等,文中给出应对建议。
14 岁清华天才、普林斯顿最年轻终身教授王梦迪:AI 尚未发现新的基础科学|附完整演讲
本文整理了普林斯顿大学终身教授王梦迪在2026外滩大会的演讲,分析当前大模型在科学发现上的核心局限,提出AI实现自主科学发现的路径,分享了团队的科研实践。
坚决不用行业标准AGENTS.md,Claude Code惹来“封杀令”:Anthropic终于回应了,但开发者更气了
当所有AI编程工具向行业标准靠拢时,Anthropic的Claude Code拒绝支持AGENTS.md格式,引发Shopify CEO公开威胁。开发者多次要求其支持该格式无果,Anthropic回应未让开发者满意,引发争议升级。
大模型推理加速全链路:内存管理、编译优化、量化与并行策略
本文整理自金煜阳博士在QCon大会分享。介绍大模型推理挑战,如规模增大、架构复杂。阐述算子优化、内存管理、量化、异构调度和并行优化方法,还介绍开源推理引擎赤兔在国产芯片的实践成果。
100亿美元押注AI:红杉换帅后,寻找“白天鹅”
2026年8月,红杉资本募得约100亿美元。新掌舵人林君睿和帕特接受专访,称当下是“白天鹅”市场。此前红杉经历领导层更替,新团队调整投资决策,还补仓Anthropic,布局AI多环节。
因果发现大模型迎来「理论破局」: DAG-FM 破解异质机制下的因果图识别与涌现难题 | GAIR Paper 116
浙大、清华与稳准智能联合发布因果发现大模型DAG - FM,解决了现有模型缺乏理论基础、易产生非法环路和显存爆炸问题。它在理论上证明因果图可识别,架构上避免环路,处理数据能力强,还将推进特定领域预训练。
2026「中国 AGI 创新影响力机构 TOP 30」发布
过去一年 AI 行业变化溢出模型层,Coding Agent 铺开,视频生成实现商业变现,具身智能供应链成型。Founder Park 从四维度选出「中国 AGI 创新影响力机构 TOP 30」,涵盖多领域团队。
王炸!模型越接越乱,2.9 万 Star OmniRoute 把 290+ 个 AI 供应商压成一个入口
现在接入AI工具麻烦,换模型要改配置,额度、接口等也有问题。OmniRoute是开源AI Gateway,将多家模型供应商统一到一个入口,支持290+ providers等,可解决接入混乱问题。