「策略改进」共找到 1263 篇相关文章
免训练加速61倍!陈怡然团队新作DPad:仅关注「彩票token」
杜克大学陈怡然团队新作DPad,发现扩散大语言模型关注少量「中奖」token,推理速度可提61 - 97倍,还增强模型语境学习能力。DPad免训练零成本挑关键信息,实现「少算多准」。
JHU教授揭秘学术潜规则:普通博士如何打破鄙视链翻盘?
约翰霍普金斯助理教授Anand Bhattad用亲身经历,总结给博士生的硬核生存指南,揭秘学术潜规则,如出身门槛、指标焦虑等问题,并给出突围策略和主动方法。
火遍全网的AI在线生成前端页面DeepSite开源替代LocalSite
LocalSite AI是现代化网页应用,能按自然语言描述生成HTML、CSS和JavaScript代码。它功能丰富,支持多AI供应商,介绍了技术栈、安装步骤、部署方式、使用指南及发展路线等。
DeepMind 提出 CaMeL,抵御 LLM 提示词注入
谷歌DeepMind研究人员提出CaMeL,作为围绕LLM的防御层,通过提取查询中的控制流和数据流阻止恶意输入,能在AgentDojo基准测试中抵御67%攻击,采用传统软件安全原则。
AGI失控率>90%!MIT教授算出「康普顿常数」,AI地球「夺权率」已锁定?
MIT教授研究指出,即使采用理想监督机制,人类成功控制超级智能概率仅52%,全面失控风险超90%。研究通过量化分析提出嵌套可扩展监督等理念,并在四个真实监管场景验证,探讨如何优化现实监管系统。
新版GPT Image 2.5已经能伪造GPT-6发布会了
GPT-6还未发布,新版生图模型GPT Image 2.5就能伪造其发布会。它升级幅度大,测试显示能伪造奥特曼全员信等,在LMArena测试有生成快、图像逼真等特点,生图或成GPT-6主打功能。
Anthropic发布Fable 5.1:科研、编程能力翻倍,成本最高降45%
当地时间9月1日,Anthropic推出Claude Fable 5.1和Claude Mythos 5.1。Fable 5.1科研、编程能力翻倍,成本最高降45%,还能解决实际问题,此次模型竞争转向多方面综合较量。
15岁进少年班,97后打造「元点机器人宇宙」:全栈技术自研领跑家庭机器人赛道
元点Zeroth发布全尺寸人形Jupiter和异构机械臂家庭协作机器人N1,强调与人类长期共生关系。其创始人是97年的郭人杰,公司已累计融10亿。元点有全栈技术体系,走渐进式落地路线。
3000块钱,这支中国团队把ChatGPT成功的“秘密”用在了机器人训练上
国内穹明智能团队推出千元级手持采集系统 UMI ver.2 并开源。该系统精度达毫米级、能双臂协同,成本低、部署快。团队认为数据是关键,还计划搭建机器人数据 infra,预计新模型范式很快出现。
阿里正式批准林俊旸辞职!CEO亲自挂帅新基模小组
昨日深夜林俊旸官宣告别Qwen,国内媒体确认其离职属实,阿里CEO吴泳铭批准。此外,周靖人继续领导通义实验室,吴泳铭等领导新小组,阿里坚持开源模型策略。