「深度学习模型训练」共找到 8744 篇相关文章
3A大作!阿里ROLL团队从基建->算法->机理,推动RL4LLM全栈协同优化
阿里巴巴ROLL团队联合高校推出「3A」协同优化框架,推动「强化学习用于大语言模型(RL4LLM)」迈向新范式。Async架构提升GPU利用率,AsyPPO降低计算资源消耗,Attention机制提升训练效率与可解释性。
AI「学不会」竟成相变探针!UCSD华人联手谷歌等,曝光量子纠缠秘密
加州大学圣地亚哥分校华人学者Wanda Hou等与Google Quantum AI合作,在谷歌超导量子处理器实验,发现机器学习模型‘学不会’对应量子体系测量诱发相变,AI失效成物理探针,还展望了量子AI前景。
华为发布如何利用RL训练强大的Deep Research Agent综述!
华为技术团队发布综述论文,首次系统性梳理利用强化学习(RL)训练强大的深度研究代理。论文指出传统SFT和DPO方法有局限,RL优势明显,还在数据构建、算法设计等方面给出进展与路线图。
阿里开源创新AI Agent:媲美Deep Research,Github每日增长第一
人类信息检索能力受限,OpenAI的Deep Research虽能解决难题但闭源。阿里巴巴通义实验室开源AI Agent框架WebSailor,在多基准测试表现出色,核心技术围绕复杂任务生成和强化学习模块展开,在Github成绩亮眼。
最大的开源GraphRag:知识图谱完全自主构建|港科大&华为
香港科技大学KnowComp实验室与香港华为理论部提出AutoSchemaKG框架,可自主构建知识图谱,无需预定义模式。该系统利用大模型提取知识三元组并归纳模式,构建了ATLAS系列知识图谱,经测试表现优异。
Anthropic CEO:人的幻觉比AI 更多!这是真的吗?
Anthropic公司CEO称AI幻觉比人类少,创业公司ColdIQ联合创始人Alex Vacca用虚构故事喂给ChatGPT、Claude和Gemini,测试它们识破谎言的能力,实验结果显示各模型表现不同,AI幻觉短期内难消失。
ChatGPT要卖 500 美元的Pro Max套餐了!
本文爆料OpenAI正筹备月费500美元的ChatGPT Pro Max订阅套餐,价格为现有顶配的2.5倍,主打最快算力优先级,面向重度生产力用户。因前沿大模型算力消耗过大,业界讨论顶尖AI是否会成为高价特权。
RoboScience机器科学发布轮式仿人形通用机器人REX G1,让机器人真正成为新一代具身生产力伙伴|甲子光年
8月17日,RoboScience机器科学发布轮式仿人形通用操作机器人REX G1,搭载自研的Visics通用具身大模型,面向多场景打造,能完成完整任务闭环。它将移动与操作融合,适应真实环境,具强大泛化能力且续航佳。
独家 | 华为天才少年楼燚航离职创业,要做 200B 以上的「具身大脑」
前华为“天才少年”楼燚航离职创立引力蓝移,定位构建具身大脑。其采用分层架构,认为具身智能Scaling拐点已至,规划了数据来源和模型参数规模。正与汇川合作,按24个月规划推进,面临产品验证挑战。
独家|「中科第五纪」完成数亿元A轮融资,率先开启海外商业落地
AI科技评论独家消息,具身智能企业「中科第五纪」近日完成数亿元A轮融资,年内已完成三轮。该公司还收获海外数亿订单。其提出超少样本具身操作大模型等核心技术,形成完整技术体系。