「两小时学习法」共找到 2357 篇相关文章
刚刚,Meta风雨飘摇中发了篇重量级论文,作者几乎全是华人
风雨飘摇的Meta发布重量级论文《Agent Learning via Early Experience》,提出「早期经验」新范式,让AI智能体「无师自通」,为突破强化学习瓶颈提供新思路。该范式结合两种策略,实验效果显著,还指出了局限与未来方向。
AI「学不会」竟成相变探针!UCSD华人联手谷歌等,曝光量子纠缠秘密
加州大学圣地亚哥分校华人学者Wanda Hou等与Google Quantum AI合作,在谷歌超导量子处理器实验,发现机器学习模型‘学不会’对应量子体系测量诱发相变,AI失效成物理探针,还展望了量子AI前景。
用两个简单模块实现分割理解双重SOTA!华科大白翔团队等推出多模态新框架
华中科技大学和金山办公团队联合提出语义增强特征提取器(SEFE)和交错局部视觉耦合(ILVC)模块,构建多模态大模型LIRA,解决现有模型分割不精确和理解有幻觉问题,在分割和理解任务上达SOTA。
超强开源模型Qwen3、DeepSeek-V3.1,都被云计算一哥「收」了
亚马逊云科技两大AI平台支持多款新模型,Qwen3和DeepSeek-V3.1已上线Amazon Bedrock。其坚持“Choice Matters”战略,为用户提供多样选择,保障数据安全,还可基于开源模型定制开发。
芯片大地震,黄仁勋355亿入股!英特尔要为老黄造CPU,股价狂飙30%
芯片行业投下重磅炸弹,英伟达斥资50亿美元入股英特尔成大股东。两家合作,英特尔为英伟达定制x86 CPU,还将推出集成英伟达GPU的系统级芯片,此合作改写行业格局。
华为发布如何利用RL训练强大的Deep Research Agent综述!
华为技术团队发布综述论文,首次系统性梳理利用强化学习(RL)训练强大的深度研究代理。论文指出传统SFT和DPO方法有局限,RL优势明显,还在数据构建、算法设计等方面给出进展与路线图。
GPT-5爆改时尚圈,让Excel原地复活!OpenAI黑客松大奖出炉
OpenAI举办GPT - 5黑客马拉松挑战赛,95支队伍角逐5万美元奖金。韩国Gentoo团队夺冠,其用GPT - 5开发系统助力商家营销。此外,还有团队将GPT - 5用于时尚、电子表格、知识学习、电脑使用、电网决策等场景。
社区供稿 | 开源多模态大模型新突破,书生·万象3.5发布,通用能力、推理能力与部署效率全面升级
2025年8月26日上海AI实验室开源发布书生·万象InternVL3.5,通过创新技术实现推理、部署和通用能力全面升级。它有多种尺寸模型,多项性能领先,还加强了智能体核心能力,应用场景广泛。
RAG2.0进入“即插即用”时代!清华YAML+MCP让复杂RAG秒变“乐高”
检索增强生成系统(RAG)复杂度提升,开发者面临高昂工程成本。基于MCP架构的UltraRAG 2.0框架,让科研人员用YAML文件声明复杂逻辑,降低技术门槛与学习成本,还提升了复杂多跳问题性能。
不靠高薪靠信仰!以文化破局,Anthropic凭「使命驱动」杀出AI人才血路
顶尖AI人才争夺战在科技巨头间白热化,Meta等不惜高薪抢夺。但Claude开发商Anthropic工程师净增长率超对手,它不靠高薪,凭“使命驱动”和独特文化吸引人才,其经验值得国内AI初创企业学习。