「技术问题」共找到 5539 篇相关文章
北大腾讯突破奖励模型瓶颈!让AI理解人类偏好,泛化能力比肩GPT-4.1
北京大学知识计算实验室联合腾讯等机构提出RewardAnything,突破奖励模型瓶颈。它让奖励模型理解自然语言评判原则,降低成本,泛化能力比肩GPT - 4.1,还能用于定制AI行为模式。
被 AI 大厂逼至绝望,这帮欧洲人发起了一场“科学复兴运动”
AI前沿成果被科技巨头锁在“黑箱”,欧洲科学家、工程师等发起“科学复兴运动”成立LAION。他们构建开放数据集,训练出表现优异的模型,还进行“爱丽丝梦游仙境”研究测试大模型,探讨推理模型发展方向。
疯狂……韩国开发出强大的核灾难处理人形机器人。丑,但实用
韩国原子能研究院正开发用于核灾难响应和废料处理的人形机器人,目标是能举200公斤重物。与其他机器人相比,其举重能力优势明显。不过在真实核灾难现场应用还需长期测试。
从RLHF、PPO到GRPO再训练推理模型,这是你需要的强化学习入门指南
强化学习是当今LLM重要技术,Unsloth团队发布教程,从吃豆人谈起,介绍RLHF、PPO到GRPO,分享用GRPO训练推理模型技巧,涵盖相关概念、训练方法及奖励函数设计等内容。
模型合体!上交&上海AI Lab&华师提出LED-Merging,拒绝「能力」与「安全」二选一
上海人工智能实验室等团队提出LED - Merging解决模型融合“安全 - 效用冲突”问题。该方法无需训练,像“神经元手术刀”,不牺牲专业能力还提升安全性,论文已被ACL 2025 Main Conference接收。
浙大 95 后团队,发布全球首个旅行 WebAgent
浙大95后团队发布全球首个旅行WebAgent产品「iMeanAI Coyage」,它自称“全球首个真正意义上的AI旅行伙伴”,能打破旅行行业格局,为用户提供一站式服务,解决旅行规划痛点。
4B Qwen3逆袭671B DeepSeek!字节DAPO微调方法这么猛的吗
最新模型Jan - nano引发关注,它在智能体任务上超671B的DeepSeek - V3 0528,在SimpleQA基准获80.7分。它基于Qwen3 - 4B用字节&清华DAPO微调方法。其研发团队是Menlo Research,有开源产品和长远规划。
一个数据集,一年产稿7876篇!AI强力加持,垃圾论文海量爆发
利用美国NHANES公共数据集,结合AI工具,研究者批量生产质量堪忧的论文。这不仅是技术滥用,更是科研评价体系扭曲的缩影。背后有论文工厂作祟,根源在于学术生态的扭曲。
AI又来带货了!字节推出DreamActor-H1自动对齐手势和商品
在电商和数字营销领域,现有框架呈现效果不佳。字节推出DreamActor - H1框架,基于扩散变换器,集成Seaweed - 7B模型,能生成高保真人机交互视频,有效果突破但也存在局限。
三大云厂同时瘫了?Cursor、ChatGPT跟着倒下!网友:整个互联网都要废了
北京时间昨天晚上,AWS、谷歌云、Azure 和 Cloudflare 同一时间发生中断,谷歌云服务全球瘫痪 3 小时,导致旗下及第三方诸多服务受影响。Spotify、Cloudflare 等也受波及,有人猜测是谷歌 Chemist 服务故障所致。