「Gemini研究团队」共找到 5209 篇相关文章
英伟达发现RL Scaling!创造力暴涨,做基座模型做不了的事!
过去学界争论强化学习(RL)对语言模型的作用,此前研究认为其效果有限。本文发现问题出在训练时间短,提出ProRL,让训练突破2000步以上,结果惊人,小模型也能有出色表现。
文旅新玩法!藏师傅教你做食物微缩景观宣传海报&视频
作者玩 Gpt - 4o 图片生成时,用食品做键盘图,又结合食物与城市做微缩场景海报,还用 Veo3 做微缩景观生长动画,给出各工具提示词,鼓励大家尝试。
一文解读 LLM Posting-Train技术
文章解读了大语言模型后训练(Post-training)技术,介绍其核心价值,从微调、强化学习、测试时拓展三方面展开,分析现有技术瓶颈,指出前沿研究方向,还给出实践指南和工具链推荐。
CAI+DeepSeek渗透测试情况及扩展分析
文章对CAI+DeepSeek进行渗透测试。介绍CAI安装,在kali按Ubuntu指令装,使用界面友好。测试中CAI执行指令彻底灵活,扫描分析到位。还提及CAI多种能力,称其作为开源框架全面细致,值得研究。
答对之后还能学,答错之后也有用:重新理解推理轨迹的训练价值
本文结合EchoRL、ReflectRL两项最新研究,重新解读推理轨迹的训练价值,解决全答对无强化信号、错题全丢弃的训练痛点,梳理方法设计、实验结果与适用边界,为大模型推理训练提供新参考。
4秒卖出一只的爆款鸭,中国制造,宇树都来推销电机,复刻比买贵?
Hugging Face推出售价399美元的机器鸭Microduck,预售火爆,24小时销售额超260万美元。它开源且可玩性高,社区二创丰富。其配置“五脏俱全”,由中韩中多方合作,软件栈也全套开源,民间复刻成本超原版。
对话陈炜鹏:Loopit 有了 1500 万件作品之后,我们决定做自己的互动世界模型
Loopit 今年 2 月上线,已积累近 1500 万作品,北美数十万青少年成稳定用户。在此基础上,团队发布互动世界模型 Zing - 0.5,探索互动内容新形态。陈炜鹏认为模型与应用应结合,自研是为拓展产品边界。
专访|两位华人主导创办,Jeff Dean参投,伯克利开源项目SkyPilot转型初创
前沿模型团队算力瓶颈从不足变为分散,开源AI算力调度项目SkyPilot应运而生。7月末,它从高校走出成为初创公司,完成2000万美元种子轮融资。其免费版与商业版各有侧重,切入AI编排赛道潜力大。
都说记忆是Agent标配,但MemSyco发现漏算了一件事
厦门大学与吉林大学的最新研究指出,随着大模型Agent具备长期记忆,虽成为“长期协作者”,但也出现Memory-Induced Sycophancy问题。为此提出MemSyco - Bench评测基准,经实验得出多项发现,指出Agent Memory关键瓶颈转变。
AI让科研人发了3倍论文,但科学本身正在收缩:什么才是科研人真正需要的AI?
2026 年研究显示,用 AI 工具的科学家发文量是不用者 3.02 倍,但科研主题覆盖面缩减、虚假引用增多。通用 AI 提升效率却动摇科研基础,爱思唯尔 LeapSpace 注重可信度与发现力,已开放免费试用。