「前馈模型」共找到 8039 篇相关文章
前Meta大神创业,用强化学习打造PokeeResearch-7B模型,刷新AI深度研究SOTA
Pokee AI发论文介绍70亿参数的PokeeResearch - 7B模型,用基于AI反馈的强化学习和推理框架,在深度研究基准测试中成绩领先。该公司由前Meta大神创立,产品可打通多应用,已获融资并公开测试。
3B模型性能小钢炮,“AI下半场应该训练+验证两条腿跑步”丨上海AI Lab&澳门大学
上海AI Lab和澳门大学联合发布通用答案验证模型CompassVerifier与评测集VerifierBench,填补Verifier领域循环迭代体系空白。AI下半场评估比训练更重要,当前验证方法有困境,新模型验证精度高且能用于强化学习。
LeCun离职后不止创一份业!押注与大模型不同的路线,加入硅谷初创董事会
离开Meta后,Yann LeCun创立AMI,还加入Logical Intelligence任技术研究委员会主席。该公司推能量 - 推理模型,与主流大模型路线不同,其Kona模型在数独测试上表现远超大模型。
腾讯组织大调整,前 OpenAI 研究员姚顺雨担任首席 AI 科学家
腾讯进行组织架构大调整,成立AI Infra部等部门。前OpenAI研究员姚顺雨出任首席AI科学家,兼任多职。此次调整旨在整合模型、数据、算力,腾讯还大力招募人才,此前元宝借开源起量,凸显自研重要性。
Meta亿元天团首个大模型交卷!余家辉宋飏Jason Wei耗时九个月,一雪Llama前耻
Meta超级智能实验室耗时9个月推出原生多模态模型Muse Spark,发布后股价拉升。它让Meta在第三方测评中赶上第一梯队,虽在编程和长时间自主运行有差距,但在多模态理解等方面表现突出,不过也有编程翻车情况。
速递|前字节Seed强化学习专家孙鹏加入星尘智能,将大模型后训练经验带到物理世界
9月2日消息,前字节跳动Seed团队强化学习专家孙鹏博士加入星尘智能,负责机器人强化学习方向。星尘智能有技术、资本和商业优势,孙鹏经验丰富,此次加入将助力其强化学习后训练发展。
o3-pro答高难题文字游戏引围观,OpenAI前员工讽刺苹果:这都不叫推理那什么叫推理
OpenAI“最新最强版”推理模型o3 - pro引发关注。首位全职提示工程师给它设难题,它推理后答对。OpenAI前员工借此讽刺苹果。各大评测榜单显示其表现与官方有差异,苹果&SpaceX前工程师分享使用心得,肯定其表现。
AI人才争夺战加大薪资差距,OpenAI前副总裁:能留住人才是最重要的
随着AI人才争夺战白热化,大模型公司员工薪酬差距扩大,研究与非研究人员薪资差距明显。OpenAI前副总裁Peter Deng认为留住人才最重要,有独特优势的人定价能力强,Meta未来战略看重超级智能。
英伟达推理服务器被曝高危漏洞,云端AI模型被攻击直接裸奔
安全研究机构Wiz Research曝光英伟达Triton推理服务器一组高危漏洞链,可组合利用实现远程代码执行,造成模型被盗、数据泄露等后果。英伟达已发布补丁,25.07版本前系统有风险。
0产品获苏妈投资!前腾讯AI大牛刘威视频创业,又融了8000万美元
前腾讯AI大牛刘威的AI视频初创公司Video Rebirth完成8000万美元融资,由AMD Ventures等联合投资。资金用于Bach系列模型商业化与全球扩张,其业务面向海外企业和专业个人用户。