「ORCA Lab 1.0」共找到 2679 篇相关文章
“掩码即武器”,四款扩散LLM全部破防 ? 上交&上海AI Lab发现dllm致命安全缺陷
上海交通大学、上海人工智能实验室等团队研究指出,扩散语言模型(dLLMs)有根本性架构安全缺陷。他们提出DIJA攻击框架,能让多个dLLMs大概率生成有害内容,还呼吁从多方面加强dLLM安全。
雷军:小米一直有一颗芯片的梦想
9月25日晚雷军年度演讲深情坦言,小米一直有造芯梦想。其造芯始于2014年松果电子,澎湃S1虽量产但未成功,后停掉SoC研发。2024年小米成功流片3nm芯片,玄戒O1首发于小米15S Pro,表现出色,但雷军称其成功只是第一步。
教多模态大模型学会“反思”和“复盘”,上交&上海AI Lab重磅发布MM-HELIX&AHPO,破解多模态复杂推理难题
上海交通大学和上海人工智能实验室研究团队带来MM - HELIX,这是完整生态体系,赋予AI长链反思性推理能力。其含基准测试、数据集、优化算法,搭载相关技术的模型表现优异,部分成果已开源。
9.1K Star 调参师集体失业!亚马逊造出机器学习“核弹”,3行代码打造高精度模型!
在机器学习普及的当下,自动化机器学习框架降低开发门槛。AutoGluon由AWS AI开发并开源,仅3行代码就能训练和部署高精度模型,支持多类型数据,有诸多亮点,已获9.1K Star。
刷新SOTA高出19.05分!英伟达开源OmniVinci全模态理解模型,只用1/6的数据,实现全方位超越
英伟达研究团队发布OmniVinci研究,该全模态理解大语言模型用六分之一训练数据,在全模态理解基准测试成绩超现有顶尖模型19.05分。它靠创新架构和数据策略实现效率与性能双突破。
抨击AI炒作、曝企业需求为先,Anthropic 联创:模型提 0.01 性能就血赚,算力烧钱但值!
Anthropic由7位前OpenAI核心成员创立,联合创始人兼总裁Daniela Amodei接受采访,谈到成本控制、AI安全及上市可能。她认为AI安全是核心优势,公司谨慎对待支出和算法效率,虽算力投入大,但硬件回报高。
骂谷歌干蠢事、炮轰甲骨文、AI在真实数据库测试得分为0!83岁图灵奖数据库教父的硅谷“狂人日记”
本文是对图灵奖得主、Postgres 奠基者 Mike Stonebraker 的访谈。他直言大模型 Text - to - SQL 在真实数据库测试得分低,批评谷歌、甲骨文等公司做法,还探讨数据库未来,如 Agent 读写与数据库结合、DBOS 技术等。
马斯克“巨硬计划”新动作曝光!从0建起算力集群,6个月完成OpenAI&甲骨文15个月的工作
马斯克“巨硬计划”新动作曝光,6个月从0建起算力集群,完成200MW供电规模。“巨硬”将基于Grok构建多智能体系统,自动化完成软件开发。Colossus II为此提供算力,马斯克亲自督战。
GUI智能体训练迎来新范式!半在线强化学习让7B模型媲美GPT-4o
浙江大学与通义实验室团队推出UI - S1,提出半在线强化学习训练范式。它融合离线与在线学习优势,用三项关键技术构建核心架构,新评测指标SOP更贴近真实表现,实验显示UI - S1 - 7B性能卓越,逼近GPT - 4o。
「具身原生」元年!专访原力灵机汪天才,解析具身智能的「PyTorch时刻」
2月10日原力灵机发布开源具身原生框架Dexbotic 2.0,宣布与RLinf合作。合伙人汪天才将其与RLinf结合定义为具身智能的「PyTorch时刻」。还推出具身大模型DM0和应用量产工作流DFOL,推动具身智能进入「具身原生」时代。