「136亿参数」共找到 1799 篇相关文章
苹果港大终结自回归时代?7B扩散模型发布,AI写代码逻辑彻底颠覆!
苹果联合港大开源扩散大语言模型DiffuCoder,用扩散模型+强化学习策略,性能提升4.4%。研究还提出耦合梯度奖励策略优化方法,建立原生RL训练框架,探究了dLLM的生成机制等问题。
Mistral的首个强推理模型:拥抱开源,推理速度快10倍
本周二,欧洲人工智能公司 Mistral AI 发布全新大语言模型 Magistral 系列,有企业版 Magistral Medium 和 24B 参数开源版 Magistral Small。它推理强、多语言表现好,速度比竞品快 10 倍,应用于主流云平台,成本有竞争力。
别再卷数据了,LLM也怕「过劳死」!CMU等揭秘灾难性过度训练
CMU、斯坦福等四大名校研究团队挑战“预训练规模越大越好”观点,提出“灾难性过度训练”现象,即增加预训练数据可能导致后训练性能下降,并从现实证据、控制实验、理论分析等方面阐述新研究贡献,还介绍了相关实验及结论。
n8n是开源工作流程自动化工具,提供直观界面创建自定义流程,支持超400应用集成。过去一年增长迅速,活跃用户超20万,ARR增长5倍,GitHub获77.5k star。介绍其创立背景、优势特点,用户评价褒贬不一,还提及与其他工具对比及“公平代码”理念。
姚顺雨Agent能力交卷!腾讯混元Hy3把元宝练成了打工人
腾讯混元Hy3正式版发布,总参数295B、激活参数21B,最大支持256K上下文。它是快慢思考融合的MoE模型,重点提升Coding和Agent能力。其加持下,元宝大升级,能完成办公、生活等多场景任务。
孙正义的物理AI帝国:机器人产业的每一层,他都想吃下
2026 年 1 月 14 日,软银领投机器人软件公司 SkildAI 的 14 亿美元 C 轮融资。过去 18 个月,软银在物理 AI 产业栈各层签约,包括基础模型、工业机械臂等。孙正义称软银下一个前沿是物理 AI,正将产业各环节纳入麾下。
硅谷这一夜,属于中国机器人!图灵奖得主、英伟达大牛全来了
美西4月28日,具身智能全球性峰会GEIS在硅谷落幕。中国公司魔法原子发起,图灵奖得主演讲,英伟达等科学家对谈。会上发布世界模型Magic - Mix、灵巧手H01和人形机器人MagicBot X1三款产品,展现全栈自研实力。
刚刚,李飞飞世界模型开源了个渲染神器
今天凌晨,李飞飞空间智能独角兽公司 World Labs 官宣推出「Spark 2.0」,将 3DGS 世界带入 Web,原本专业设备才能运行的 3D 场景,现在任何人可在浏览器访问,该渲染器开源,能流式加载 1 亿 + 的 3DGS 数据。
SVG性能比肩GPT/Claude,腾讯开源3B模型HiVG,让Token「懂几何」
腾讯混元团队开源仅3B参数的HiVG,它是面向SVG生成的层次化分词框架,减少63.8% token数量,多项指标超越GPT-5.2等闭源模型及8B级开源模型,还在人类评测中表现出色。
OpenClaw不会蛋炒饭!Ropedia放出人类经验,机器人「教科书」来了
当LeCun和李飞飞各自拿下10亿美元押注世界模型时,一个更底层的问题浮出水面:谁来为Physical AI提供真正能用的数据?Ropedia给出的答案,不是更多视频,而是一部结构化的、来自真实世界的「经验百科全书」。