「开源编程模型」共找到 9489 篇相关文章

算法论文7

拟合接近满分,外推却会跑偏:Meta 给缩放律加了一个指数

大模型训练前,团队常用 Chinchilla 缩放律估算模型规模和数据量,但它在模型和数据极不平衡的边界预测易跑偏。Meta FAIR 提出的 Skaling 只增加一个耦合指数,降低外推误差,还采用 L 形采样降低试算成本。

深度学习自然语言处理
算法论文8

CMU朱俊彦等上新LEGOGPT,一句话就能搭乐高,网友:复杂零件行不行?

近日,CMU助理教授朱俊彦团队带来基于文本生成3D乐高的大模型LEGOGPT,输入文本即可快速拼好乐高,生成的乐高还有纹理和颜色。研究人员让机器臂组装模型,结果完美。该模型仍有局限,团队正努力扩展能力。

机器之心
新闻资讯8

「10万小时人类数据」不搞对齐只靠规模,灵初智能Psi-R2登顶MolmoSpaces!

4月10日晚,灵初智能发布大模型、数据集与合作计划,包括策略模型Psi - R2、世界模型Psi - W0及近10万小时人类操作数据。其未走花哨对齐路线,靠系统协同,在MolmoSpaces评测中表现优异,体现自主研发路线先进性。

机器之心
算法论文8

西交大 x A*STAR 论文:让 AI 学会「保持一致」,多图生成迎来关键突破丨CVPR 2026

西安交大与新加坡A*STAR团队提出论文《PaCo-RL: Advancing Reinforcement Learning for Consistent Image Generation with Pairwise Reward Modeling 》,将一致性问题转为“跨图比较”学习问题,结合强化学习实现能力闭环,提升多图生成一致性。

AI科技评论
算法论文8

镜头被油污糊住,机器人还稳定操作?北大/清华等给VLA加一道信息筛选,不靠额外数据,效率提升14x,真机鲁棒性反而更高了 | ICML 2026

北大、清华等机构联合提出StableVLA,相关工作被ICML 2026接收。该工作提出轻量级IB - Adapter,不依赖额外数据对视觉特征筛选对齐,让机器人遇视觉干扰仍能稳定执行任务,实验展现出鲁棒性提升。

量子位
开源动态7

Agent Team 实践与架构设计:在约束下构建可演进的一个人开发团队

作者结合构建的Routa,探讨在Token、流程、工具选择等约束下构建可演进的多Agent系统。介绍了Routa架构、原则,如跨Agent通信、状态外置等,还阐述了各设计要点及示例,强调系统可演进性。

phodal
产品应用8

腾讯 CodeBuddy IDE 如何成为一个“全栈高级工程师”?

腾讯 CodeBuddy IDE 海外版开启内测,国内版预计 8 月上线。它定位‘下一代 AI 全栈高级工程师’,内置 4 个智能体,助力全链路研发。腾讯内部超 43% 代码由 AI 生成,编码时长缩短 40%。

AI前线
产品应用8

Vibe Coding杀进3D领域!OpenAI总裁都在围观这种新玩法

AI 3D 基础模型领先公司 VAST 发布 Tripo P2.0,直接产出原生四边面拓扑,解决生成后模型可用性问题。此外,VAST 完成约 30 亿融资,Tripo 系列在评测中居首。

机器之心
产品应用7

王兴兴亲测后点赞!这家AI公司提前半年把“龙虾”能力带上车,还管住了Token黑洞

宇树科技王兴兴体验宝马新世代 i3 智能座舱后称赞,其核心技术来自斑马智能“元神 AI”。斑马智能发布“元神 AI 汽车机器人大脑”等,对“元神 AI”升级,明确交流和办事方向,还管控 Token 等挑战。

AI前线
7

奥特曼怕了!GPT-5.5「大蒜」决战谷歌,红色警报紧急拉响

三年前ChatGPT让谷歌恐惧,如今OpenAI被谷歌逼得拉响‘红色警报’。OpenAI计划发布新推理模型,‘Garlic’预训练有突破,还启动下一代模型。OpenAI调整策略,聚焦提升ChatGPT体验。

新智元