开源方法」共找到 3361 篇相关文章

算法论文8

用中等难度prompt做高效post training

近年来,RL后训练在LLM发展中至关重要,但传统效率低。本文提出PCL轻量级算,通过动态选中等难度提示提升LLM后训练效率,经多基准实验验证其优越性,也指出局限与未来向。

深度学习自然语言处理
新闻资讯7

炮轰黄仁勋,决裂奥特曼!1700亿美元估值背后,硅谷最不好惹的AI狂人

本文介绍AI圈大佬Dario Amodei,因家庭变故投身AI。他带领Anthropic发展迅速,拟融资使估值达1700亿美元。不过公司亏损严重,且面临开源模型竞争。他坚信AI发展快,要加速开发并注重安全。

新智元
算法论文7

The Batch: 979 | LLM 清理智能体的“垃圾”

研究人员提出选择性管理智能体记忆之,小红书Xubin Hao等构建Self - GC。它在送上下文给LLM前,让大语言模型决定内容取舍。测试显示其删历史少且保留必要细节能力强,不过未测其输出质量。

DeeplearningAI
产品应用8

Qwen3.8-Max:编程与办公,全面跃升

今日正式发布Qwen3.8-Max,下周将开源其及Qwen3.8 - 27B模型权重。它参数达2.4万亿,在多面全面提升。开发者可通过千问AI平台获API服务,性价比高。在编程、办公等场景表现出色,用户反馈良好。

千问大模型
开源动态8

多 Agent 并行,手机也能用,已经 4 万星!

GitHub上项目Orca是专为「并行Agent」做的开发环境,开源4个月揽4万+ Star。它让多个Agent在独立git worktree里并行干活,互不干扰,还支持近30款主流Agent,另有多种实用功能,安装也简单。

开源先锋
开源动态8

4B小模型数学推理首超Claude 4,700步RL训练逼近235B性能 | 港大&字节Seed&复旦

香港大学NLP团队联合字节跳动Seed、复旦大学发布Polaris强化学习训练配,让4B模型数学推理能力超商业大模型,且Polaris-4B可在消费级显卡部署,相关内容已全部开源

量子位
新闻资讯7

Anthropic封号OpenClaw之父!复刻、改价、拉黑,24天三连杀

OpenClaw创始人Peter Steinberger的Claude账号被Anthropic封号,后恢复但无官解释。此前Anthropic改价限制OpenClaw使用,且Claude Cowork半年来对标OpenClaw核心功能。这撕开了AI平台与开源agent生态裂痕,也凸显包月模式被Agent算力需求击穿的问题。

新智元
算法论文8

为什么GPT-5算得出微积分,却数不清积木?

文章对GPT - 5展开系统化空间能力测评,涵盖8个基准、超10亿token成本。提出“空间智能六维图谱”,发现GPT - 5在MM和SR达人类水平,但MR、PT等面有短板,还揭示闭源与开源模型在复杂任务上差距小等情况。

深度学习自然语言处理
开源动态8

原生3D-VAEs,1536³三维分辨率,清华与微软TRELLIS 2开启3D全能生成新纪元

清华与微软团队推出TRELLIS 2系统,用全新O-Voxel表示,1分钟生成1536³分辨率3D资产。它解决拓扑灵活性与存储效率矛盾,结合SC-VAE和流匹配模型,在多面超越现有模型,还能适应不同场景。

AIGC开放社区
开源动态8

WRC整理床铺机器人背后模型曝光!端到端双系统全身智能VLA,仅凭少量微调就能get任务

星海图在2025WRC展示G0模型,可让机器人自主完成铺床任务。其发布端到端双系统全身智能VLA模型G0,结合真机数据集与架构,还构建开放数据集,评测结果优于π0模型,即将开源

量子位