「国产开源大模型」共找到 9191 篇相关文章
RLinf上新πRL:在线强化学习微调π0和π0.5
近年来,基于流匹配的VLA模型成机器人领域前沿技术,但训练依赖大量人类演示数据。清华等机构联合推出在线强化学习微调框架πRL,提出两种微调方案,在测试平台验证了有效性,目前代码等已开源。
一键式训练端到端Agent,Qwen3+MCP工具集高效集成!
RLFactory是开源的端到端RL后训练框架,将环境与RL后训练解耦,有极致易用、高效训练等特点。它让用户专注奖励逻辑和工具配置,还能提升训练效率,用Qwen3和MCP工具可快速训练DeepSearch模型。
当前的上下文方案,本质是暴力破解!DeepMind 创始人:忽强忽弱的 AI,才是真正的灾难,突破在记忆系统
在播客《20VC》中,谷歌 DeepMind 创始人德米斯·哈萨比斯与主持人探讨 AI 未来。他认为 AGI 五年内大概率实现,规模和速度超工业革命;算力是瓶颈,软件记忆系统等突破也重要;还谈及开源、监管、能源等问题。
与Gemini Diffusion共振!首个扩散式「发散思维链」来了
西湖大学齐国君教授团队提出扩散式「发散思维链」,这是面向扩散语言模型的新型推理范式。它与传统思维链不同,能非线性生成,已应用于两种模型,增强后的模型在相关任务上超越现有模型。
GPT-6 Astra 省 Token & 使用技巧大全
本文原创分享GPT-6 Astra的Token节省与实战使用技巧,通过实测对比不同模型搭配的配额消耗效果,给出排雷指南,还介绍了一款开源工具可将普通ChatGPT网页版爆改成全功能Codex,干货充足实用性强。
解析科大讯飞:把AI做成懂你的那一个|甲子光年
2025年中美AI发展路径分化,中国企业探索本土商业化道路。科大讯飞董事长刘庆峰提出自主可控、软硬一体、行业纵深、个性化四个关键词。其用华为昇腾芯片训练出可商用大模型,在多领域展现优势,还发布新功能和产品,为AI商业化提供“中国答案”。
当智能醒于物理世界,英伟达副总裁: 下一个十年属于物理AI!|新智元十周年峰会
在新智元十年峰会上,NVIDIA副总裁赖俊杰揭示公司下一个十年战略核心——物理AI,它是继生成式AI和智能体AI后的下一波浪潮。物理AI与现实物理世界交互,但面临诸多挑战,英伟达为此开源Cosmos世界基础模型。
MIRIX重塑AI多模态长期记忆:超Gemini 410%,节省99.9%内存,APP同步上线
UCSD和NYU团队推出开源的MIRIX,全球首个多模态、多智能体AI记忆系统。它表现亮眼,在多任务中超越传统方法,有类人记忆系统等特点,还上线Mac端应用,开启大模型从对话生成到长期记忆驱动心智的新周期。
我去,真牛!Coze Studio 开源版究竟有多火?看 GitHub 最新 1.4k star 人气飙升!
Coze Studio是低代码、可视化的AI Agent开发平台,有Apache‑2.0开源许可,降低使用门槛。它能解决非专业开发者、企业等构建智能对话助手的痛点,核心功能亮点多,应用场景广,在国产AI Agent开发生态潜力大。
计算机科学学术界死了吗?AI博士生该何去何从
本文整理了德克萨斯大学奥斯汀分校AI博士生曹晋的公开发帖,围绕大模型冲击下AI学术界灌水严重、研究范式过时的观点展开,探讨AI研究者与博士生的未来出路,引发业内广泛讨论。