「大模型开发」共找到 10183 篇相关文章

开源动态8

14.8K Star!这个开源 Skill,一句话就能做出大厂级设计!

Anthropic 发布的 Claude Design 虽能在对话框生成网页,但需手动操作。有人据此开发了开源项目 Huashu Design,可在 agent 里打一句话,3 到 30 分钟就能拿到能交付的设计,还介绍了其功能、核心规则等。

开源星探
开源动态8

世界模型+强化学习=具身智能性能翻倍!清华&加州伯克利最新开源

具身智能发展中样本效率成瓶颈,传统无模型强化学习依赖盲目试错。清华与加州伯克利团队提出BOOM框架,通过自举循环机制解决在线规划与策略学习矛盾,实验表现卓越,为具身智能落地提供支撑。

量子位
推荐文章8

AI Coding 赛道,Solo 创业、6 个月 8000 万卖掉,独立开发的新传奇

Maor Shlomo开发全栈无代码平台Base44,6个月获25万用户后8000万美元卖掉。他复盘了从搭建到推广的全流程,分享产品切入点、与AI协作、渠道增长等经验,强调做喜欢之事,把握用户‘顿悟时刻’。

Founder Park
产品应用8

实测 Seed 2.1:豆包基模超进化,国产模型能力跨过质变点

作者在做面向 Agent 项目时,因 Claude Code 内存开销大,需更轻方案。火山引擎 Force 大会发布 Seed - 2.1,作者实测其在办公、编程、图像理解等方面表现出色,认为它跨越质变点,将赋能国内 AI 生态圈。

特工宇宙
算法论文8

李飞飞又被超越了?百万「普通视频」打造通用4D世界模型!

全行业为昂贵多视角数据发愁时,中科院和CreateAI推出NeoVerse,用百万单目视频打开4D世界模型大门。它抛弃多视角数据和离线预处理,解决扩展性瓶颈,在重建速度、生成质量等方面表现出色,有丰富下游应用。

新智元
推荐文章8

从DeepSeek-V3到Kimi K2:八种现代 LLM 架构大比较

文章对比了DeepSeek-V3、Kimi K2等八种现代LLM架构。介绍各模型独特技术,如DeepSeek V3的多头潜在注意力和混合专家技术,OLMo 2的后归一化策略,Gemma 3的滑动窗口注意力等,探讨架构改进与突破。

PaperAgent
推荐文章7

最新 AGI 暴论:强化学习的「GPT-3 时刻」实现,还需要 1 万年?

国外AI初创公司Mechanize三位创始人联合撰文称,RL或迎“GPT - 3时刻”,但需数千至上万年“模型处理任务所用时间”训练。还提出“复制训练”新范式,能磨炼模型能力,补足短板。

AI科技评论
开源动态8

10.6K star!再见了英文GitHub,这个汉化项目必须安排上,程序员力荐!

文章介绍实用开源项目`github-chinese`,它是GitHub界面汉化浏览器插件。由‘楼教主’开发、maboloshi维护,有开发版和发布版。有全面汉化等特色,还给出安装使用步骤,适合英文不好的新手。

开源先锋
新闻资讯8

OpenAI公开62页核心手稿!AI连破十大「菲尔兹奖级」难题

OpenAI公开62页核心手稿,展示GPT对十大「菲尔兹奖级」数学难题的完整推演,涵盖高维球体堆积、非sofic群构造等。仅花2000美元Token成本,引发全网热议,被指或为GPT - 6,强化学习大佬称像“奇点前夜”。

新智元
新闻资讯7

我在OpenAI修中文

OpenAI研究科学家陈博远介绍GPT Image 2官网博客花絮,分享模型训练、测试情况,还展示亲手制作的官网图片,包括中文彩蛋、漫画、杂志页等,体现模型文字渲染、视觉推理等能力。

机器之心