手动调参」共找到 379 篇相关文章

新闻资讯7

刚刚,北大校友Lilian Weng自曝公司首个产品?一篇论文未发,估值却已90亿

OpenAI前安全副总裁Lilian Weng疑似曝光90亿估值新公司Thinking Machines首个产品——手动调参仪表盘,训练中可调超参数。OpenAI也有AI硬件野心,设想让ChatGPT成全能硬件助

新智元
产品应用7

陪5岁小朋友玩到黔驴技穷,我用一张照片给他做了个汪汪队办。

作者陪5岁小朋友玩时,用一张照片结合Hi3D网页和3D打印技术做汪汪队办。介绍了3D建模、格式选择、代加工等全流程,还分享了成本控制和上色等经验。

探索AGI
产品应用7

小哥硬核搓AI桌宠!接入GPT-4o,听得懂人话还能互,方案可复现

国外小哥Matthieu Le Cauchois受皮克斯台灯机器人启发,搓AI桌宠Shoggoth,接入GPT - 4o,能与人互。它结构简单可复现,采用低级和高级控制层,策略经仿真和真实环境验证有效。

量子位
开源动态7

3.3k星星!用AI做前端效最好的开源项目,给AI写前端代码注入灵魂

现在AI编程做的前端效果不佳,页面不生、特效生硬。而Text-to-Lottie开源框架可通过AI编程Agent快速生成生产级Lottie画,支持多种输入,有实时预览与编辑功能,还能集成多平台,简化效开发。

开源AI项目落地
开源动态8

三大核心创新公开,快开源多模态Keye-VL 1.5拿下视频理解SOTA,8B力压GPT-4o!

开源多模态Keye-VL 1.5,为8B视频理解最强模型,公开3大核心创新技术。它靠Slow-Fast视频编码等,在20+基准屠榜。在多类基准测试和内部测评中表现优异,将业务经验沉淀到开源社区。

PaperAgent
开源动态8

三大核心创新公开,快开源多模态Keye-VL 1.5拿下视频理解SOTA,8B力压GPT-4o!

开源多模态Keye-VL 1.5,为8B视频理解大模型,公开3大核心创新技术。靠Slow - Fast视频编码等,在20 + 基准屠榜。它能精确视频定位,实验显示通用、视频理解和数学推理表现佳。

CourseAI
算法论文8

机器人看视频学操作!伯克利首次打通互联网视频到灵巧真机部署链路

UC Berkeley团队提出端到端流程,跑通从网络视频生成真实灵巧实机执行轨迹链路。解决了单目RGB视频-物交互重建、带噪声参考轨迹作重定向及遥操作规模化难题。还给出数据筛选要点。

新智元
新闻资讯8

击败PI ,清华系具身公司包揽「具身奥林匹克」三项全球第一,刷新世界纪录!

在Benjie's Olympics赛事中,星纪元凭借自研具身智能模型获三项全球第一,击败具身领域老牌公司PI。该赛事规则严苛,星纪元在剥橘子、开锁、翻袜子任务中表现出色,此前其在技术研发和场景落地也成果颇丰。

AI科技评论
推荐文章8

就行,教你从0到1快速搓搭建个GUI Agent

随着通用大模型发展,搭建GUI Agent难度降低。文章介绍如何用通用大模型API,从0到1搭建PC GUI Agent,包括原理、代码实现等,该Agent能跨应用操作,未来可强化功能。

腾讯技术工程
新闻资讯8

OpenAI入股AMD,股价暴涨35%!奥特曼左黄仁勋,右苏姿丰,通吃全球算力

OpenAI宣布与AMD达成战略合作,将部署6GW的AMD Instinct MI450 GPU集群,可认购最多1.6亿股AMD普通股,持股比例或达10%。消息公布后,AMD盘前股价飙升35%。此前OpenAI也官宣与英伟达合作。

新智元