AI 模型构建」共找到 13848 篇相关文章

算法论文7

AI生成的图片正在反向对齐人类的审美?ICML 2026观点论文Spotlight

UBC和Weathon Software研究指出,图像美学对齐削弱艺术表达。开发者用评估模型让图像生成模型产出符合人类审美的图片,但这导致图片同质化,限制艺术多元性,作者还提出六个相关担忧,并做多项测试验证。

机器之心
算法论文7

从OpenAI AI Phone到Gemini on Android:AI手机时代需要怎样的Agent Harness?

过去一年,AI与手机关系被重新定义,腾讯混元等机构研究PhoneHarness,关注AI在手机上行动及任务完成验证问题。它让手机Agent行动不止GUI,还有Bench检验执行结果,推进AI手机基础设施建设。

机器之心
开源动态7

教你构建私有 AI Coding 平台:Pi、DSH、Codex Harness 扩展能力对比与选型。

文章聚焦构建私有AI Coding平台,对比Pi、DeepSeek Harness、Codex Harness的架构、扩展能力及选型策略。介绍三者交互集成方式,分析其扩展特点,并为不同需求团队给出选择建议。

AI大模型应用实践
新闻资讯7

AI比我们更聪明:李飞飞和Hinton给出截然相反的生存指南

如今AI发展火热,人类对其安全担忧已久。李飞飞和Hinton在Ai4 2025上给出相反答案,前者认为AI会成人类伙伴,安全性靠设计等;后者觉得超级智能或难控制,要造‘关心人类’的AI。还探讨了AI行为两种解读。

机器之心
开源动态7

Agent Team 实践与架构设计:在约束下构建可演进的一个人开发团队

作者结合构建的Routa,探讨在Token、流程、工具选择等约束下构建可演进的多Agent系统。介绍了Routa架构、原则,如跨Agent通信、状态外置等,还阐述了各设计要点及示例,强调系统可演进性。

phodal
产品应用7

AI把一段视频变成可视化网页,Google的新模型又卷飞了。

Google将Gemini 2.5 Pro更新为05 - 06版,此版代码能力在WebDev Arena盲测竞技场登顶,还提升视频理解能力,可将视频变成可视化网页,虽产品有不足,但模型进步值得肯定。

开源星探
产品应用7

我让10个大模型又参加了完整版数学高考,第一名居然是它。。。

作者让10个大模型参加完整版数学高考,单独制定规则,邀朋友协助测试。结果令人意外,单选题第6题成噩梦,多模态题大模型几乎全军覆没。讯飞星火和豆包145分并列第一,Qwen3屈居第三。

数字生命卡兹克
开源动态8

ICCV25 Highlight|格灵深瞳RICE模型狂刷榜单,让AI「看懂」图片的每个细节

格灵深瞳公司灵感团队自研的视觉模型基座RICE(MVT v1.5)刷榜多项视觉任务,在ICCV25获Highlight荣誉。它延续MVT系列理念,提升图片内部视觉特征差异性,在多任务验证中表现优异。

机器之心
新闻资讯7

独家|蚂蚁、美团入局 AI 硬件, Looki 完成超 2000 万美元 A 轮融资

AI硬件创业公司Looki完成超2000万美元A轮融资,由蚂蚁集团领投。其首款产品Looki L1引发关注,全球累计销量近万台。Looki将推主动式AI新功能,持续深耕‘以人为中心’理念。

Founder Park
开源动态8

每次画架构图都快崩溃?这个开源 AI 版 draw.io 一句话帮你搞定

Next AI Draw.io是基于Next.js + draw.io的开源Web应用,给draw.io加了AI大脑。它能让用户用自然语言画图、改图、补图,解决画架构图等耗时费力问题,有诸多功能亮点,适合特定人群。

小华同学ai