「全模态技术」共找到 4377 篇相关文章
北大校友,OpenAI前安全副总裁Lilian Weng最新万字博客文章:Why We Think
北大校友Lilian Weng新发布万字博文《Why We Think》,系统梳理让AI模型‘多想一会儿’的前沿方法及逻辑,深入剖析多种机制突破AI性能瓶颈的理论、技术与进展,还提出一系列待解决的开放性问题。
新晋顶流Agent颠覆设计师!Lovart一手实测来了:是该刷屏爆火
新晋顶流Agent Lovart火爆全网,可一句话搞定专业视觉设计,支持二次编辑。量子位实测其设计能力强,背后是多模型融合调度。它定位人机协作,适合中小企业,官网可申请内测。
字节开源DreamO,一个框架包揽多种图像定制需求
近期图像定制研究展示大规模生成模型潜力,但多数方法通用性有限。字节提出DreamO框架,支持多种图像定制任务,有特征路由约束机制,能解决特征冲突,还介绍其技术原理与各任务效果。
AI 开发工具的隐形战场:新一轮 IDE 之争打响!
在AI开发工具领域,VSCode成主战场,但背后有技术和策略拉扯。开发者面临战略选择,VSCode有诸多限制,OpenVSX虽提供替代方案但插件不全,Cursor崛起引发微软动作,未来走向待察。
OpenAI发长文自曝家丑:搞砸了GPT-4o更新,模型“拍马屁”复盘与总结
OpenAI官网发布长文,详细拆解了一次失败的GPT-4o模型更新。此次更新使模型变得“谄媚”,OpenAI解释了原因,包括奖励信号失衡等。还分析了部署前评审流程失效的因素,并表示从中学到诸多经验教训,将修改评审流程等。
当 Agent 会自动上传你的代码库,开源为什么更重要了
本文结合近期闭源Agent私自上传用户代码等隐私事件,探讨Agent深度融入办公后,用户数据资产的归属与迁移问题,分析开源Agent的安全优势,介绍有道开源LobsterAI的产品实践与商业模式。
梅涛的视频AI创业,最新产品来了
本文来自量子位,对梅涛旗下智象未来发布的AI视频创作智能体Vivago R1进行深度实测,介绍产品定位、技术架构,分析AI视频赛道分化路线,分享实测体验,探讨AI创作工具发展方向。
智能体请求暴增 9.4 倍,token 账单却没涨:Uber 公开 AI 软件工厂省钱方法
Uber AI已嵌入软件开发全流程,超70%代码合并请求由智能体生成,半年内智能体请求暴增9.4倍,通过多项优化实现AI总支出稳定,本文公开其整套AI降本方法论。
孪生素数猜想被GPT-6新突破!北大数学07级又出现了
OpenAI发布数学论文,宣布GPT-6 Astra在孪生素数猜想上有新进展,用Lean形式化证明把连续素数间距的上界从246推到186。此外,其3D生成效果出色,Codex还新增可搜索笔记功能。
千亿多肽市场迎来Scaling时刻,清华校友创业用AI重写发现规则 | 对话利太智药贾寅君
本文对话利太智药贾寅君,他从临床医学转向AI药物发现,创业聚焦多肽。他认为多肽泛用性强,能覆盖更多靶点。其团队构建合成数据,开发模型,如MEET、PepMirror,探索将技术落地成药。