设计工具」共找到 3003 篇相关文章

算法论文8

相机参数秒变图片!新模型打通理解生成壁垒,支持任意视角图像创作

S-Lab等机构研究员提出Puffin统一多模态模型,它能整合理解相机参数与按参数生成对应视角图片的能力。通过“用相机思考”和400万组数据训练,解决此前模型问题,还构建相关数据集和评测基准,性能出色。

量子位
开源动态7

打造图像编辑领域的ImageNet?苹果用Nano Banana开源了一个超大数据集

苹果研究团队提出Pico - Banana - 400K数据集,基于Nano - Banana在OpenImages实拍照片生成编辑对。其系统化设计保证质量与多样性,还构建自我编辑评估流程,为图像编辑模型训练评测奠定基础。

机器之心
算法论文8

均值至上假繁荣!北大新作专挑难题,逼出AI模型真本事

当强化学习成大模型后训练核心工具,主流方法陷入「均值优化陷阱」,推理能力停滞。北大团队提出RiskPO,将风险规避理念融入优化目标,用MVaR+捆绑策略双管齐下,三大任务表现优异。

新智元
产品应用8

你奶奶也能看懂:DeepSeek-OCR的秘密。

本文介绍DeepSeek-OCR,它并非普通OCR工具,而是用“上下文光学压缩”将大量文本信息转为少量视觉Token。其架构含编码器和解码器,压缩效果惊人,重新定义AI“记忆”,或改变AI认知方式。

AI大模型应用实践
推荐文章7

AI 时代,编程语言选型更难也更重要:Go、Rust、Python、TypeScript 谁该上场?

文章围绕AI时代编程语言选型展开,引述Armin Ronacher观点,对比Go、Rust、Python、TypeScript,指出各语言适用场景,还提及AI编程工具影响及创业公司语言选择建议,探讨错误处理和创业体会。

AI前线
推荐文章8

Manus:3大核心策略,破解AI Agent上下文膨胀难题

当AI Agent调用工具结果大量涌入上下文窗口,LLM性能会下滑。Manus联合创始人拆解其上下文工程逻辑,给出‘减少、卸载、隔离’三大策略及模型选择等方法,还提炼出6条实践启示。

CourseAI
新闻资讯7

马斯克亲自点名Karpathy迎战Grok 5!别神话LLM,AGI还要等十年

OpenAI创始元老Karpathy称AGI仍需10年,指出实现AGI难题多。马斯克点名其与Grok 5编程大战被拒。Karpathy还谈及LLM、强化学习、智能体等观点,主张合理看待AI发展。

新智元
产品应用8

挑战Claude code和Cursor:阿里Qoder对标全球,AI编程迎来“上下文”革命

AI编程工具爆发式增长,‘上下文’成实用化难题。阿里推出Qoder平台,结合大模型与Agent,可深度检索代码、理解上下文。本文采访Qoder团队工程师,解析其定位、成本、技术路线等关键问题。

InfoQ
新闻资讯8

腾讯发布超低成本AI训练法!120元效果秒杀70000元微调方案

腾讯提出无训练组相对策略优化Training-Free GRPO,无需调整参数,在提示词中学习经验就能提升模型性能。实验显示,该方法在数学推理和网页搜索任务上效果显著,成本远低于传统方法。

量子位
新闻资讯8

Google封神,计算机视觉的GPT3时刻来了!

Google Deepmind称在CV领域做出类似GPT-3的成果,Veo 3经大规模训练涌现通用视觉理解和推理能力,能以图片+提示词完成复杂视觉任务,还具备感知、建模等四大超能力。

探索AGI