「一站式创作」共找到 1346 篇相关文章
为什么大模型会产生幻觉?OpenAI最新研究终于搞清楚了
OpenAI发布研究论文剖析LLM幻觉根源,指出当前主流训练与评估体系是核心驱动因素之一。现行评估奖励猜测行为,幻觉起源于预训练的‘下一词预测’,论文还澄清五大误区,建议改革评估体系。
字节跳动开源超强USO模型,AI绘图六边形战士来了
在AI图像生成领域,风格和主题驱动的图像生成一直脱节。字节跳动智能创作实验室推出USO模型,构建海量数据集,设计两阶段训练法,引入风格奖励学习范式,化解此难题,且已全面开源。
拖拽式搭建分布式Agent工作流!Maze让非技术人员几分钟搞定复杂任务
大模型智能体落地有诸多问题,Maze分布式智能体工作流框架可提供一站式解决方案。它是集成分布式执行引擎的全能平台,有四大核心优势,还有可视化工具让非技术人员也能轻松搭建工作流。
视频进入可编辑时代:藏师傅教你视频版 Banana 可灵 O1
可灵发布大一统视频、图像生成和编辑工具 O1,支持在一个界面完成视频图片编辑生成。此次更新统一多模态视频大模型,支持多模态输入,有诸多新特性,还支持自由选择视频生成时长和风格转换等。
作为一个AI博主,我劝你先别急着用AI。
作者结合宝玉老师观点,认为想深耕某领域成专家,应在独立练习1000小时后再用AI。还分享自身创作中用AI辅助情况,强调品味重要性,称1000小时练习是建立品味体系的锚定。
山姆•奥特曼刚发长文:《丰盛的智能》,智能将人人可及
Sam Altman 发布新博文《Abundant Intelligence》,展现 OpenAI 的 AI 基础设施愿景。他认为获取 AI 将成经济驱动力甚至基本人权,还提出每周产一吉瓦 AI 基础设施工厂的计划,称增加算力是增收关键。
生数科技认领神秘登顶模型:AI视频公司拿出工业级Demo,跨本体跑通复杂长程任务
生数科技认领神秘登顶模型MotuBrain,该模型4月中旬悄登两国际benchmark。它将预测与行动统一,具一脑多型等能力,技术上走边看边动路线,有响应快等优势。生数科技双轨布局,Vidu与MotuBrain同根。
这一次,谷歌Veo 3.1教Sora做视频!角色0变形,4K竖屏直接满分
谷歌Veo 3.1迎来重磅升级,优化移动端体验,上传素材图片就能创作有趣视频。亮点包括素材生视频一致性强、支持原生竖屏输出、有业界领先的1080p和4K超分辨率,现已可在多平台体验。
Sam Altman 刚刚发文:Sora 2要高速迭代,两大变革直指版权与搞钱
Sora 2因大量侵犯日本动漫 IP 遭日本高层施压。Sam Altman 宣布立即调整,一是赋予版权方更精细的角色生成控制权,二是尝试商业化并与版权方收入分成,还会高频迭代,新方法将用于所有产品线。
时隔一年,再次使用7个国产AI大模型写高考作文,国产模型的进步也太大了!有彩蛋。
去年评测国产模型写高考作文能力时,各模型问题不少,如用词重复、字数不足。今年再次测试7个国产模型,能力有指数级提升,文采惊人,扣题方面通义千问和文心一言表现出色。文末还有海外模型“翻车”彩蛋。