波浪能」共找到 5046 篇相关文章

新闻资讯7

AI遭遇灵魂拷问!这道题所有模型集体翻车,网友:我也不会啊

图像推理现新难题,在Reddit引发热议,目前无AI真正解决。国内外支持图像输入的大模型答案不同,原因是对大立方体规格理解不同。结合提示多次尝试,部分大模型找准方向,人类面对该问题也会困惑。

量子位
推荐文章7

“不用 Cursor和 ChatGPT、手写代码的开发者,怕不是疯了?”

本文围绕开发者是否应使用AI辅助编程展开讨论。支持者认为大模型提升效率,解决琐碎问题;反对者则质疑其可靠性。文中还分析了大模型在编程中的优缺点,如生成代码但也有幻觉等问题,并反驳了一些反对观点。

InfoQ
产品应用8

感觉这次扣子 2.0 触碰了模型和工程的天花板

2026 年,真正好用的 AI Agent 应拆解目标、推进过程和交付验收。扣子 2.0 正式发布,从“给指令的工具”变为“干活的工作伙伴”,有技和长期计划两大核心升级,还具备扣子编程功,拓宽了 AI 力边界。

MacTalk
产品应用7

Sora 2 App 上手体验攻略,附Sora AI视频

本文是Sora 2 App上手体验攻略。Sora 2 PC版依提示词生成精美电影感视频,还可创建虚拟形象;App交互似抖音,录制上传自身形象生成视频。其生成视频镜头自然,有“AI导演感”,但目前时长较短。

AI Reading Hub
开源动态8

13小时不眠不休,300个分身狂敲代码!开源第一易主了

4月20日深夜,Kimi K2.6出道即开源,展示了强大的「全栈交付」力,跑分超GPT - 5.4等。它完成多类型官网制作,300个Agent协作力强,还复刻高盛研报、交付三件套,其Claw群组开启小范围测试。

新智元
算法论文8

体系统如何「边做边学」?斯坦福团队探索在线优化的新范式

斯坦福等校团队提出 AgentFlow 框架及 Flow - GRPO 算法,让智体系统「边做边学」。它由多个智体模块协作,在多领域基准测试中表现出色,小模型也超越大模型,为智体训练提供新思路。

机器之心
开源动态8

开源真强大,不敢相信,太真实,揭秘8.3k star 开源神器 VoiceCraft 如何封神!!!

VoiceCraft 是多团队合作推出的零样本语音编辑与 TTS 开源项目。它几秒克隆语音,实现编辑功,支持零样本文本转语音,在真实场景音频中性超 XTTS - v2、VALL‑E 等模型,解决了内容创作和编辑痛点。

小华同学ai
开源动态8

首篇自进化智体系统技术报告出炉:Token成本直降近10倍,省钱又高效!

全球首个基于‘上下文信息密度最大化’的自进化智体系统GA发布技术报告。它在多基准测试表现惊艳,省近10倍Token,还自我进化。报告深度解读设计理念,剖析自进化力与智体设计思路。

机器之心
算法论文8

量化噪声竟是RL秘钥?QeRL:高效强化学习新范式,一场噪声引发的性革命

近年来,大语言模型在复杂推理任务中面临挑战,强化学习虽更接近人类推理过程,但训练“烧资源”。论文《QeRL》提出量化不仅压缩模型、节省资源,还增强模型探索力,QeRL框架实现训练速度提升、内存占用减半。

深度学习自然语言处理
产品应用8

24小时直播,只靠一张照片?虎牙实时多模态数字人VAM 1.0率先突围行业三堵墙

虎牙推出实时多模态数字人VAM 1.0,只需一张照片就转化成说会唱、可实时互动的数字人。它解决了AI数字人行业的时间、交互、部署三堵墙,稳定性、交互精度和响应速度表现出色,应用场景广泛。

量子位