新生态位」共找到 4475 篇相关文章

新闻资讯7

OpenAIAgent遭中国24人初创团队碾压!实测成本、质量全输惨,海外用户:中国Agent代差领先

今日凌晨,OpenAI 推出 ChatGPT Agent 功能,能让 AI 助手完成多步骤任务。虽官方称其性能先进,但实际效果有局限。海外用户将其与中国团队产品对比,发现中国 24 人初创团队产品成本、质量更优。

AI前线
开源动态7

视频生成1.3B碾压14B、图像生成直逼GPT-4o!港科&快手开源测试时扩展范式

香港科技大学联合快手可灵团队推出 EvoSearch 方法,支持图像和视频生成。该方法无需训练和梯度更,能提升模型生成质量,展现了 test - time scaling 补充 training - time scaling 的潜力,目前论文和代码已开源。

机器之心
算法论文8

让AI学着“看菜下碟”!港中大等框架让推理长度减少90%,准确率反增17%

香港中文大学等研究者提出TON选择性推理框架,使视觉语言模型能自主判断是否推理。该框架有两阶段训练机制,实验显示其让推理长度最多减90%,准确率还提升,有益模型部署。

量子位
算法论文7

多模态模型具备“物理推理能力”了吗?基准揭示:表现最好的GPT-o4 mini也远不及人类!

来自多机构研究人员构建PhyX基准测试,评估多模态模型物理推理能力。测试显示,即便表现最佳的GPT - o4 mini准确率仅45.8%,远不及人类的75.6%,且模型在多方面存在结构性缺陷。

量子位
6

7B参数比 Kimina 72B 版更强!DeepSeek 模型将“自动化所有运算”?奥赛生实测能力“太棒”

InfoQ
新闻资讯8

黄仁勋对话 10 开源 AI 掌门人:未来算力将向后训练倾斜,OpenClaw 开启了现代计算机的想象|GTC 2026

在 GTC 2026 上,黄仁勋与 10 开源 AI 掌门人探讨开放模型。大家认为 AI 正从模型走向系统,未来算力或向后训练倾斜。OpenClaw 让大众感知到 agent,企业落地难点在治理,开放模型价值体现在可控、定制和信任。

AI科技大本营
算法论文8

给GRPO加上运筹外挂让7B模型比肩GPT-4!Li Auto团队发布多目标强化学习框架 | ICASSP 2026

文本摘要质量评估需兼顾多维度,但开发者优化时易顾此失彼。Li Auto团队提出HVO,基于GRPO框架,让7B模型在摘要任务媲美GPT - 4,且生成内容更简洁,成果被ICASSP 2026接收。

量子位
算法论文8

大模型学会拖进度条看视频了!阿里研究让视频推理告别脑补,实现证据链思考 | ICLR 2026

阿里巴巴未来生活实验室团队解决多模态大模型视频推理难题,推出ReWatch数据集和ReWatch - R1模型。数据集克服现有训练数据痛点,模型用SFT + RL范式及创奖励机制,实验成绩SOTA。

量子位
新闻资讯7

“再也不雇人类了!”高薪员工闪辞,创始人直接用Agent填满工,半年前才被AI坑得删库?

素有‘SaaS 教父’之称的 Jason Lemkin 表示销售部门不再招聘人工员工,将用 Agent 突破 AI 应用极限。SaaStr 目前部署 20 个 Agent 承接工作,虽有人质疑其激进做法,但他仍看好 Agent 应用。

AI前线
开源动态8

美团开源LongCat-Image,6B参数挑战80B效果,中英双语理解、图像逼真度及复杂指令编辑突破

美团开源6B参数图像模型LongCat-Image,在双语文本理解、图像逼真度及复杂指令编辑任务中表现出色。它以轻量化设计超越大模型,还解决中文文本渲染难题,有精确图像编辑能力,且提供全链路开源方案。

AIGC开放社区