Opus 5.1」共找到 3351 篇相关文章

开源动态8

英伟达&MIT等推出Long-RL,长视频训练速度翻倍

英伟达联合MIT等推出Long - RL,它是面向长序列推理和多模态强化学习的全栈训练框架,能提升RL训练数据长度上限,让训练速度翻倍。其核心MR - SP并行框架可降低训练耗时和显存,LongVILA - R1是其明星应用。

机器之心
新闻资讯7

山姆奥特曼称OpenAI 有意收购Chrome

OpenAI CEO山姆·奥特曼在晚宴上透露,OpenAI 有意收购 Chrome,认为这能提升自家 AI 浏览器水平。此外,他还谈及 GPT - 5 开发、ChatGPT 相关问题、业务扩张计划等多方面内容。目前因法官考虑强制谷歌出售 Chrome,Perplexity 已报价 345 亿美元参与竞购。

AGI Hunt
产品应用7

季度AI视频生成产品:多模态输入成标配,角逐一站式生成能力 | 量子位智库AI 100

Sora2下载量破百万引发AI视频生成热潮,谷歌推出Veo3.1再掀高潮。国外大厂将其卷至电影制作级创意,国内企业追求高质量、秒级生成并落地垂直场景。量子位智库发布的产品呈现多维度技术演进。

量子位
新闻资讯8

【闭门会干货】字节 AI 最新动态:豆包升级+提示词神器+ SOTA 向量模型 + AI知识库 !

作者参加字节火山方舟开发者闭门会,分享诸多AI成果。豆包模型0715版较0615版能力提升显著;PromptPilot工具让提示词优化工程化;还有Responses API、AI知识库等实用工具,且有免费计划。此外,Seed1.6 - Embedding登顶多榜单SOTA,VikingDB升级,平台有协作奖励计划。

AI进修生
产品应用8

生产级Prompt自动化推理评估A/B实验结果的工程实践

本文围绕生产级Prompt自动化推理评估A/B实验结果展开,介绍系统背景与痛点,展示主Prompt和决策树,用deepseek - r1等模型推理。通过分析Bad Cases优化Prompt,总结设计原则和迭代方法,还给出通用启示与展望。

阿里云开发者
新闻资讯8

Claude 通过率不到 4%,SaaS-Bench 撕碎了 Computer-Use 的「全自动办公」幻想

UniPat AI用SaaS - Bench测试,让Agent在真实工作环境中执行任务。结果显示,Claude Opus 4.7端到端完全通过分数仅3.8%,多数模型表现差,还暴露Agent四种致命缺陷,揭示其与真实工作能力有巨大鸿沟。

机器之心
推荐文章8

在三张圆明园鼠首照片里,我们看到了3D AI的Harness时刻

作者通过三张圆明园鼠首照片开展实测,验证了全新3D AI Harness工作流:通用Agent调度任务、专业3D模型生成、专业软件后处理,仅1.47元即可生成可编辑可交付的3D资产,探讨了3D AI行业的新发展路径。

AI科技评论
新闻资讯8

华人女学霸AI杀疯!本科最难数赛12题全对,自主证明首次公开

24岁华人女学霸Carina Hong初创打造的AxiomProver,在2025 Putnam数学竞赛拿下满分,其自主生成的Lean证明也公开。该竞赛是北美本科生数学竞赛天花板,人类满分罕见。此外,GPT - 5.2 Pro数学表现也很强,引发“奇点将近”之感。

新智元
新闻资讯7

阿里HappyHorse开启灰测,720P视频生成低至0.44元/秒

4月27日,阿里巴巴视频生成模型HappyHorse 1.0开启灰测,全球专业创作者和企业级客户可在官网和阿里云百炼平台注册使用,大众用户可在千问App体验。官网720P视频生成刊例价0.9元/秒,专业会员包月叠加限时折扣后低至0.44元/秒。

AI前线
算法论文7

把 Gemini 和 GPT 放到《我的世界》当教练,谁能看懂机器人的微操?

国立清华与英伟达团队研究《VLM-AR3L》,把Gemini 2.0、GPT-4.1等拉进考场,评估视觉裁决能力。结果显示Gemini综合最稳,开源小模型特定场景反超。还提出VLM-AR3L框架破使用瓶颈,实战超人类手写奖励。

AI科技评论