基础模型厂商」共找到 8059 篇相关文章

算法论文8

工具增强的多模态LLM综述

多模态大语言模型(如GPT - 4V)虽有强大图文理解能力,但受数据稀缺、复杂任务表现不佳和评估标准不统一限制。论文提出为MLLM集成外部工具,构建全景图,覆盖多维度,还指出挑战与对策。

深度学习自然语言处理
新闻资讯8

刷新硅谷融资纪录!华人具身智能团队刚毕业融资过7亿元,平均年龄不到28岁

华人主导的Genesis AI公司成立仅一月完成1.05亿美元种子轮融资,刷新硅谷两项融资纪录。团队平均年龄不到28岁,靠开源的Genesis物理引擎吸引投资,致力于开发通用机器人基础模型和通用机器人。

量子位
新闻资讯7

对话付昊桓:数值模拟不能被替代,AI 应该放在哪里丨GAIR 2025

在GAIR 2025大会上,付昊桓教授结合地球系统模型与超算实践,探讨数值模拟与AI的边界和可能。他认为数值模拟是基础,AI可补充,二者应深度融合,还谈及气象领域商业价值和未来期待。

AI科技评论
新闻资讯7

Sonnet 5 翻车!同性能价差最高 56倍,海外巨头为何复刻不出 DeepSeek?

Anthropic发布Claude Sonnet 5,官方称补足了Agent能力,价格优惠,但开发者反应不佳。Sonnet 5因tokenizer换代,实际使用成本更高,且比同类模型贵。与之相比,DeepSeek V4 Pro便宜很多,其靠技术实现低价,海外厂商难以复刻。

鲸选AI
新闻资讯8

国内外AI大厂重押,初创梭哈,谁能凭「记忆」成为下一个「DeepSeek」?

文章指出‘记忆’或成引爆新一轮AI浪潮的关键。当前,国内外AI大厂和初创企业纷纷入局,围绕‘记忆’研究是大模型新方向。‘记忆’是技术和应用的双重诉求,研究路线多样且各有优劣,未来竞争激烈,谁能突围尚未可知。

机器之心
算法论文8

ECCV 2026 | 一段视频,重建一个可仿真的动态世界

机器人走出实验室后,训练数据需覆盖真实世界情况。OVOW由多团队完成,被ECCV 2026接收。它从单目视频出发,输出可编辑、可碰撞的实例级Mesh,串联视觉基础模型完成流水线工作,能用于物理仿真。

机器之心
算法论文8

仅用提示词工程摘下IMO金牌!清华校友强强联手新发现,学术界不靠砸钱也能比肩大厂

清华校友杨林和黄溢辰,仅用提示词设计和自我迭代验证流程,让基础模型Gemini 2.5 Pro达到IMO金牌水平。他们设计的流程分六个步骤,用差异化提示词,最终为5道题生成严谨解答。

量子位
开源动态8

开源音视频同步SOTA基座:极简的单流架构,2秒出片

AI视频生成迈入音视频同步新纪元,闭源巨头已展实力,而上海创智学院与Sand.ai联合发布的开源音视频生成基础模型daVinci - MagiHuman,以极简单流架构,2秒就能在1张H100显卡上生成精准音视频同步画面。

AIGC开放社区
算法论文8

半在线RL新范式UI-S1,使得GUI Agent既稳定又规划长远

现有AI训练方法在GUI自动化中各有弊端,本文提出半在线强化学习范式,训练出UI - S1 - 7B模型,性能提升显著,还提出新评估指标SOP,是迈向实用化AI智能体的重要一步。

深度学习自然语言处理
新闻资讯7

曦望,死磕AI推理成本|甲子光年

1月27日,国产GPU厂商曦望发布新一代推理GPU芯片启望S3等。启望S3面向大模型推理定制,设计系统级重构,单位Token推理成本降约90%。曦望还推出超节点方案及推理云计划,目标是极致推理性价比。

甲子光年