喆学大模型」共找到 7951 篇相关文章

新闻资讯7

00后中国女孩0产品创业实现3亿估值:斯坦福数博士的AI量化野心

00后中国女孩洪乐潼创业一鸣惊人,虽无产品和用户,但目标估值3 - 5亿美元。她是斯坦福华人数博士,公司Axiom想为量化和对冲基金公司提供解决数问题的模型能力,获投资人关注。

量子位
新闻资讯8

OpenAI连破10道数难题,Fable 24小时「复现」5道

这个周末,OpenAI与Anthropic两大AI巨头在数前沿短兵相接。先是OpenAI用未发布模型Astra证明10项数成果,不到24小时,Anthropic的Fable复现了其中5项。AI解难题成本降低,成果验证成新考验。

新智元
开源动态8

湾大北交大开源 CutClaw,自动踩点音乐的 AI 智能视频剪辑师!

大湾区大GVC实验室和北京交通大团队开源CutClaw,它是模拟专业后期流程的多智能体系统,能实现音乐驱动剪辑,按文字指令自动剪辑,适配多平台,还可解构素材。操作简单,支持多模型

开源星探
算法论文8

单向VLM变双向!人大斯坦福等提出MoCa框架:双向多模态编码器

人大、斯坦福等机构提出MoCa框架,将单向视觉语言模型转化为双向多模态嵌入模型。它通过持续预训练和异构对比微调,解决传统模型局限,在多模态基准测试中表现优异,尤其小规模模型性能突出。

新智元
算法论文8

博士宿舍激情脑暴,革新了Scaling Law?Qwen和浙大联手推出新定律,直接干掉95.5%推理内存!

近日,阿里与浙大合作提出并行计算缩放定律 ParScale,可在不增参数下提升大模型能力,推理效率更高。它通过引入并行流实现,在数、编程等任务表现佳,适合边缘设备,代码已开源。

AI前线
推荐文章8

对谈 DeepSeek-Prover 核心作者辛华剑:Multi Agent 天然适合形式化数 |Best Minds

文章是对 DeepSeek-Prover 核心作者辛华剑的访谈。他认为强化习是 AGI 关键解法,Multi Agent 适合形式化数。还探讨了 DeepSeek Prover 进展、数与 AGI 关系、评测基准等,指出未来有全才模型和自主 Agent 出现。

海外独角兽
开源动态8

三大核心创新公开,快手开源多模态Keye-VL 1.5拿下视频理解SOTA,8B力压GPT-4o!

快手开源多模态Keye-VL 1.5,为8B视频理解大模型,公开3大核心创新技术。靠Slow - Fast视频编码等,在20 + 基准屠榜。它能精确视频定位,实验显示通用、视频理解和数推理表现佳。

CourseAI
算法论文8

UC伯克利新作颠覆认知:LLM靠「自信爆表」会推理?无需外部奖励超进化

UC伯克利华人团队发现,LLM不靠外部奖励,仅靠「自信爆棚」就能会复杂推理。他们提出基于内部反馈的强化习(RLIF)新范式,用INTUITOR方法让模型用自身置信度作内在奖励,在多任务中表现良好。

新智元
算法论文8

One RL to See Them All?一个强化习统一视觉-语言任务!

国内初创公司 MiniMax 提出 V-Triune 系统,可让 VLM 单一训练流程视觉推理和感知任务。它含三个组件与动态 IoU 奖励机制,基于此的 Orsta 模型在多项测试中性能提升显著,凸显统一 RL 方法有效性和可扩展性。

机器之心
推荐文章8

吴恩达年终总结:2025是AI工业时代的黎明

吴恩达发表2025人工智能年度总结与公开信。总结指出,今年推理模型性能提升但有成本,AI人才争夺激烈、薪酬高,数据中心建设投入大,智能体让编程更高效。信中建议通过课程、动手实践和读论文构建AI系统。

机器之心