大模型公司」共找到 10046 篇相关文章

算法论文8

推理正确率下降65.5%!斯坦福、MIT等用「不等式」拷问AI逻辑极限

语言模型在数学证明常现推理漏洞,斯坦福等高校团队提出IneqMath基准评估其严谨性。用不等式证明题切入,拆解为子任务,构建评测体系,用LLM - as - Judge审查。结果显示模型推理正确率低,存在结构性缺陷。

新智元
产品应用7

数字技术工人已到岗!时序模型+Agent已掌握了工厂生产管控技术,比人类更懂工况

基于时序模型和Agent的数字技术工人,能承担生产操作等关键任务,接手复杂工业环节。国内AI团队打造的河谷平台构建智能体,自研底层技术,以工艺维度训练,上岗快,极峰科技还创新商业模式。

量子位
算法论文7

Energy | 西工史子颉、高传强等:三维风力机叶片动态失速数据融合建模研究

动态失速威胁风力机叶片安全与发电效率,传统模型有局限。西工团队开发数据融合神经网络与动量叶素理论耦合框架,能高效高精度预示三维叶片动态失速,虽部分工况有偏差,但预测精度显著提升。

力学与人工智能
新闻资讯8

美国开源被中国甩在身后,套壳创业者更遭惨烈清算!OpenRouter CEO:天天乱用高价AI的员工要小心了

顶级科技播客20VC访谈OpenRouter联合创始人兼CEO Alex Atallah。他指出美国开源模型落后中国,企业怕依赖巨头,AI时代员工成本应动态化,还探讨了模型生态、路由技术等行业热点。

AI科技大本营
新闻资讯8

头部互联网企业交锋,AI时代可观测边界出现了吗?

InfoQ《极客有约》X AICon 直播栏目邀阿里云张城等探讨AI时代可观测新边界。嘉宾们认为AI与可观测技术双向赋能,传统算法与模型互补,未来有望实现半自治运维,还分享了数据治理等经验。

InfoQ
开源动态8

LLM开源2.0洗牌:60个出局,39个上桌,AI Coding疯魔,TensorFlow已死

9月13日蚂蚁集团开源团队发布LLM开源2.0全景图,收录114个项目,39个新晋、60个出局。生态洗牌,Agent层活跃,分类架构细化。AI Coding等领域发展显著,TensorFlow不敌PyTorch,还梳理厂商模型发布情况。

机器之心
算法论文8

RL 将如何提高具身模型 VLA 泛化性?清华学团队NeurIPS 2025文章分析 RL 与 SFT 泛化性差异

清华学团队在NeurIPS 2025发表文章,揭示强化学习(RL)提升具身模型VLA泛化能力的优势,对比其与SFT差异,还提出评测基准和训练方法,为VLA训练提供新方向。

机器之心
新闻资讯8

DeepSeek之后,中国AI「自己出题」杀进Nature通讯!全球仅4家

一家成立不到两年的香港AI公司维纳智能,不堆参数、不依赖人工标注,靠让模型自动生成高精度推理数据登上Nature通讯。其技术可解决Agent泛滥的困局,还推出特色产品,业务增长快。

新智元
新闻资讯7

她拒了贝索斯,离开黄仁勋,只为回答一个问题:AI能学会物理世界吗?

近日,AI初创公司Accelerated Understanding亮相,由Anima Anandkumar夫妇创立。它未随主流,目标是训练模拟物理现象的通用AI模型。该模型处理数据规模公司想解决AI验证瓶颈,产品面向科研工程机构。

DeepTech深科技
开源动态8

抖音&LV-NUS开源多模态新模,以小博刷新SOTA,8B推理比肩GPT-4o

抖音SAIL团队与LV - NUS Lab联合推出多模态模型SAIL - VL2,以中小参数规模在106个数据集实现性能突破。该模型从架构、数据、训练三方面创新,后经全链路优化,在多数据集验证中表现卓越。

量子位