「思考Agent模型」共找到 9679 篇相关文章

开源动态8

迈向AI4S 2.0,上海AI实验室开源书生万亿科学大模型Intern-S1-Pro

2月4日上海人工智能实验室开源万亿参数科学多模态大模型Intern - S1 - Pro,为AI4S迈向2.0提供开源基座。其核心科学能力跃升,底层架构创新,科学与通用能力协同发展,还构建了‘算力 - 算法’一体化基座,推动科研范式革命。

OpenMMLab
推荐文章7

GLM-4.6 vs Claude 4.5:当AI编程模型能力趋同,会用比选什么更重要

文章对比GLM - 4.6和Claude 4.5在AI编程中的表现。用两套提示词测试,发现二者能力接近,GLM - 4.6性价比高,还给出Claude Code + GLM - 4.6的组合使用方法,建议聚焦做产品而非纠结工具。

花叔
算法论文9

扩散模型路线之争可以停了?Latent‑Pixel混合扩散生成新范式上线 | ECCV'26

中科大与智象HiDream.ai团队提出混合潜空间-像素空间扩散新模型Hi-DiT,解决了两类传统扩散路线各自的瓶颈,论文被ECCV 2026接收,在多个主流图像生成任务上取得优异性能,仅小幅增加计算开销。

量子位
新闻资讯8

与Generalist顶峰相见,30天狂吸30亿,千寻智能做对了什么?

2026年4月7日,千寻智能完成新一轮10亿融资,30天内累计融资30亿,由雷军、马云旗下资本领投。其开源具身模型Spirit v1.5展现泛化能力,技术路径获认可。千寻构建多源数据引擎,还通过现实场景数据反哺模型。

机器之心
新闻资讯8

全网炸了!骨折傅盛直播翻车:龙虾3分钟救场,10万人看懵了

春节滑雪受伤后,猎豹移动CEO傅盛躺在床上用语音和截图,基于OpenClaw框架14天养出一支8个Agent的AI团队,产出惊人数据。龙虾三万24小时建站,成本和时间优势明显。直播中三万还解决网站访问问题,揭示Agent核心壁垒是Skill积累。

新智元
新闻资讯8

全球首份大模型业绩报!MiniMax预判2026三大超级PMF,AI平台公司启程了

港交所上市52天,MiniMax交出IPO后首份年报,2026年2月ARR突破1.5亿美元,2025年营收同比增158.9%,毛利飙升437%、亏损率收窄。它产品密集迭代,还预判2026年有三个超级PMF,欲成AI平台型公司。

量子位
算法论文8

港科提出新算法革新大模型推理范式:随机策略估值竟成LLM数学推理「神操作」

香港科技大学联合团队提出 ROVER 算法,跳过传统强化学习推理的策略迭代循环。它在多项数学推理基准上超越现有方法,在高难度任务中大幅提高 pass@1 和 pass@256,且提升推理多样性,更轻量。

机器之心
产品应用8

最高提效8倍!腾讯游戏发布专业游戏AI大模型,美术师做动画不用辣么“肝”了

在Devcom开发者大会上,AI成焦点。腾讯游戏发布游戏创作AI全链路解决方案VISVISE,含动画制作等四大管线,能辅助美术完成重复工作。如MotionBlink可自动补帧,GoSkinning已在多游戏应用,提升了制作效率。

量子位
开源动态8

完全开源的7B模型,性能比肩主流LLM,训练成本仅16万美元,复现DeepSeek的强化学习!

Moxin-7B由多机构团队联合开发,遵循“开源科学”原则,公开全流程细节。它训练成本仅16万美元,评测表现亮眼,在架构、数据策略、训练过程等方面有创新,为中小企业提供可控AI方案。

AI科技大本营
算法论文8

揭秘LLM“思考”之谜:推理即“梯度下降”,元学习框架解构训练过程,还给优化提供新思路

上海AI Lab团队提出RaML框架,从梯度下降和元学习角度揭示LLM“思考”机制。通过实证验证推理轨迹作为参数更新的合理性,还对比不同训练策略,指出RaML为优化LLM性能提供新思路。

量子位