大模型平台」共找到 9896 篇相关文章

新闻资讯7

a16z:AI Coding 产品还不够多

a16z两位合伙人发文称AI应用生成平台不是太多而是太少。该领域发展如基础模型竞争,非赢者通吃,各平台找差异化共存。不同水平用户有定制平台,还应垂直细分。

Founder Park
产品应用7

GLM-4.5 验证:智谱已完成一轮“洗牌”

2025年模型热度下降,智谱AI关注度降低。7月28日晚其发布新一代基础模型GLM - 4.5,体现战略调整成效。该模型专为AI Agent打造,性能出色,同时智谱人事、业务、收入等方面也有“洗牌”。

AI科技评论
新闻资讯7

刚刚,Claude两个新模型曝光!

开发者在Anthropic的API中发现Claude的两个新模型代号claude - marshmallow - eap和claude - melon - eap,目前处于内部测试阶段。社区有多种推测,且Anthropic命名风格改变,新模型或下月发布。

机器之心
算法论文8

SIGGRAPH 2025最佳论文出炉,清华、上科、厦获奖!谷歌拿下两篇

SIGGRAPH 2025技术论文奖项揭晓,投稿量首破970篇。5篇最佳论文涉及3D重建、图像个性化等前沿方向,清华、厦、上科均有入选,还有荣誉提名论文和时间检验奖论文公布。

新智元
算法论文8

模拟脑功能分化!北与港中文发布Fast-in-Slow VLA,让“快行动”和“慢推理”统一协作

与港中文研究团队发布 Fast-in-Slow(FiS-VLA)全新双系统视觉 - 语言 - 动作模型,将快速执行模块嵌入预训练视觉 - 语言模型,实现快慢系统一体化。该模型在多平台表现优异,控制频率幅领先。

机器之心
算法论文8

RLPT:腾讯混元在预训练数据上实现自主强化学习

腾讯混元团队发布RLPT,是在预训练数据上应用强化学习的方法,可突破语言模型扩展瓶颈。它能让模型自主学习推理能力,无需人工标注,在Qwen3 - 4B - Base模型实验中性能显著提升。

AI工程化
产品应用8

用AI“打开”金融市场黑盒:微软亚洲研究院如何构建订单级仿真引擎

模型与智能 Agent 崛起的时代,金融行业变革不断。微软亚洲研究院刘炜清在 AICon 会分享,团队构建金融基座模型与 Agent 流程,实现高保真市场模拟与决策优化,还介绍了相关平台模型构建应用。

InfoQ
算法论文8

Think in Games:做一个在王者荣耀中会玩和思考的Agent

文章介绍论文《Think in Games: Learning to Reason in Games via Reinforcement Learning with Large Language Models》,指出当前AI在游戏领域面临的困境,提出TiG框架结合语言模型与强化学习,打造既会做又会说的AI,实验验证其高效性。

深度学习自然语言处理
推荐文章7

中学生就能看懂:从零开始理解LLM内部原理【十】| “过拟合” 与 Dropout

文章围绕神经网络过拟合问题展开,介绍了过拟合的概念、危害及产生原因,阐述了缓解过拟合的正则化方法,重点介绍了Dropout随机失活,还指出其局限性及在模型中的应用策略。

AI大模型应用实践
算法论文8

Dense、MoE之外第三条Scaling路径:交提出JTok模块,省1/3算力

上海交通学与小红书Hi Lab联合团队提出JTok/JTok - M模块,作为插件挂载在Transformer层,几乎不增算力和显存开销却显著提升性能。该模块构建新scaling路径,在多任务测试中全面提分,为模型发展提供新方向。

机器之心