「大模型智能体」共找到 10801 篇相关文章
1000+页PDF解析速度暴涨3倍,MinerU模式不香了
百度PaddleOCR推出HPD - Parsing小模型,文档解析速度大幅提升,是上一代最快模型的1.62倍、自身原解码方式的3.06倍。它采用层级并行解码架构,有两层并行设计,效果出色且兼容性好,还分享了优质训练方法和优化思路。
MiniMax 技术闭门会分享:长上下文是 Agent 的 Game Changer
MiniMax 7月10日举办M1技术研讨会,探讨模型架构创新等领域。会议围绕RL能否赋予模型新能力、预训练价值等展开,指出长上下文是Agent的Game changer,混合架构将成主流,还分享了混合架构推理实践及M1相关问答。
Jev是分类器吗?今天向所有人开放,送1.2亿token
近期大火的Jev模型由TypeSafe AI推出,现已向所有用户开放,新用户可获得5美元额度约合1.2亿token。该模型主打快速结构化判断,引发AI社区热议,围绕其定位、能力优劣也有不少讨论与实测。
跨本体、长任务、可预测……Motubrain双榜登顶只是一个开始
本文围绕具身机器人展开,指出当前大多具身机器人干活存在局限。Motubrain 双榜登顶,确立通用机器人大脑干活能力参照系,它具备一脑多能、一脑贯通等能力,生数科技已开启产品落地布局。
为什么 2025 的基模公司都押注 Interleaved Thinking?
本文探讨 2025 年基模公司押注 Interleaved Thinking 的原因。从大模型迭代说起,介绍其在多模型中的体现,阐述该思维链对 Agent 的重要性,还提及 MiniMax 在推动其成行业标准上的诸多努力及带来的影响。
1.5B刷新数学代码SOTA!快手&清华精细化Token管理,LLM推理能力飙升
快手与清华团队用1.5B参数小模型在推理基准上超越同量级SOTA。其Archer方法通过精细化Token管理,对知识型和推理型Token差异化训练,让知识和推理同步更新且互不干扰,在数学和代码任务表现出色。
英伟达周末双炸!CUDA二十年最大更新,顺手屠榜AGI比赛
本周末英伟达有两大动作。一是推出CUDA 13.1,这是CUDA平台诞生二十年来最大更新,引入CUDA Tile编程模型等。二是在Kaggle ARC Prize 2025竞赛中,团队用4B小模型变体夺冠,靠合成数据等策略。
cursor 2.0实测:cursor的摆烂之作
作者实测Cursor 2.0后大失所望。它交互粗糙,多智能体虽有多个回答但选方案操作不明;因Claude涨价推出智能分发和自研Composer,后者除快无优势且需魔法;内置浏览器交互麻烦,窗口管理离谱,语音模式基本不可用。
AI 基础知识从-1到0.1:带你走进机器学习的世界
文章沿着AI发展脉络,从Seq2Seq到GPT模型,深入介绍关键技术原理。以简明方式梳理AI基础概念,涵盖人工智能、机器学习等定义,还介绍了各类学习方法、特征工程及向量化等内容,最后提及模型应用流程和Quick BI助力企业分析。
AI Coding 产品的陷阱:有 PMF 但还没有做到 BMPF
AI Coding 产品增长迅速,如 Lovable 预计年底 ARR 达 2.5 亿美金。但也暴露出盈利难题,多数产品利润为负。解决办法要么自建模型,但成本高;要么等大模型成本下降,却不太可行。AI Coding 产品或未实现 BMPF。