「模型能力」共找到 9120 篇相关文章

开源动态8

10项评测痛打GPT-4o!智源重磅开源全球最强具身智能大脑

近日,智源研究院开源具身大脑RoboBrain 2.0 32B版本和跨本体大小脑协同框架RoboOS 2.0单机版。RoboBrain 2.0在多项权威具身智能基准上刷新纪录,RoboOS 2.0创新性集成MCP协议与无服务器架构,二者双擎联动推动机器人迈向群体智能。

新智元
新闻资讯7

苹果正在成为下一个诺基亚

彭博社爆料苹果深陷「史上最大AI危机」,高层警告苹果或成下一个黑莓或诺基亚。AI基础模型负责人被Meta天价挖走,高层老化、人才流失、新品挤牙膏式更新等问题凸显,苹果正面临衰落风险。

AGI Hunt
算法论文7

原来Scaling Law还能被优化?Meta这招省token又提效

2017年《Attention Is All You Need》提出的Transformer是主流语言模型基础范式。Meta新论文提出旋转不变型三线性注意力机制,证明其表现能改变Scaling Law系数,还证实2 - simplicial Transformer在有限token预算下更优。

机器之心
推荐文章8

Data Agent如何帮助企业打造懂你的“电子牛马”?|数势xSelectDB

本文邀请数势科技谭李和飞轮科技肖康探讨数据Agent。谈到懂业务的Agent特点、与传统BI差异,还提及数据库挑战及应用场景,指出Agent能激活数据、提升交互效率,未来将催生新角色。

量子位
新闻资讯7

「超级智能」终极拼图曝光!小扎连撬OpenAI灵魂研究员,Meta梦之队已成形

扎克伯格从OpenAI等机构挖来九位AI顶级人才,涵盖数据、模型、推理等领域,组建无短板「梦之队」,全力冲刺Meta通向超级智能的最后一跃。此前Meta曾高价挖角OpenAI联合创始人,均遭拒绝。

新智元
算法论文7

苹果出手!改进GRPO,让dLLM也能高效强化学习

苹果研究团队针对扩散语言模型(dLLM)在编码任务中表现不明的问题,基于7B级代码生成MDM DiffuCoder展开研究,定制优化GRPO提出coupled - GRPO算法,填补开源dLLM训练和推理机制空白。

机器之心
新闻资讯7

成立 5 年最高估值超百亿,摩尔线程之后,又一家AI芯片独角兽争当“国产 GPU 第一股”

6月23日,沐曦集成电路IPO辅导完成,离A股上市更近一步。它成立于2020年,专注高性能GPU,产品应用广,还与书生・浦语3.0合作。虽曾被曝裁员,但已完成8轮融资。当下国产GPU厂商扎堆IPO,适配DeepSeek或带来机遇。

AI前线
开源动态8

ThinkChain:一个让Claude边调用工具边思考的开源框架

ThinkChain是展示Claude高级能力的Python项目,其核心创新是将工具执行结果注入Claude思维流,改变AI与工具交互方式。它支持零配置启动,有丰富工具集,还具备交互式命令等特性。

AGI Hunt
推荐文章8

深度拆解:为什么通用 Agent 的下一站是 Agentic Browser?

文章指出 2025 年 AI 圈新风暴眼 Agentic Browser 正形成。从 Perplexity 故事讲起,阐述传统系统和浏览器限制通用 AI 发展。厘清通用 Agent、AI 搜索等概念,分析 Agentic Browser 成通用 Agent 下一站的原因,预测 OpenAI 相关产品秋季前发布。

Founder Park
算法论文7

“看懂”指令并做动作!Motion-R1结合COT让角色动起来

大语言模型为文本驱动动作生成带来新可能,但现有方法有局限。GigaAI提出Motion - R1框架,融合“思维链”机制,能分解指令、优化动作合成,虽有不足,但在测试中表现优于主流方法。

带你学AI