「推理能力提升」共找到 6248 篇相关文章

新闻资讯7

宇树机器人上市前再破纪录

IPO前夕,宇树科技放出新一代人形机器人「超人」预告视频,其打破两项世界纪录:0.85米短腿原地起跳2米高,冲刺跑峰值速度超博尔特。该机器人仅研发三月多,后续提升空间大。8月19日宇树将上市。

量子位
产品应用7

电脑操作、技能、连接器、工作伙伴:豆包的牌来了

最近字节有两个豆包相关新闻,一是在训练超大模型,二是反对模型蒸馏。豆包上线大批 Agent 相关工作任务能力,覆盖办公场景,如电脑操作、技能商店等,过程流畅且可观察,还更新移动端,实现远程控制。

MacTalk
推荐文章7

烧了1万块横测,你用的模型可能掉队了

作者花大成本从后端、人味、前端、推理等维度,对glm 5.2、kimi k3等国产模型进行测试,展示各模型在不同测试中的结果,指出国模2T俱乐部的kimi和qwen下限高,且刻板印象需改变。

探索AGI
新闻资讯7

传 GPT-5.6 明日发布:要打赢 Fable 5,光靠刷分可不行

近期GPT-5.6发布消息不断,上线或进入倒计时。它被拿来与Fable 5对比,Fable 5长任务处理出色,而GPT-5.5有短板。GPT-5.6虽跑分亮眼,但被指‘benchmaxxed’,还存在脱离现实常识问题。

AI科技评论
产品应用7

用 Codex 读 DeepSeek 最新论文 DSpark,AI 改变了读书方式

作者用 Codex 加‘论文 Skill’读 DeepSeek 最新论文 DSpark,省一半时间还获图文并茂中文解读材料。介绍了使用方法、优势,如叠三层能力让读论文成共读之事,处理词、段及全文后可重构知识材料。

AI产品自由
产品应用7

不换 Kimi 底座,1/10 成本追平 Opus 4.7?Cursor 用 Composer 2.5 反击 Claude Code

Cursor 发布 Composer 2.5 应对竞争,虽沿用 Kimi K2.5 底座,但通过后训练提升性能。它跑分接近 Opus 4.7,价格更低,在长任务处理上表现更好,还公布多项技术进展,正推进大模型训练。

InfoQ
新闻资讯8

GPT-5.6曝光了!OpenAI砸钱宣战:换掉Claude Code

GPT-5.5发布三周,GPT-5.6曝光且进入开发全速阶段,预计下月亮相。OpenAI本周四将上线「ultrafast模式」,速度提升2 - 3倍。Codex与Claude Code全面开战,OpenAI砸钱吸引开发者,AI自我加速与商业化形成正反馈。

新智元
新闻资讯7

哈萨比斯出的难题,GPT之父接上了:用一个知识停在1930年的模型

GPT之父Alec Radford等用1931年前数据训练13B模型Talkie,切断现代知识污染。研究者测试其能力,探讨它对未来的“预感”、规避污染问题及数据多样性等,同时训练中也面临时间泄漏、数据质量等难题。

机器之心
算法论文8

港大×复旦×上交:视触觉融合+闭环纠错,让机器人双臂协作不再「盲操」

港大联合复旦、上交大提出TAMEn,在UMI框架上全方位升级,构建视触感知融合等数据闭环,打通数据采集到再训练链路。其三层闭环让机器人学得更快准高效,在双臂协作任务中提升成功率。

量子位
产品应用7

扣子 2.5,过了体验那条红线

作者参加扣子Coze官方直播后分享使用感受,认为扣子2.5过了体验红线,普通人打开就能用且能解决问题。它继承龙虾优点,封装大模型能力,前端体验顺畅,还有云手机等功能,虽有不足但值得期待。

刘言飞语