任务性能」共找到 3534 篇相关文章

新闻资讯7

两份报告,两种 PMF:ChatGPT 跑通了 Copilot,Claude 验证了 Agent

OpenAI和Anthropic发布核心产品使用报告,展现ChatGPT和Claude用户心智差异。ChatGPT像Advisor,以询问、写作为主;Claude似Agent,随模型能力提升,用户倾向用其执行自动化任务

Founder Park
开源动态8

刚开源几周,一键深挖你的聊天数据宝藏!

这两天在Github发现开源工具`ChatLab`,它把聊天记录变“私人数据库”,支持用 SQL 和 AI 挖掘社交数据价值。具有本地隐私保护、解析性能强等特性,安装简单,适合不同用户。

开源先锋
新闻资讯8

刚刚,GPT-5.1发布,OpenAI开始拼情商

深夜,OpenAI上线GPT - 5.1 Instant和GPT - 5.1 Thinking模型。前者更温暖智能、指令执行强,后者处理任务更高效易理解,语气温暖。模型将逐步推出,还发布系统卡附录。

机器之心
产品应用8

MiniCPM 4.0来了!220倍极速狂飙,端侧模型的比赛,结束了

面壁智能联合清华发布MiniCPM 4.0,极限场景220倍加速。它是首个原生稀疏模型,有三级火箭推理加速体系,性能强,适配全平台,应用广泛,或成端侧AI分水岭。

AGI Hunt
开源动态8

图像、视频一模搞定!字节全能原生多模态本地可部署

字节开源原生多模态模型Lance,仅3B激活参数,40G显存就能跑,已登顶huggingface趋势榜。它能进行图像与视频的理解、生成、编辑等操作,在多个基准测试中表现优异,多项性能居首。

AIGC开放社区
新闻资讯7

关于GPT-6 Astra的三条判断|甲子光年

北京时间9月4日凌晨,OpenAI发布GPT-6 Astra,演示其多种能力。「甲子光年」判断:GUI没消亡,是软件兼容层;Astra会“吞噬”App入口;传统Benchmark难描述Agent,任务闭环成关键。

甲子光年
新闻资讯8

机械手成精了:能变形、能爬行、自己抓东西,全程无人操控

武汉大学高霄团队设计出可拆卸爬行机械手,能像普通机械手抓取物体,还能脱落爬行够取远处物品。其完成全套取物任务,未来有望用于工厂、救援、家庭等场景。

DeepTech深科技
新闻资讯7

Karpathy 教它的 nanochat 数单词里有几个“r”

Andrej Karpathy 教超小型语言模型 nanochat d32 数单词里字母 r 的数量,创建 SpellingBee 合成任务微调模型,虽像填鸭式教学但有效,不过小模型上下文处理能力有限。

AI工程化
算法论文8

Tokenization谢幕?H-Net登场:Mamba作者新作正面硬刚Transformer

「Mamba」作者之一Albert Gu在新Paper提出新技术,实现动态分块机制,嵌入H - Net可替代传统流水线。在多方面实验中,H - Net性能优于基于BPE token的Transformer模型。

PaperAgent
算法论文7

支持5000+ Server,ScaleMCP为大模型Agents动态同步MCP工具

现有工具选择框架未整合MCP服务器,存在重复、不一致和低效问题。普华永道提出ScaleMCP,配备MCP工具检索器,还提出TDWA嵌入策略,通过实验证明其提升了LLM代理性能

PaperAgent