手机智能体」共找到 5206 篇相关文章

算法论文8

ICLR 2026 oral | AI代码真进生产环境?SwingArena:从「写对代码Commit」到「通过CI审查」

过去一年大模型写代码力提升,人们思考其否参与软件工程核心流程。现有评测基准有缺失,SwingArena填补空白,将博弈引入评测,设计检索增强流水线,其开源后或成评估AI编程力新工具。

机器之心
产品应用8

美团龙猫LongCat技术升级!新注意力机制解码速度快10倍,还处理1M超长文本

美团龙猫LongCat系列发布全新稀疏注意力机制LoZA,重点解决长文本任务难题。它在MLA机制基础改造,计算复杂度降至线性,处理128K上下文解码快10倍,性不缩水,后续还计划支持动态稀疏比例。

量子位
新闻资讯7

每周产业洞察 | 从史努比交易看AI时代:握存量IP的巨头如何开辟新路径

北京AIGC视听产业创新中心位于朝阳区东坝乡,是朝阳区推动影视制作基地建设的举措。由多方参与,首创郎园运营,提供六大服务平台,截至2025年8月汇聚60余家生态伙伴。首创郎园拓展服务边界,项目多地布局。

郎园Station
新闻资讯7

ICLR 2026还会好吗?300篇投稿50篇含幻觉,引用example.com竟也过审

GPTZero扫描300篇ICLR 2026投稿论文,发现50篇含引用幻觉,如用example.com作引用,且经同行评审也未识别。学术会议和期刊在AI重压下不堪重负,GPTZero幻觉检测工具或助同行评审。

机器之心
产品应用8

Anthropic 深夜祭出 Claude Sonnet 4.5,自主工作 30 小时!CEO:它更像你的同事

昨夜凌晨,Anthropic 推出新一代模型 Claude Sonnet 4.5,官方称其是世界上最好的编码模型等。该模型性跑分登顶,工程落地力强,还带来产品生态升级,开放 Agent SDK,误报率降低,价格亲民。

InfoQ
新闻资讯8

通用Agent是伪命题?昆仑万维方汉现场拆解:垂直推理才是胜负|新智元十年峰会

在新智元十周年峰会上,昆仑万维董事长方汉分享公司转型故事与多模态AGI见解。他认为通用Agent非万,垂类推理数据是关键,还提出AI商业落地逻辑,展示多款产品成果。

新智元
开源动态8

超长推理还节省计算!Salesforce开源神器两连发:教大模型边想边省,显著提升数学编程准确率

Salesforce AI Research开源Elastic Reasoning和Fractured Sampling。前者将推理流程分两部分,分配token预算,使输出缩短、准确性提高;后者打碎推理链条,从三维度采样,以更少tokens换更高准确率,均提升数学和编程任务准确率。

量子位
新闻资讯8

AI也当情感大师?腾讯发布最新AI社交智榜单,最新版GPT-4o拿下第一

腾讯混元AI数字人团队打造SAGE自动化评估框架,可评价AI“共情力”与否成“知心伴侣”。研究团队用其对18个主流模型测评,GPT - 4o表现最佳,还通过多实验分析模型特性。

量子位
算法论文8

绝对零监督Absolute Zero:类AlphaZero自博弈赋大模型推理,全新零数据训练范式问世

清华大学 LeapLab 团队等提出全新推理训练范式 Absolute Zero,使大模型实现「自我进化式学习」。基于此范式训练的模型 AZR,在代码生成与数学推理基准任务表现出色,缓解了大模型对人工数据依赖难题。

机器之心
产品应用8

9.1K Star!这个工具把 Claude Code 的幸福感拉满了,终于不用撸 JSON 配置了!

Claude Code等让开发者回归终端开发,但配置“反人类”。GitHub上的cc-switch工具基于Rust + Tauri开发,支持多款模型快速配置切换,有可视化面板及多种功,还集成Skills库,大大提升使用体验。

开源星探