推理智能体」共找到 5499 篇相关文章

新闻资讯8

Linus一句话说透Al局限:代码不直接用,bug只创可贴式地修

本文是 Linus Torvalds 在开源技术会议上与 Dirk Hohndel 的对话。Linus 从工程实践出发,谈到 Linux 内核开发节奏、硬件支持取舍、语言之争及 AI 应用。他认为 LLM 是工具,有价值但无法替代长期维护者经验。

InfoQ
开源动态7

AI 终于"玩手机"了:Mobile MCP 让大模型直接操控你的 iOS 和 Android

Mobile MCP 是开源 MCP Server,让支持 MCP 协议的 AI 客户端操控 iOS 和 Android 设备,通过自然语言指令完成操作,解锁自动化测试等场景,但成功率有待提升,目前更适合探索性测试等。

AI Reading Hub
算法论文8

Codeforces难题不够刷?谢赛宁等造了个AI出题机,生成原创编程题

LiveCodeBench Pro团队出AutoCode框架,利用LLM自动化竞赛编程问题创建与评估。该框架结合验证器 - 生成器 - 检查器框架与双重验证协议,在测试用例生成上可靠性佳,还生成新问题,同时揭示了LLM在创作上的优劣势。

机器之心
推荐文章7

特热议、AI 万亿美元新赛道,「上下文图谱」到底是什么?创业机会在哪?

文章围绕「上下文图谱」展开,探讨其定义、构建问题及创业机会。指出它是决策轨迹积累形成的结构,构建要解决双时钟等问题。大厂难以捕捉决策轨迹,初创公司有三条路可走,捕捉决策轨迹或成新万亿级平台。

Founder Park
开源动态8

AI自己打红警了!经济拉满零交战惨遭打脸,玩家笑疯

Hugging Face出OpenRA-RL,将《红色警戒》改造成大模型的Agent训练场,50个MCP游戏工具全量暴露,25Hz实时状态流送,打通三条训练路线,原生接入OpenEnv生态。实战中,Agent经济满分但战斗零分。

新智元
开源动态8

突破全模态AI理解边界:引入上下文强化学习,赋全模态模型“意图”理新高度

在多模态大语言模型应用多元的当下,对模型理解人类意图需求迫切。阿里巴巴通义实验室团队出HumanOmniV2,解决现有理路径问题,其相关代码等开源,在多基准数据集成果突破性领先。

量子位
算法论文8

Thinking Machines新发现:Lora不是权宜之计,哪怕秩低到 1,也匹敌全参数微调

Thinking Machines和John Schulman新研究刷新对LoRA的认知,实验显示正确使用时它匹敌全量微调。团队系统研究训练集与参数关系,有层选择、学习率等关键发现,还给出实用建议,但LoRA在部分场景表现待验证。

AI工程化
算法论文8

腾讯与中科院联合提出R-4B,一个自动决定是否思考的多模态大模型

多模态大语言模型“始终思考”模式有缺陷,腾讯混元团队与中科院自动化所联合提出R - 4B,通过双模式退火训练和双模式策略优化实现自动思考,在多评测中达SoTA,省资源且效果好。

深度学习自然语言处理
开源动态8

腾讯混元开源游戏AI生成新工具!RTX 4090就制作3A级动态内容

腾讯开源游戏视频生成框架Hunyuan - GameCraft,基于混元视频生成搭建,操作简单,输入单张场景图、文字描述和动作指令就生成高清动态游戏视频,解决传统工具瓶颈,性优于主流模型。

量子位
产品应用7

我把Claude变成了带记忆的人生教练,结果它比我还了解我自己|人生教练 Agent v2.1

作者将Claude打造成带记忆的人生教练,记忆功让教练回顾过往对话。其技术栈不复杂,相比传统教练优势明显。虽有缺乏情感共鸣等局限,但发现认知盲区,未来有改进空间。

AI 产品自由