推理智能体」共找到 5499 篇相关文章

产品应用8

秘塔AI也终于悄悄上线了DeepResearch。

秘塔AI搜索上线新功DeepResearch,作者测试后评价颇高。它有可视化界面,展示思考执行过程,打破AI黑盒。输出报告质量好、精准度高,还可生成互动网页,且免费额度多,虽有小问题但仍值得肯定。

数字生命卡兹克
产品应用8

豆包 Seed 2.0 Lite升级:给 Agent 装上眼睛和耳朵

近期模型发布竞争激烈,作者做视频字幕常遇识别错误,因语音识别工具缺上下文。字节方舟的豆包 Seed 2.0 Lite 升级后听,还可结合上下文准确输出字幕,成本降 20%,也理解视频,为工作流补全感知。

花叔
开源动态7

只要强化学习1/10成本!翁荔的Thinking Machines盯上了Qwen的黑科技

新智元报道,翁荔的Thinking Machines研究同策略蒸馏策略,以1/10强化学习成本,结合同策略训练优势与密集奖励信号。该策略受DAGGER启发,扩展Qwen3团队工作,可在Tinker复现,还用于个性化和持续学习。

新智元
新闻资讯7

AI遭遇灵魂拷问!这道题所有模型集体翻车,网友:我也不会啊

图像理现新难题,在Reddit引发热议,目前无AI真正解决。国内外支持图像输入的大模型答案不同,原因是对大立方体规格理解不同。结合提示多次尝试,部分大模型找准方向,人类面对该问题也会困惑。

量子位
推荐文章7

“不用 Cursor和 ChatGPT、手写代码的开发者,怕不是疯了?”

本文围绕开发者是否应使用AI辅助编程展开讨论。支持者认为大模型提升效率,解决琐碎问题;反对者则质疑其可靠性。文中还分析了大模型在编程中的优缺点,如生成代码但也有幻觉等问题,并反驳了一些反对观点。

InfoQ
8

超越英伟达B200!AMD最强AI芯:1.6倍大内存、大模型理快30%,奥特曼都来站台

AMD发布最强AI芯片MI350X和MI355X,号称大模型理比英伟达B200快30%,内存是其1.6倍。该系列本月初已批量出货,还发布ROCm 7软件栈。AMD还预告明年MI400系列,由其与OpenAI联合研发。

量子位
产品应用8

感觉这次扣子 2.0 触碰了模型和工程的天花板

2026 年,真正好用的 AI Agent 应拆解目标、进过程和交付验收。扣子 2.0 正式发布,从“给指令的工具”变为“干活的工作伙伴”,有技和长期计划两大核心升级,还具备扣子编程功,拓宽了 AI 力边界。

MacTalk
产品应用7

Sora 2 App 上手体验攻略,附Sora AI视频

本文是Sora 2 App上手体验攻略。Sora 2 PC版依提示词生成精美电影感视频,还可创建虚拟形象;App交互似抖音,录制上传自身形象生成视频。其生成视频镜头自然,有“AI导演感”,但目前时长较短。

AI Reading Hub
开源动态8

13小时不眠不休,300个分身狂敲代码!开源第一易主了

4月20日深夜,Kimi K2.6出道即开源,展示了强大的「全栈交付」力,跑分超GPT - 5.4等。它完成多类型官网制作,300个Agent协作力强,还复刻高盛研报、交付三件套,其Claw群组开启小范围测试。

新智元
算法论文8

体系统如何「边做边学」?斯坦福团队探索在线优化的新范式

斯坦福等校团队提出 AgentFlow 框架及 Flow - GRPO 算法,让智体系统「边做边学」。它由多个智体模块协作,在多领域基准测试中表现出色,小模型也超越大模型,为智体训练提供新思路。

机器之心