超级智能体」共找到 5723 篇相关文章

开源动态8

越O4-mini,多模态大模型终于学会回头「看」:中科院自动化所提出GThinker模型

现有多模态大模型在通用场景推理有瓶颈,缺乏对视觉线索校验与再思考能力。中科院自动化所提出GThinker模型,有创新的「线索引导式反思」模式,经两阶段训练,性能O4 - mini,论文等已开源。

机器之心
新闻资讯7

内部爆料:Alexandr Wang上任第一把火,Meta大模型闭源

据知情人士,Meta新成立的智能实验室正讨论重大决策,高层对AI模型是否开源存分歧。Meta曾因性能问题延迟Llama 4版本,现完成Behemoth训练却因不佳延迟发布,还探讨放弃它开发闭源模型。

机器之心
开源动态7

月之暗面硬刚Anthropic!开源万亿参数Kimi K2,Agent编码性能直逼闭源最强!

上周五月之暗面发布并开源万亿参数Kimi K2,外网评价高。它或开启开源AI的“Agentic时代”,在智能体和编码基准上表现出色,成本远低于竞品,但推理速度较慢,已可平替Claude。

探索AGI
新闻资讯7

微信支付这波操作把我干懵了,Agent能赚钱?

微信支付从商业底层——支付——直接 mcp 了,用户可在腾讯元器体验其 mcp 服务,支付后智能体干活。微信支付 MCP 让 AI 与支付系统融合,实现“对话即交易”,但也面临安全合规问题。

MacTalk
产品应用7

测评豆包1.6:我用它开发了一个“聪明的旅行策划Agent”

作者对豆包1.6进行测评,用其构建旅行策划Agent。豆包1.6推理强、有自适应思考模式且计价创新。作者实操构建旅行Agent,结合MCP完成任务,虽有不足但预期,国内Agent开发生态已成熟。

花叔
产品应用7

1.93bit版DeepSeek-R1编程过Claude 4 Sonnet,不用GPU也能运行

1.93bit量化后的DeepSeek - R1(0528)编程能力Claude 4 Sonnet,在aider榜单获60分。Unsloth工作室制作9个量化版本,小版本不用GPU也能跑。R1 - 0528在游戏评测中表现也佳。

量子位
新闻资讯8

谷歌 CEO 皮查伊万字专访:AI 正重塑搜索引擎、Web 乃至整个互联网

Google I/O 大会后,谷歌 CEO 皮查伊接受专访,围绕 AI 平台转型、搜索体验重塑等议题分享洞察。他指出 AI 是平台跃迁,搜索将成定制体验,Web 在转型非消亡,还回应了新闻出版界不满等争议。

AI科技大本营
算法论文8

清华&通院推出"绝对零"训练法,零外部数据大模型自我博弈解锁推理能力

清华、北通院和宾州州立大学研究人员提出“绝对零”训练法,让大模型通过自我博弈生成并解决任务获推理能力。测试显示,其训练出的模型专家标注样本训练的模型,且能提升编程与数学推理表现。

量子位
产品应用8

首发限时免费两周!实测腾讯混元Hy3:Agent能力飞升,日常主力毫无压力

腾讯混元Hy3正式版发布,尺寸300B,在多领域表现亮眼,追平甚至越大参数模型。作者用三个刁钻场景实测,Hy3在全栈开发、3D游戏开发、办公任务中表现出色,幻觉率低,达生产标准。

AI寒武纪
产品应用7

打工人五一自救指南:把活全甩给AI,准备免打扰出门

五一将至,为避免假期工作内耗,可安装百度智能云打造的AI助手DuMate。它支持多模态理解与生成,能跨应用完成复杂任务。经测试,它可高效处理整理文件、生成报告等工作,还能并行处理多项任务。

量子位