新能安」共找到 7785 篇相关文章

新闻资讯7

GPT正面对决Claude!OpenAI竟没全赢,AI全「极限大测」真相曝光

OpenAI和Anthropic罕见合作,测试双方模型在幻觉等四大全方面的表现。这场合作是AI全的里程碑,百万用户每天的互动推动全边界扩展。文中详细对比了GPT和Claude模型在各全测试中的表现。

新智元
新闻资讯8

Claude网页版接入MCP!10款应用一键调用,开发者30分钟可创建集成

Claude网页版接入MCP,集成10款应用,开发者30分钟可创建集成。同时Research功,增加更多数据来源,网页搜索功面向付费用户开放。MCP逐渐成为行业标准,引发对大模型SaaS时代的讨论。

量子位
产品应用8

Claude Skills,4000字详解 Anthropic 的思考

Anthropic推出Claude Skills,作者认为它会引导第三方工具形态。Skills结合笔记式形态、可执行工具与AI调度自优化,具备低门槛、灵活表达等优势,还实现了AI自我进化,是一种范式。

AI产品自由
算法论文8

RLPT:腾讯混元在预训练数据上实现自主强化学习

腾讯混元团队发布RLPT,是在预训练数据上应用强化学习的方法,可突破大语言模型扩展瓶颈。它让模型自主学习推理力,无需人工标注,在Qwen3 - 4B - Base模型实验中性显著提升。

AI工程化
新闻资讯7

没有头,没有脚,还三折叠,周衔团队发布首款「非人形」机器人

机器人创业公司Genesis AI发布首款通用机器人Eno,它是轮式且配机械臂,无腿无头部,外壳颜色可定制。其由自研模型GENE驱动,预计2026年Q4发货,落地从工业到生活场景。

机器之心
产品应用8

AnyGen款AI工具,专门解决打工人最头疼的3件事,Doc,PPT,Excel

字节跳动2025年12月在海外推出一站式AI协作工作台AnyGen,强调人机协作打磨。产品有文档、通用智体、幻灯片、数据分析四个核心模块,解决会议纪要整理、PPT制作等痛点,还与主流工具做了横评。

AI Reading Hub
算法论文8

谢赛宁团队基准让LLM集体自闭,DeepSeek R1、Gemini 2.5 Pro都是零分

纽约大学等8家机构研究者提出LiveCodeBench Pro竞技编程基准测试,评估了Gemini 2.5 Pro等前沿大模型。发现当前模型有显著不足,在无外部工具时,高难度题通过率为0,LLM与人类大师级水平差距明显。

机器之心
产品应用8

ShellAgent 2.0 体验:让前端消失,省掉 70% 开发资源

本文介绍Myshell ShellAgent 2.0测试情况,它仅用提示词就生成Agent应用,摆脱前端构建流程,降低创建门槛。文中展示创建计算八字、分析钱包资产、拆解学习资料等应用案例,还Remix他人发布的应用。

歸藏的AI工具箱
开源动态7

又上Trending,这个项目赋予AI灵性,可以和你一起玩游戏看电视!

项目 AIRI 可让用户轻松拥有数字生命。与其他项目不同,它支持多种 Web 技术,在现代浏览器和设备运行,还玩游戏、看视频。目前已完成部分基础功,支持众多 LLM API 服务,还衍生出多个子项目。

GitHubStore
新闻资讯7

优必选「拆墙」:具身智行业等了三年的「卓时刻」来了吗?

4月23日,优必选在FAIR plus 2026机器人全产业链接会期间发布开发者专属社区「Thinker Cosmos」。该平台连接场景需求与开发者,解决行业痛点,以分层服务构建生态,还提及聚焦家庭场景刚需点。

AI科技评论