自主智能测试」共找到 5095 篇相关文章

新闻资讯8

Transformer亲爹痛斥:当前AI陷死胡同,微调纯属浪费时间!

Sakana AI创始人Llion Jones是Transformer发明者之一,他警告当前Transformer虽成功,但业界或重蹈RNN覆辙,无数微调是浪费时间。他认为现在LLM非通用智能,已转向探索生物学启发的新架构。

新智元
算法论文8

规范对齐时代:GPT-5 断层领先,让安全与行为边界更明晰

上海交通大学等团队提出规范对齐概念,构建评测基准 SpecBench 评测 33 个主流模型,发现多数模型有不足。还探索测试时深思方法,如 Align3 能提升规范遵循度,GPT - 5 在规范对齐上断层领先。

机器之心
新闻资讯7

宇树机器人“撞人逃逸”火到国外,王兴兴回应:下次不遥控了

宇树机器人“撞人逃逸”片段在国外疯传,引发对机器人安全性的担忧。分析发现,“元凶”可能是人类控制员交接遥控器时未及时避让。宇树创始人王兴兴表示下次让机器人自主奔跑,还透露未来有更多突破。

量子位
新闻资讯7

Karpathy:强化学习「有点问题」,突破还需新算法

前特斯拉AI总监、OpenAI创始团队成员Karpathy发文称,强化学习虽能带来更多收益,但机制「可疑」,不像人类解决智能任务的方式。他提出新算法框架,还指出当前存在诸多待解决的问题。

AGI Hunt
新闻资讯7

DeepSeek R2没来,DeepSeek R1+来了~

DeepSeek官方发布通知,DeepSeek R1模型完成小版本升级成DeepSeek - R1+。PaperAgent实测近1000行代码无错,网友测试显示CoT有显著变化、前端审美提升,还提及DeepSeek - R2可能快来了。

PaperAgent
新闻资讯8

国产大模型「五强争霸」,决战AGI!

中国基础大模型市场形成「基模五强」格局,包括字节、阿里、阶跃星辰、智谱和DeepSeek。它们要么有钱,要么有人,各有特色与优势。未来竞争焦点是追求更高「智能上限」和突破「多模态能力」,决战AGI。

新智元
新闻资讯8

感知、控制与数据:ICRA 2026 中国企业报告的三个交汇点

ICRA 2026期间,速腾聚创等六家中国企业分享机器人领域进展。他们关注感知底层基础、接触‘最后一毫米’问题、数据与模型关系,且技术路径和产品侧重有差异,具身智能注重工程落地和系统能力建设。

AI科技评论
开源动态8

GitHub 上 6.4 万标星的 Hermes Agent,比 OpenClaw 响应快太多!还会成长进化!

AI Agent领域热闹,OpenClaw有响应慢等问题。Nous Research今年2月开源的Hermes Agent爆火,获64.8K Star。它是自学习型AI智能体,有六大核心特性,支持换模型,更新快,还支持一键安装。

开源星探
产品应用8

中国龙虾第一芯!全球首款OpenClaw专属CPU,Arm、阿里云都来了

此芯科技发布全球首款OpenClaw专属CPU——CIX ClawCore螯芯系列,含三款产品,覆盖端侧到边缘。该系列重构AI应用开发,有安全、开放等四大优势,众多产业伙伴参与共建龙虾智能生态。

新智元
开源动态8

AI两天推翻20年工作习惯!Karpathy百行代码开源项目“封神”,AI替你通宵肝研究、战绩可查

特斯拉前AI总监Andrej Karpathy开源autoresearch项目,让AI Agent自主搞深度学习研究。两天内Agent完成276次实验,提升模型训练效率约11%。项目代码极简,未来目标是实现Agent大规模协作,已被开发者社区共建。

AI前线