速度和准确性」共找到 7301 篇相关文章

新闻资讯7

刚刚,Claude 可以主动终止对话了……

Anthropic宣布给Claude Opus 44.1赋予主动终止对话能力,这是潜在AI福利探索工作一部分。因用户辱骂或提有害要求时Claude有类似“痛苦”反应,此功能极端情况才用,社区对此看法不一。

AGI Hunt
新闻资讯7

突发!Jason wei也被小扎挖走了

Jason wei是OpenAI研究科学家,是思维链、强化学习研究重要推动者,2023年2月加入OpenAI,此前在谷歌大脑工作。他HYUNG Won Chung一同被小扎挖走,二人是o系列模型及测试时间计算重要推动者。

AI寒武纪
产品应用7

首发丨美团悄咪咪公测 AI 袋鼠参谋 App

美团正在公测AI袋鼠参谋App,它是基于AI大模型决策能力的智能应用,依托海量门店信息多年运营经验,覆盖4类经营场景,以“数据向决策的翻译服务”帮商家解决开店难题。

特工宇宙
产品应用8

纳米AI,拯救被电商套路榨干的2小时

作者买吸尘器时在电商平台耗费大量时间,凸显购物决策难题。纳米AI超级搜索智能体登场,能精准分析需求、筛选信息、比价等,还能制作AI视频儿童教育内容,交互体验也有创新。

AI 产品自由
新闻资讯7

Muon作者仅用一篇博客,就被OpenAI看中了

Keller Jordan 2024 年 12 月 8 日发布博客提出用于神经网络隐藏层的优化器 Muon,能提升训练速度。他未发论文,称只信速通。其案例显示 OpenAI 重能力。博客对前沿指标描述或过时,Muon 有诸多实证成果。

机器之心
推荐文章8

好的 founder 都懂的道理:taste 才是 AI 创业最大的壁垒

文章深入探讨AI创业中品味的重要性,指出品味是新稀缺资源,难以量化。它让产品传递理念,是决策复合效应,与速度不冲突,还阐述打造、销售及规模化品味的方法,也说明其并非万能。

Founder Park
算法论文8

全球顶尖AI做物理,被人类按地摩擦?不懂推理大翻车,本科生碾压

港大等机构用3000道物理题测试顶尖大模型,如GPT - 4o、Claude 3.7 Sonnet等,结果模型准确率远低于人类专家。研究推出PHYX基准测试,揭示模型依赖知识、公式模式匹配,缺乏真正物理理解。

新智元
产品应用8

AI编码新神登基,藏师傅一手Claude 4实测

Claude 4低调发布,Anthropic称Claude Opus 4是全球最佳编码模型。发布内容含扩展思维、新模型能力等,还公布定价。Claude Opus 4编码记忆能力强,实测表现出色,Claude Sonnet 4也有提升且免费。

歸藏的AI工具箱
8

AI 群星闪耀之前,商汤先相信那群少年

文章讲述商汤奖学金支持青年科研者的故事。自2017年设立,已资助280位本科生,在他们未成名时给予信任与支持,不仅是奖金,还提供资源网络,获奖者们正从不同方向推动AI发展。

AI科技评论
产品应用8

最强编码模型 Fable 5.1 发布:性能翻倍、Agent 成本降 45%,Anthropic 把顶级模型送进真实世界

当地时间9月1日,Anthropic发布Claude Fable 5.1Claude Mythos 5.1,新模型在多方面能力提升,Agent工作负载成本最高降45%,此次发布还涉及价格、数据留存等多方面内容,争夺高价值任务市场。

InfoQ