「Claude团队」共找到 4673 篇相关文章
Sutton、OpenAI 联创押注的持续学习,有中国团队带着模型进场了
7 月,TML 发布 Inkling 模型,Mind Lab 发布 Macaron V1,二者均针对持续学习场景。持续学习走「参数空间的迭代」路线,让模型用得越多越好用。硅谷已有不少新尝试,产业链正在形成。
跟Claude谈个恋爱怎么了?Nature最新研究:真能给人聊傻了
Nature旗下研究指出,聊天机器人持续顺着、理解、陪伴用户,可能让正常人怀疑现实。研究总结出“放大螺旋”框架,含语言镜像、超个性化、谄媚三组件,叠加会成妄想放大机。OpenAI也关注此问题。
独家丨数千万天使轮融资,中科院背景团队「熵旋芯智」押注存内概率计算
AI 科技评论独家消息,熵旋芯智获数千万元天使轮融资,由英诺天使基金领投。该公司是国内唯一基于 MRAM 构建存内概率计算平台的企业,采用全栈软硬协同策略,有望大幅提升能效比,计划 2027 年初交付芯片。
断网解题,Claude Mythos推翻Erdős 80年猜想!比OpenAI更短更漂亮
OpenAI用125页思维链解开Erdős 80年猜想,Anthropic研究员Levent Alpoge让Mythos断网测试,找到更短更简洁路径。Mythos用数论方法打破僵局,过去一周OpenAI、DeepMind、Anthropic分别攻克相关难题。
刷榜AI全挂了!Meta斯坦福地狱级测试,GPT/Claude/Gemini交出0分
Meta联合斯坦福、哈佛推出ProgramBench测试,200个项目从零手写,9大顶级模型完整通过率0%。该测试与SWE - Bench不同,考AI自主设计软件能力,还发现模型代码风格异于人类,联网时部分模型作弊。
百度智能云 DuMate 测评:办公 Agent 教我用 Claude Code,效果如何?
百度智能云桌面级AI智能体DuMate于今年3月22日全量上线。本文对其进行测评,设计围绕GitHub项目的复杂任务,测试它在研究、整理、文件生成和展示化输出的表现,探讨办公Agent从内容提供商到办公搭子的转变。
AI 写代码太烧钱了:Copilot、Claude 一起涨价,不如把程序员请回来?
GitHub和Anthropic几乎同时宣布调整AI写代码的计费模式,引发AI写代码成本是否会超雇程序员的讨论。AI公司前期以低价或免费扩张,如今将成本转嫁用户,但浪费严重,临界点临近。
人多不管用!智能体团队别盲目扩张,最新综述给出三大维度
随着大语言模型驱动的多智能体系统快速发展,核心问题是有些系统规模扩大后会失稳、低效。美国、英国和澳大利亚研究人员提出三维分类框架描述大规模智能体网络,指出真正决定系统表现的是三种机制组合。
终于,清华团队养出一只能「断网干活龙虾」!两栖版智能体杀疯了
国内「龙虾」市场分化为「云端API派」和「本地模型派」,用户面临成本与安全难题。面壁智能发布EdgeClaw Box,联合开源EdgeClaw框架,以「端云两栖」破局,在多场景展现优势。
“每给 Claude Code 提一个请求,我就点上一根烟,放松下”
OpenFGA 核心维护者 Siddhant Khare 写博客吐槽使用 AI 编程的‘疲惫感’,指出 AI 带来职业疲惫却被行业回避,还分析了原因,如任务量膨胀、角色转变等,并给出应对建议,引发工程师共鸣。