「开发团队」共找到 4741 篇相关文章
15个前沿大模型,100个职业场景:谁才是最强AI打工人?
通义千问与港中文联合发布OccuBench,用语言世界模型评测AI Agent职业能力。评测15个前沿模型,发现无全能选手,隐式故障难处理,Scaling定律有效,做Agent和环境模拟器能力不同,还给出具体案例。
中国具身模型狂揽全球第一!机器人的人类数据时代来了
00后带队的灵初智能用近10万小时人类数据拆解具身智能,1000小时数据开源。其发布Psi-R2和Psi-W0双系统架构,让Psi-R2登顶MolmoSpace榜单。灵初认为纯人类数据训练必要,还强调开源对具身智能落地重要。
神秘模型屠榜多日、碾压Seedance 2.0!背后竟是阿里大招:新部门首作实锤,引爆股价拉升
近日,神秘模型 HappyHorse-1.0 登顶 Artificial Analysis 视频模型排行榜。4 月 10 日,阿里确认它是 ATH - AI 创新事业部自研产品,正在内测。该模型技术亮点多,若开源或使 AI 视频行业格局生变。
重磅!Anthropic又一个平台级产品炸场:Harness难题一次性解决,把Agent宠物变成牲口
Anthropic推出Claude Managed Agents,一套为云端大规模构建和部署智能体设计的API套件,已在Claude Platform上线公测。它全托管基础设施,专为Claude模型优化,多家企业已在生产环境使用,还同步发布工程博客解释架构设计思路。
Sam Altman被纽约客指控撒谎成性
纽约客调查指Sam Altman撒谎成性,如将安全承诺当融资工具,骗董事会等。Paul Graham私下指其撒谎,公开却替他洗地。出走的Dario创办Anthropic,收入反超OpenAI,产品更受开发者青睐。
逼AI当山顶洞人!Claude防话痨插件爆火,网友:受够了AI废话
一个叫「caveman」的Claude Code插件在Hacker News爆火,冲破2w星。它核心是条prompt,删掉冠词等废话,号称省75%输出token。但它不压缩模型后台推理token,真实成本节省存疑。
首个用户生活「长程模拟器」来了!LifeSim 重新定义大模型个性化评测
现有个性化助手评测基准与真实用户-助手交互脱节,来自复旦大学等的研究人员提出 LifeSim 框架及 LifeSim-Eval 评测方法。实验显示主流 LLM 处理显性需求尚可,隐性意图识别等方面短板明显。
开源一周狂揽 7.6K Star!这个爆火的「同事.skill」可以将“数字遗产”炼成 AI!
开源项目colleague-skill上线不到一周获7600+ Star。它由@titanwings开发,可凭同事材料生成能替其工作的AI Skill,有双层架构、多源采集等亮点,还介绍了使用方法与项目结构。
1.9万行 Claude Code“AI垃圾”杀入 Node.js:全球顶流开源项目,快守不住了
2026 年 1 月,Node.js 技术指导委员会成员 Matteo Collina 用 Claude Code 生成近 1.9 万行代码提交 PR,引发争议。长期贡献者 Fedor Indutny 质疑其不符合 DCO 1.1 条款,而 Collina 认为自己担责,且开源生态已认可 AI 辅助贡献。
Claude Code 终端工具链完全指南:7 款终端横评 + 我的最佳实践
文章对 7 款主流终端进行横评,给出 Shell 配置、终端复用器、快捷键的最佳实践,旨在让 Claude Code 体验更顺滑。介绍各终端特点,避坑 Powerlevel10k,推荐 Starship,强调 tmux 重要性等。