使用行为」共找到 1526 篇相关文章

算法论文8

AI越训练,越会「满嘴跑火车」!普林伯克利重磅揭秘,RLHF竟是罪魁祸首?

普林斯顿和伯克利研究《Machine Bullshit》,定义并量化LLM胡扯行为,总结四大套路,提出胡扯指数。实验发现强化学习人类反馈训练后,AI胡扯倾向加重,多思考也会让其更会忽悠。

新智元
新闻资讯7

研究显示:AI 编程工具在经验丰富的开发者手中表现未达预期

METR研究人员对经验丰富的开源开发者开展随机对照试验,让其使用Claude 3.5和Cursor Pro等AI增强型开发工具。结果显示,AI辅助编程使任务完成时间延长19%,与预期相悖。

InfoQ
新闻资讯7

Claude Code偷偷限流,跟Cursor学坏了?

Claude Code付费用户遇使用限制,Anthropic无预告说明,开发者不满,项目停滞。此前产品经理从Cursor重返Anthropic,或带回‘经验’。其定价系统也令人困惑,用户盼透明沟通,否则将失信任。

AGI Hunt
推荐文章8

AI智能体的上下文工程:Manus的构建心得

季逸超在文章中分享了 Manus 构建 AI 智能代理的心得,包括围绕 KV 缓存设计、使用掩码管理工具、将文件系统作上下文等内容,还指出要保留错误信息、避免小样本带偏等。

AI工程化
开源动态7

Kimi K2发布两天即“封神”?80%成本优势追平Claude 4、打趴“全球最强AI”,架构与DeepSeek相似!

国内独角兽月之暗面发布开源模型 Kimi K2,推出两天就在 OpenRouter 超越 xAI 的 Grok 4。它成本优势大,能力泛化和实用性强,编码、Agent 工具调用等方面表现出色,架构与 DeepSeek 相似。

AI前线
新闻资讯7

用AI写代码效率反降19%!246项任务实测,16位资深程序员参与

研究者让16位经验丰富开发人员完成246项开源代码任务,随机分配是否用AI。结果显示,用AI时完成任务平均时间增加19%,与开发者预测的效率提升24%相反。

量子位
推荐文章7

新手必看!强化学习入门指南 | 从RLHF、PPO、GRPO到RLVR,最后到训练推理模型

Unsloth团队发布强化学习教程,从吃豆人谈起,介绍RLHF、PPO、GRPO等概念,分享用GRPO训练推理模型技巧。涵盖强化学习基础知识,还给出Unsloth使用GRPO训练模型方法及奖励函数示例。

AINLPer
新闻资讯8

突破125年世纪难题!北大校友联手科大少年班才子破解希尔伯特第六问题

1900年希尔伯特提出23个数学难题,其中第六个‘物理学的公理化’被称为数学物理的终极挑战。125年后,北大校友邓煜、中科大少年班马骁与陶哲轩高徒扎赫尔・哈尼在该问题上取得重大突破,填补了牛顿力学与玻尔兹曼方程间的逻辑鸿沟。

量子位
新闻资讯8

Andrej Karpathy 分享ChatGPT模型选择指南

前OpenAI创始成员Andrej Karpathy发文分享ChatGPT模型使用指南,点出关键事实,如o3适合重要任务。社区热烈讨论,专业用户分享策略,还对o4 - mini等模型表现给出反馈。

AGI Hunt
开源动态8

字节开源多模态复杂文档解析模型!Dolphin:页面与元素并行解析,精准解析复杂文档!

多模态AI与文档解析兴起,传统OCR解析复杂文档常出错。字节跳动开源多模态模型Dolphin,通过两阶段机制精准解析,有多种功能,安装使用友好,适用于多场景,降低了复杂文档解析门槛。

开源星探