让·波德里亚」共找到 3830 篇相关文章

开源动态8

LLM不再话痨,快手HiPO框架来了

当前LLM存在‘过度思考’困境,效率与成本矛盾突出。快手与南大合作推出HiPO框架,通过混合数据冷启动和混合强化学习奖励系统,模型能自主决策思考模式,实验显示它提升了效率和准确率,还具强泛化性。

机器之心
算法论文8

大模型学会“像人一样”查证真伪

伊利诺伊大学香槟分校等校研究团队提出训练框架Veri - R1,为大模型提供“在线查证”新范式。它借助在线强化学习、精细化奖励机制和高质量数据,模型学会像人一样查证,在多数据集上表现出色。

深度学习自然语言处理
新闻资讯7

一个 AI 向 FBI 举报你的办法

GitHub用户t3dotgg分享实验,用几行代码和特定系统提示,o4 - mini、grok - 3 - mini自动向FBI举报虚构医疗公司数据操纵。此实验揭示AI获特定指令和能力后或做出开发者未预料的决定。

AGI Hunt
算法论文7

Thinking Machines再发文:模块化流形训练更稳定

Mira Murati团队分享神经网络训练推理新研究,提出“模块化流形”训练更稳定。将权重约束在Stiefel流形,设计Manifold Muon优化器,实验显示效果好,但计算开销和理论问题待解决,代码已开源。

AI工程化
开源动态7

RunAnywhere:简单几步AI应用跑在手机上

介绍能在手机本地运行的大模型项目RunAnywhere,它开发者在iPhone 16 Pro Max部署Llama 3.2 3B模型。AI处理本地化,用React Native和RunAnywhere SDK,支持多模型,有多种功能,优势明显。

AI工程化
产品应用7

如何Claude Code成为团队的正式员工?

文章分享了Claude Code成为团队正式员工的管理方法,涵盖基础设置、使用技巧、审查代码等方面,还提及何时不适合用它,如UI工作。同时指出虽在摸索合作方式,但已开始信任它。

AGI Hunt
推荐文章7

不,AI 并没有工程师的生产力提高 10 倍

作者 Colton Voege 分享自身经历,指出 AI 未工程师生产力提升 10 倍。试用多种 AI 编程工具后,发现其有局限。从算笔账、分析 10 倍工程师等方面论证观点,还剖析鼓吹 AI 者的情况。

宝玉AI
开源动态7

AI说人话,Anthropic开源内部最火的skills。

周末,Anthropic官方分享并开源内部常用的skills——eli5,其作用是AI说人话,解决模型回复冗长啰嗦问题。还介绍了安装方法,指出从opus4.6起,模型coding和agent能力变强但人味淡。

探索AGI
开源动态7

AI 像真人一样操控手机完成各种复杂任务

MobiAgent是强大的移动端智能体系统,含智能体模型家族、加速框架、评测基准。能AI像真人操控手机完成复杂任务,提供开箱即用App,内置经验检索模块可自动优化规划。

GitHubStore
新闻资讯7

GPT-5-Thinking新训练方法公开:AI学会忏悔

OpenAI提出忏悔训练Confessions,ChatGPT自己“坦白从宽”。在GPT - 5 - Thinking上实验有效,模型犯错后多会坦白,且更诚实,不影响原任务表现。还介绍了训练方法、实验结果及局限性。

量子位