意识可及」共找到 5912 篇相关文章

算法论文7

直播预约 | 强化学习训练能否不依赖外部知识优化模型的弱点?

论文提出 SwS 框架,针对强化学习场景,利用模型自我感知弱点驱动自动化问题生成,合成针对性训练数据。还对其进行多项扩展,在多个基准测试集和模型上验证有效,性能提升显著。

深度学习自然语言处理
开源动态7

谷歌将 A2A 捐赠给 Linux 基金会,但代码实现还得靠开发者自己?!

当地时间6月23日,Linux基金会宣布与多公司成立A2A项目,由谷歌捐赠协议规范等。A2A是谷歌4月推出的开放标准,支持智能体通信协作。有开发者认为它或削弱MCP地位,但谷歌称是其“补充”。实际应用有诸多问题待解。

AI前线
算法论文8

提升大模型内在透明度:无需外部模块实现高效监控与自发安全增强|上海AI Lab & 上交

大语言模型能力提升引发风险担忧,当前主流用外部“黑盒”监控模块解读模型表征,存在诸多局限。上海人工智能实验室和上海交通大学团队提出TELLME方法,摒弃外部模块,提升模型内部透明度,还提升了输出安全性。

量子位
算法论文8

DPO与GRPO谁更胜一筹?港中文、北大等联合发布首个系统性对比研究

港中文、北大等团队首次全面对比DPO和GRPO算法在自回归图像生成中的应用,评估其在域内、域外性能,探究奖励模型扩展策略的影响,为开发高效RL算法提供新思路。

机器之心
8

软件正在发生根本变化:Andrej Karpathy 旧金山 AI创业学院演讲万字实录

Andrej Karpathy在旧金山Y Combinator AI创业学院演讲,指出软件正进入“软件3.0”时代,大语言模型(LLM)是新型计算机,能用英语编程。他探讨了LLM特性、生态,以如何利用其构建部分自治产品等。

AI寒武纪
产品应用7

The Batch:834 | 更一致的人物与风格

德国 Black Forest Labs 的 FLUX.1 Kontext 系列文本生成图像模型,控编辑图像。有 max、pro 和 dev 版本,功能含角色一致性和图像编辑,在测试中表现优,公司计划公开专有评估基准。

DeeplearningAI
推荐文章7

代码怎么才能跑的更快

文章围绕让代码跑更快展开,先介绍调整源代码的方法,如降低循环开销、去除内存引用等,又阐述使用硬件加速指令,像用 SIMD 函数、避免分支语句等,还提多核并行和分析瓶颈等要点。

阿里云开发者
算法论文8

模型遗忘不代表记忆抹除!首次系统发现「逆性遗忘」背后规律

研究人员发现大语言模型遗忘并非简单信息删除,能藏于内部。他们构建表示空间诊断工具,区分逆与不逆遗忘,揭示真正遗忘是结构抹除。还在多种方法、数据集和模型上实证,得出系列结论。

新智元
推荐文章7

AI大模型浪潮下的认知重构:从一个数据老兵的转型思考

作者作为数据老兵,分享接触 ChatGPT 后的转型思考。指出 AI 使编程、数据分析师岗位巨变,填鸭式教育不再适用。强调认知结构是护城河,还探讨了 ETL、数据建模 AI 原生产品变化。

InfoQ
推荐文章7

240 款 AI 软件定价分析:从席位到成果,AI 定价的五种趋势

国外科技作者 Kyle Poyar 收集超 240 家软件公司数据,分析 AI 软件定价。指出传统定价面临挑战,混合定价成主流,还介绍常见策略、结果定价问题、价格透明化困境企业准备不足等情况。

Founder Park