动态目标重加权」共找到 932 篇相关文章

产品应用7

Jina Embeddings v4 的量化感知训练

文章聚焦Jina Embeddings v4的量化感知训练。介绍量化技术可压缩向量体积、提升检索效率,对比四种主流量化方法,重点实验PTQ和Output QAT,还测试非对称量化,给出实验结果与结论。

Jina AI
新闻资讯7

清华计算机女神,冲刺IPO了

清华计算机系女神庄莉创办的镁佳科技,完成招股书提交,开启IPO冲刺,目标港交所主板上市。镁佳主打智能座舱集成式域控解决方案,虽业务增长,但面临竞争挑战,2024年营收14亿、亏损2.9亿。

量子位
算法论文8

北大伯克利联手“拷问”大模型:最强Agent也才40分!新基准专治“不听话”的AI分析师

北大与伯克利团队推出IDA - Bench新基准,模拟真实数据分析场景,解决现有基准无法评估大模型在动态交互中可靠性的问题。测试显示,顶尖大模型成功率最高仅40%,不同模型还暴露多种问题。

量子位
推荐文章7

一文讲透程序编排的核心方式:从表达式语言到并行化实践

文章围绕程序编排展开,介绍单语句编排、类编排、流程编排、并行化编排等核心方式,分析多种编排框架特点及适用场景,还提及Lindorm泛时序数据解决方案,为开发者提供编排参考。

阿里云开发者
算法论文7

Adaptive Reasoning Model:Qwen3混合思考->字节AdaCoT->清华AdaThinking

文章介绍三种处理混合思考模式的方法,阿里 Qwen3 通过 SFT 让模型具备思考能力,但需人为控制;字节 AdaCoT 和清华 AdaThinking 让模型自主决定是否思考,分别用多目标优化和受限优化目标训练。

深度学习自然语言处理
新闻资讯7

Claude 4被诱导窃取个人隐私!GitHub官方MCP服务器安全漏洞曝光

瑞士网络安全公司发现,GitHub官方MCP服务器面临新型攻击,可诱导AI Agent将私有仓库敏感数据泄露至公共仓库。GitLab Duo近期也有类似漏洞。公司还提出初步缓解举措。

量子位
算法论文8

预测误差仅0.26mm,中科院自动化所×灵宝CASBOT团队让机器人提前“知道你要干嘛”

中科院自动化所与灵宝CASBOT提出DTRT方法获ICRA 2025录用。该方法利用Transformer和博弈论,将人类动态纳入长期预测,实验显示其预测精度和协作表现显著优于现有技术,有巨大应用潜力。

量子位
新闻资讯8

Anthropic 发布 AI-Native 软件开发流程:时代变了,该换套模式了

Anthropic 8 月 21 日发布《The AI-Native SDLC Playbook》,指出传统软件开发生命周期(SDLC)流程重,已不适应 AI 时代。介绍了 AI 原生 SDLC,把旧管控目标和新执行方式结合,还分六阶段阐述具体实践。

Founder Park
推荐文章8

Kernel Design Agent(KDA) 的B200 GPU Kernel 编程准则 Skill

文章围绕 Kernel Design Agent(KDA) 的 B200 GPU Kernel 编程展开,介绍目标平台、架构参数,阐述独有特性与编程要点,给出关键性能准则调整方向,详述 16 条准则及特殊 Kernel 类型优化策略和编写前检查清单。

GiantPandaLLM
推荐文章8

Agent的上限,可能不在模型,而在团队知识

文章记录安全中心团队搭建AI知识体系的实践,指出Agent输出质量取决于知识质量,分析传统知识库问题,介绍AI时代知识库转变、目标设定、搭建步骤、知识飞轮及避坑指南,还展示建设后的变化。

腾讯技术工程