Doubao 1.6」共找到 2239 篇相关文章

算法论文8

北大腾讯突破奖励模型瓶颈!让AI理解人类偏好,泛化能力比肩GPT-4.1

北京大学知识计算实验室联合腾讯等机构提出RewardAnything,突破奖励模型瓶颈。它让奖励模型理解自然语言评判原则,降低成本,泛化能力比肩GPT - 4.1,还能用于定制AI行为模式。

量子位
开源动态8

1.2K Star!终于有工具开始认真解决 AI Agent 安全问题了!

作者深度使用AI Agent时担忧其安全性,GitHub上斗象科技开源的ClawVault项目,上线不久获1.2K Star。它为AI Agent提供多场景安全隔离方案,有分格管理、可视化监控等实用设计,适配Python3.10+环境,安装方便。

开源星探
新闻资讯7

重要!LiteLLM 供应链攻击:你的 API 密钥可能已经泄露

3月24日,LiteLLM的PyPI发布页面出现恶意版本,1.82.7和1.82.8被嵌入恶意代码。恶意代码会收集敏感文件、外传信息、进行横向移动。文章还给出检查、处理方法,此事件给开发者提了醒。

AI工程化
算法论文8

性能不减,吞吐量提升6.4倍!英伟达用混合算子和架构定义小模型新标准

NVIDIA研究团队通过Nemotron - Flash系列模型,打破对‘深而瘦’架构迷信,修正缩放定律,用进化算法搜索混合算子、改进训练策略。该模型在性能、延迟和吞吐量上表现出色,远超同类产品。

AIGC开放社区
算法论文8

DeepSeek推理最高提速6倍!开源研究:加装「思维进度条」,计算量减少30%

特拉维夫大学团队开发新方法,给LLM推理任务装进度条,控制推理深度和速度。提出“思维进度向量”TPV预测推理位置,干预TPV可“超频”“降频”,模型已在GitHub开源。

量子位
新闻资讯7

爆冷!字节Seed 在CCPC 决赛只做出一道签到题,而DeepSeek R1 直接挂零?

第十届 CCPC 举行,字节 Seed 携 Seed - Thinking 参赛,仅做出一题,DeepSeek R1 挂零。不同模型架构在比赛中差异不大,暴露出大模型做算法题短板,推理模式模型表现更好。

AI前线
新闻资讯7

一个1.5万人的加勒比小岛,靠卖.ai域名收了一半的政府预算

加勒比小岛安圭拉靠卖.ai域名收入颇丰,2025年占政府预算47%。其收入随AI浪潮增长,虽价值不如.com,但生态渐起。不过,.ai溢价与AI周期紧密相关,未来走向有待观察。

DeepTech深科技
推荐文章8

有手就行,教你从0到1快速手搓搭建个GUI Agent

随着通用大模型发展,搭建GUI Agent难度降低。文章介绍如何用通用大模型API,从0到1搭建PC GUI Agent,包括原理、代码实现等,该Agent能跨应用操作,未来可强化功能。

腾讯技术工程
新闻资讯8

全网挤爆Seedance 2.5,但2.0 fast降到6毛是真的香!

近期AI视频赛道竞争激烈,FLUX 3登场,国内巨头也纷纷推出新模型。字节Seedance 2.5优势明显,但适用特定场景。Seedance 2.0 fast降至6毛每秒,经多场景实测,表现均衡,是性价比之选。

新智元
开源动态8

1.58bit不输FP16!微软推出全新模型蒸馏框架,作者全是华人

微软推出蒸馏框架BitNet Distillation,实现几乎无性能损失的模型量化。它含三阶段,经实验在多下游任务表现近全精度模型,降内存开销、提推理速度,作者全是微软研究院华人。

量子位