AgentScope 1.0」共找到 2396 篇相关文章

算法论文7

1美元Token撬动4800美元收益!AI挑战百万美元级基准,最赚钱的Agent出现了

Humanlaya Data Lab等机构构建$OneMillion - Bench评测基准,用经济价值衡量模型。它含400道高难题目,覆盖多领域。目前最强模型能产出约50万美元价值,但离可交付专业任务还有距离。

机器之心
算法论文8

训练加速1.8倍,推理开销降78%!精准筛选题目高效加速RL训练丨清华KDD

清华大学THU-IDM团队与慕尼黑大学CompVis团队合作提出MoPPS框架,解决强化微调代价高问题。它精准挑题,预测难度,开销低、动态适应且平衡探索利用,在多任务表现佳,降本增效,有新范式。

量子位
开源动态8

1.2万人收藏单日斩获 3.4K!刚刚冲上 GitHub Trending 榜首的“AI 红队”工具!

AI加速代码编写,但也留下更多安全坑,传统扫描工具和人工渗透测试难以应对。新晋GitHub Trending榜首工具Shannon是全球首个开源全自动AI渗透测试员,多智能体架构,功能强大,适合AI编程团队。

开源星探
产品应用8

美团提出全新多模态统一大模型STAR,GenEval突破0.91,破解“理解-生成”零和困局

近日美团推出多模态统一大模型 STAR,以“堆叠自回归架构 + 任务递进训练”实现理解与生成双重突破。它解决行业痛点,通过三大核心设计统一能力,实验在多任务中表现顶尖,还给出后续探索方向。

机器之心
产品应用8

1人顶1个Infra团队!OpenAI前CTO新招,让大模型训练跌成白菜价

大模型训练正从‘作坊炼丹’进化为‘工业微调’。OpenAI前CTO创立的Thinking Machines Lab推出Tinker,潞晨云微调SDK兼容其范式,实现算法设计与基础设施解耦,降低成本,提升人效,适用于多场景。

新智元
7

AI写论文,AI评阅!AI顶会ICLR完成「AI闭环」,1/5审稿意见纯AI给出

在号称「史上最严管控AI」的顶级会议ICLR 2026上,超五分之一审稿意见由大模型一键生成。这发生在ICLR颁布史上最严LLM规定后不久,引发诸多争议,也凸显AI改写科学评审分工的趋势。

新智元
新闻资讯8

OpenAI官宣自研首颗芯片,AI界「M1时刻」九个月杀到!联手博通三年10GW

OpenAI官宣与博通合作造AI芯片,预计2029年底部署10GW算力。内部已研发18个月,首颗芯片9个月后量产。双方将垂直整合技术栈,还会用ChatGPT设计芯片,目标是实现算力充裕。

新智元
算法论文7

1/3预算跑平 GPT-5?上海AI Lab「路由魔法」成本直降63%性能反涨 7%!

当前大模型需解决性能与效率平衡问题,GPT - 5用测试时路由技术初步平衡。Avengers - Pro测试时路由框架集成不同LLMs,通过嵌入、聚类、评分操作,调整权衡参数α,能依查询特征选模型,性能和效率优于单一模型。

CourseAI
7

10亿天价挖角惨遭12人连环拒,小扎钞能力失灵!OpenAI系初创0人卖身

Meta为从OpenAI前CTO初创公司挖人,开出10亿美元天价,却遭12人拒绝。同时,苹果AI团队一月内流失4员大将。此外,Meta的Llama 4发布遇挫,小扎豪掷重金重组AI部门,其AI豪赌回报成疑。

新智元
开源动态8

谷歌杀疯了!全新开源AI编程工具Gemini CL,刚开源1天就斩获26.5K标星!

谷歌推出全新开源AI编程工具Gemini CLI,开源不到24小时获26.5K标星。它将Gemini 2.5 Pro塞进命令行终端,有自然语言驱动等多种能力,免费额度高,可扩展,部署简单。

开源星探