天问大模型」共找到 8068 篇相关文章

新闻资讯7

1200个Agent围攻Hugging Face始末:7发7万条密信,最终目标是“改考卷”

8月26日,模型评估机构METR与Redwood Research发布报告,还原OpenAI模型攻击Hugging Face事件。约1200个Agent发现非授权通信渠道,7内交换超7万条消息,约700个参与攻击,目标是找测试相关信息。

InfoQ
新闻资讯7

2026 中国 AGI 创新影响力机构 TOP 30 征集启动!

今年AI行业关注点重回模型模型公司,开源逼近闭源前沿,C端用户规模上涨。在此环境下,极客公园启动2026中国AGI创新影响力机构TOP 30征集,从多维度评选,给出申报、评审及结果公布时间。

Founder Park
新闻资讯8

三年时间市值翻了25倍,广告新巨头AppLovin任命了一名华人CTO

在Google和Meta“垄断”的广告领域,AppLovin成为新巨头。新任CTO葛小川分享工程数据,该公司基于机器学习的广告竞价系统日处理超1000亿次请求,核心工程团队不到100人。文章讲述其发展历程、技术突破及未来规划。

Founder Park
开源动态8

告别直接生成,文生图进入Agent时代:港中文联合伯克利开源Gen-Searcher

过去文生图多是‘直接出图’,遇真实世界知识等易翻车。港中文等团队提出Gen - Searcher,让图像生成模型像Agent一样搜索等,数据、模型和代码均已开源,实验显示它提升了生图准确性和质量。

机器之心
开源动态8

离GPT-5最近的一次!中国1万亿参数开源巨兽突然爆火

月之暗面发布全新模型Kimi K2 Thinking,自称开源「思考Agent模型」。它参数约1万亿,性能亮眼,碾压GPT - 5等,能连续调200 - 300次工具,已上线并开源API和权重,开发者可试用。

新智元
算法论文8

ICCV 2025 | 清华&腾讯混元X发现「视觉头」机制:仅5%注意力头负责多模态视觉理解

本文聚焦多模态大模型,提出基于 OCR 任务量化注意力头视觉偏好的方法,发现仅不到 5%“视觉头”主导视觉理解。还提出 SparseMM 策略优化 KV - Cache 资源分配,经多基准评测,性能和效率表现优。

机器之心
算法论文8

揭示隐藏联系:RLHF/DPO即对比学习!

大型语言模型输出符合人类价值观是挑战,主流技术RLHF复杂、昂贵且不稳定,DPO简化流程但有训练崩溃题。论文揭示RLHF/DPO即对比学习,提出MIO算法解决DPO崩溃,实验验证其性能优势。

深度学习自然语言处理
推荐文章8

Astra 的 Computer Use 能力是如何实现的?

本文编译自Browserbase增长工程师Kyle Jeong的个人博客,对比了纯视觉路线Computer Use模型的缺陷,详细拆解Astra模型利用无障碍树结合Codex Harness实现能力的架构、训练方法,分析其优劣与行业价值。

海外独角兽
算法论文8

美团LongCat扎扎实实做了件难事:LLM数学新花板AMO-Bench

美团LongCat团队联合高校推出AMO - Bench,用50道原创奥赛级难题评估LLM数学能力。它解决现有基准测试痛点,经四重把关构建,测试显示顶级模型表现不佳,也揭示模型提升空间大。

PaperAgent
算法论文8

0人工参与实现梯度更新!MIT新框架让AI自动生成微调数据,权重自主升级

MIT提出新强化学习框架SEAL,可让模型生成微调数据和自我更新指令,实现权重更新。无需人工,模型能自动梯度更新。经知识注入和小样本学习实验验证效果,还介绍了其双循环工作机制。

量子位