「多语言能力」共找到 6954 篇相关文章
LoRA中到底有多少参数冗余?新研究:砍掉95%都能保持高性能
这篇创新研究介绍了LoRI技术,证明即使大幅减少LoRA的可训练参数,模型性能依然强劲。研究团队在多个任务上测试了LoRI,发现仅训练LoRA参数的5%,LoRI就能匹配或超越其他方法的性能。
Google封神,计算机视觉的GPT3时刻来了!
Google Deepmind称在CV领域做出类似GPT-3的成果,Veo 3经大规模训练涌现通用视觉理解和推理能力,能以图片+提示词完成复杂视觉任务,还具备感知、建模等四大超能力。
Git for Data: 像 Git 一样管理你的数据
传统数据恢复手段在AI时代耗时费力,Git for Data带来变革,具备版本控制、快速回滚等能力,是AI时代数据管理新范式。MatrixOne数据库已具备其核心能力,未来将持续增强相关特性。
11 年前的那张图,又火了
一张2015年关于AI的智能曲线图近日在X上刷屏,马斯克也进行了转发。该图作者Tim Urban将AI分为ANI、AGI、ASI三个层级,指出人类习惯线性思考,但AI进步是指数级的。如今AI发展加速,其能力边界不断扩张。
在校生开发,榨干 win 系统全部带宽!
介绍在校生开发的开源工具 HypoMux,它面向 Windows,能把多张网卡「绑」在一起,让下载任务多线路并行。有双模式可选,还能智能分流,兼容主流加速器。操作简便,可解决下载慢问题。
第四届智能流体力学产业联合体大会在深圳隆重召开
2025年11月29日,第四届智能流体力学产业联合体大会在深圳召开。众多专家学者参会,交流前沿问题与成果。会上发布“多智能体协同流体力学工业软件平台”“风神NF3”数字孪生风洞等,还围绕多议题研讨。
AI终于学会「读懂人心」,带飞DeepSeek R1,OpenAI o3等模型
威斯康星大学麦迪逊分校联合清华大学的研究《MetaMind: Modeling Human Social Thoughts with Metacognitive Multi-Agent Systems》,将元认知理论融入LLM架构,让AI“读懂人心”。其框架分三阶段,还有动态社交记忆,在多基准测试表现出色。
Anthropic实践发现:Multi-Agent系统的核心仍然是Prompt设计!
近期Anthropic分享构建多智能体研究系统最佳实践,提出8条研究智能体的提示工程与评估原则。其架构采用协调者 - 工作者模式,与传统RAG方法不同,使用多步骤搜索动态查找信息。
为了「自我锤炼」,OpenAI 造了一个攻击力极强的「AI 黑客」
OpenAI宣布扩展网络安全计划Daybreak,推出GPT‑5.6‑Cyber,分蓝队和红队。红队模型模拟黑客找漏洞,能力强悍,高危安全任务完成率达95%。但此举也带来安全风险,OpenAI采取分级授权等措施。
Harness is the New Dataset:模型智能提升的下一个关键方向
文章指出当基模能力成熟,决定 agent 上限的是围绕模型搭建的系统,即 harness engineering。介绍其组件、设计原则,探讨模型与 harness 关系,还列举创业机会项目,最后推测下一范式是 Coordination Engineering。