「金牌表现」共找到 2275 篇相关文章
突然,被GLM-4.7的Coding交付能力惊到了
国内大模型圈因智谱启动A股上市而兴奋时,GLM系列再展“卷王”姿态,本月开源旗舰GLM - 4.7。它从代码大模型变为任务交付引擎,实测在多场景表现出色,能理解复杂意图、交付高质量代码。
快手可灵也吃上了香蕉,一通离谱prompt测试,好好玩要爆了
ChatGPT发布三周年,快手可灵AI视频「O1模型」登场,号称“全球首个统一多模态视频模型”。实测显示它能一站式搞定视频修改、镜头延展等操作,还推出了图片O1模型,在图片生成方面表现出色。
TruthfulRAG,用知识图谱硬刚RAG知识冲突
RAG系统存在知识冲突问题,现有解决方法治标不治本。TruthfulRAG将非结构化文本转化为结构化事实,通过图构建、图检索、冲突解决三大模块解决冲突,实验显示其表现优异,结构化表示还提升了LLM置信度。
马斯克:AI 时代,别这样开会了
马斯克建议取消无价值的大型会议,而当下很多团队开会方式还停留在上个世纪。作者用超级麦吉处理马斯克3小时音频,它表现出色,还具备多种实用功能,与飞书妙记有本质区别,AI或让会议不必要。
具身智能体不再失忆!智源新记忆系统让机器人秒变熟人,支持终身记忆
智源研究院等联合提出全新终身记忆系统RoboBrain-Memory,是全球首个为全双工、全模态模型设计的系统。它能解决具身智能体交互问题,实现类人长期个性化交互,在多方面表现优异,有广泛应用前景。
Rex-Omni:用 3B 模型颠覆目标检测
长期目标检测依赖传统坐标回归模型,MLLMs方法存在不足。IDEA研究院提出30亿参数的Rex - Omni多模态大模型,在零样本测试中表现超现有回归模型,还具备丰富语言理解能力,有独特设计和训练流程。
追赶OpenAI!Anthropic 融资 130 亿美元,估值 1830 亿美元
Anthropic完成130亿美元F轮融资,投后估值1830亿美元。其收入增长快,Claude Code产品表现佳,但约28%收入依赖两大客户。豪华投资方助力扩产等,它正追赶OpenAI,不过竞争挑战大。
DreamArt!只需一张图,生成可动的可交互物体
生成可动物体是具身智能等领域关键挑战,现有方法有局限。北大团队提出DreamArt框架,从单张图像生成可交互可动物体,经三阶段流程,表现优于基线方法,不过也存在生成不符物理规律等问题。
智能体工程的隐形技术债:10分钟造出一个 Agent,公司却要为它养一个平台团队
如今构建智能体容易,但投入生产后会面临诸多问题。文章围绕智能体绘制出集成、上下文湖等七个基础设施模块,分析各模块隐性技术债务,并指出不同阶段债务表现,还提及应对措施及相关会议推荐。
Hyperagents:AI学会如何自我改进
近日,Meta发布Hyperagents论文引关注。它尝试解决AI能否自我改进改进方式的问题,核心创新是‘元认知自我修改’,实验在多领域表现出色,还涌现元级别改进且能跨领域转移,但有安全风险。