「布局控制生成」共找到 2922 篇相关文章
刚刚,微软推出AI浏览器,上网从此不一样了
微软Edge浏览器推出“Copilot模式”,将其变成AI智能体,有跨标签页情境感知等功能。该模式限时免费,支持语音控制等,还将增加新功能。微软此举或引发浏览器大战,未来浏览器AI模式可能收费。
首个可学习姿态对齐的视频扩散模型!StableAnimator++
当前人像动画扩散模型在人物身份一致性上表现不佳,复旦大学联合多团队提出StableAnimator++,它是首个可学习姿态对齐的视频扩散模型,能生成自然保真的人物动画,还在保持人脸一致性上做了改进。
AI编码不是梦:手把手教你指挥Agent开发需求
文章聚焦AI实践应用,以后端开发为例,介绍用AI编码实现需求的流程,涵盖工程结构、各层代码生成等。还分析AI编程问题,提出解决方案,给出生产案例,最后展望AI在研发中的应用前景。
看懂毫米波雷达,这一篇就够啦!
文章介绍毫米波雷达,它是频率30GHz - 300GHz的电磁波,兼具微波与远红外波特点,有高数据传输速率、高分辨率等优势,也有绕射能力差等弱点,在多领域应用前景广,移远通信等企业正布局。
我用MiniMax Agent开发了个带后端的全栈网站,全程0代码
2025年Agent成AI领域焦点,大厂纷纷布局。作者测试MiniMax Agent,发现其有四大特点:深度研究和上下文管理强,多模态输出出色,编程能力超预期,能执行定时任务,还能开发带后端的全栈网站。
模型训练最重要的依然是 Scaling —— 对话阿里通义千问 Qwen 多语言负责人杨宝嵩 | Open AGI Forum
本文是对阿里通义千问Qwen多语言负责人杨宝嵩的专访。他透露Qwen一开始就将国际化视作核心战略,团队建立文化标注体系确保内容安全合规。还谈到多语言推理难题及应对策略,认为扩大模型规模和数据量仍重要,合成数据是延续Scaling Law的关键。
揭秘大模型评测:如何用“说明书”式方法实现业务场景下的精准评估
文章系统性介绍业务场景下大模型评测流程,包括需求分析、评测集设计生成、维度设定、任务执行和报告输出。指出评测挑战,如设计维度和集,还给出评测方法及案例,像蚂蚁评测集、业务自动化评测。
AI操作有了“紧急刹车”!通义&自动化所AI决策诊断模型,GUI智能体纠错正确率SOTA
阿里通义实验室与中科院自动化所推出GUI - Critic - R1模型,能在GUI智能体操作执行前诊断决策,避免错误。介绍了其动机、方法、数据集及实验,证明该模型在生成判断和提建议方面有效。
利用大模型检测钓鱼邮件:方法,效果及数据集
随着企业安全防范增强,钓鱼邮件成重要攻击手段,大模型检测方法盛行。日本论文详细披露检测方法和实验数据,含解析解码、简化邮件、生成prompt、调用LLM四步,还介绍数据集及评估了四个模型效果。
80亿美元押注Agent!全球第一CRM收购Informatica
昨晚,全球第一CRM平台Salesforce宣布以80亿美元全资收购Informatica,增强其数据基础,利于部署AI Agent。Salesforce高管认为二者结合能打造全面数据平台。Salesforce早布局Agent,其自研平台Agentforce应用效果显著。