「端到端模型」共找到 9084 篇相关文章
HexStrike代理:让大模型继承专家经验,显著提升渗透测试效率
HexStrike是开源渗透测试工具,以MCP为底座。其核心智能组件IntelligentDecisionEngine是专家系统,将安全专家经验规则化,通过知识库和算法提供工具选择和参数优化,提升渗透测试效率。
从0到1:天猫AI测试用例生成的实践与突破
本文阐述天猫技术团队在AI赋能测试领域的实践,讲述智能测试用例生成落地路径。介绍业界现状与天猫业务特性,给出实施策略,展示应用效果,还指出问题并对未来发展做了展望。
刚刚,马斯克发布Grok 4!全榜第一,年费飚到2万+
北京时间中午,马斯克现身 xAI 发布会发布 Grok 4,称其是世界最好的 AI。Grok 4 推理能力强,多类基准测试成绩领先,还在多方面能力获加强,已上线但付费昂贵。
比思维链准43%!逻辑脑+大模型直觉,推理可靠性大幅提升
中德研究团队发布成果,给大模型外挂「逻辑脑」,结合答案集编程与LLM,构建神经 - 符号框架,提升空间推理准确率,让AI能说清逻辑、跨任务迁移,迈向更可靠的通用推理。
从概念到生产级部署:AWS如何破解Agentic AI落地难题?
红杉美国合伙人预测2025年是AI agent元年,但此前Agentic AI落地难。AWS在纽约峰会推出系列产品,如Amazon Bedrock AgentCore等,完成从存储到市场的升级,有望推动企业构建Agentic AI。
超越OpenAI、拿下全球双料第一,“AI吴彦祖”背后大模型SOTA了!
国产大模型MiniMax发布Speech - 02,拿下两项全球权威语音基准测评第一,是榜单前十唯一国产玩家。它超拟人、个性化、多样,技术创新,且在多行业落地,全模态布局领先。
MiniMax M3 实测:第一流的模型,已经对执行层动手了
文章对 MiniMax M3 模型进行多维度实测。它强化 Coding 与 Agent 能力,能完成长任务,与 Sonnet 4.6 竞技各有优势,多模态能力强,价格有竞争力,MiniMax Code 意在争夺开发者工作流入口。
为了活到120岁,硅谷富豪们正在把自己变成小白鼠
硅谷富豪为活到120岁,用‘生物黑客’手段抗衰,如服雷帕霉素、尝试血浆疗法等。科研人员警告,这些技术未临床测试,效果和安全性未知。同时,长寿科技成资本热门,不同公司有不同路径。
大模型可否胸有成竹?探索LLM推理与自信心的关系 | 直播预约
本次全英文直播将探讨大语言模型推理能力扩展瓶颈,介绍以置信度为核心的推理视角,展示“自确定性”指标及应用,还会讨论方法有效性和“基于置信度的推理”意义。
告别「面瘫」配音,InfiniteTalk开启从口型同步到全身表达新范式
传统video dubbing技术有局限,新兴模型也有问题。美团视觉智能部研发的InfiniteTalk引入‘稀疏帧video dubbing’,实现口型、表情、肢体与音频自然对齐,解决长视频生成难题,技术已开源。