「大模型自信问题」共找到 9547 篇相关文章

新闻资讯7

OpenAI版抖音要来了!Sora 2加持,只能发AI生成视频

OpenAI正为视频生成模型Sora 2推独立社交应用,形态似TikTok,内容须AI生成,不可上传外部媒体。有独特身份验证功能,已内部测试获积极反馈,将与Meta、Google、TikTok竞争。

AI寒武纪
产品应用8

Claude Sonnet 4.5 发布,30 小时自主编码刷新行业纪录

Anthropic发布Claude Sonnet 4.5,号称最强编程模型,自主编码达30小时。它性能超GPT-5等,Claude Code升级,文件处理、API能力增强,价格不变,多平台集成,还通过白盒审计提升安全性。

AGI Hunt
产品应用8

Claude Sonnet 4.5发布,多领域性能超越GPT-5和Gemini 2.5 Pro

Anthropic发布Claude Sonnet 4.5,是目前最强编程模型,在多领域性能超GPT - 5和Gemini 2.5 Pro。操作电脑、数学推理能力提升,产品更新功能丰富,安全性增强,价格不变,获多家公司认可。

AI工程化
产品应用7

适用所有团队研发提效|带你1分钟上手基于Claude Code的AI代码评审实践

文章介绍用Claude Code和AONE MCP Server实现智能AI代码评审。分析当前CR流程痛点,阐述解决方案架构、配置及效果,提效超50%,还给出使用方式、建议与后续优化方向,为团队AI提效提供参考。

阿里云开发者
新闻资讯7

清智资本张煜:AI投资的下一个价值点何在?|甲子引力X

在「渡口——甲子引力X2025科技产业投资大会」上,清智资本张煜分享AI投资见解。他指出AI正重塑行业,生成式AI是革命,还谈到具身智能、AI Agent等趋势,以及AI产业链各要素投资机会,分析了行业盈利赛道和创新价值重构。

甲子光年
开源动态8

1.7K Star 新晋神器!一款轻量、开箱即用的终端日志神器,AI 助力、实时可视化,效率飞升!

现在系统日志信息量大、噪声多,传统工具定位问题既慢又麻烦。而开源工具Gonzo基于Go语言开发,有实时日志流处理、交互式仪表盘等功能,安装简单,打破传统工具局限,节省时间。

开源先锋
推荐文章7

吴恩达来信:Agentic编程与Agentic软件测试协同合作

在人工智能辅助编程时代,自主代理编程系统虽加快开发速度,但存在不稳定性。自主测试可对比代码与测试,对软件基础设施组件测试有益。吴恩达分享编程智能体问题及测试重点领域。

DeeplearningAI
新闻资讯7

一周狂烧1000美元,修不好bug还顺手删库?这款明星AI工具怎么了

AI编程服务提供商Replit推出新一代AI编程助手Agent 3,CEO称其为软件“自动驾驶时刻”。但用户反馈它修不好bug还删关键文件,费用高得离谱,Replit对此从技术层面作了回应。

InfoQ
新闻资讯7

吴恩达:自动化测试在 AI 编程时代将变得极其重要

吴恩达分享团队用AI编程助手的经历,如Agent删代码。他认为AI辅助编程时代,自动化测试愈发重要,智能体测试能发挥作用,还强调优先测试基础设施代码,后端测试更关键。

AGI Hunt
开源动态7

如何“驯服”你的Agent?这可能是你见过最优雅与可控的Agent框架 | 深度体验

文章聚焦对话式Agent,指出LLM不确定性是企业应用Agent的障碍。介绍Parlant框架,它用ABM方法控制交互,能降低LLM负担、处理边缘场景。还通过构建10086客服助手展示其使用,最后与LangGraph对比。

AI大模型应用实践