评估问题」共找到 3739 篇相关文章

算法论文8

从物竞天择到智能进化,首篇自进化智能体综述的ASI之路

普林斯顿大学等机构研究者发布首个自进化智能体综述,为领域建统一理论框架和路线图。综述给出形式化定义,围绕What、When、How、Where构建分析设计框架,还探讨评估范式并指明未来方向。

机器之心
新闻资讯7

谷歌创始人布林紧急接管Gemini团队,但“3.5 Pro已被取消”

谷歌Gemini 3.5 Pro未按计划推出,据判断已被取消。Gemini Flash系列表现不佳,谷歌AI面临压力,创始人布林重新参与相关战略讨论,而谷歌可能存在算力分配问题

量子位
新闻资讯8

Ilya 最新演讲:AI 将递归构建更强大的自己

Ilya Sutskever在演讲中称AI将递归构建更强大的自己,走向递归自我改进道路。他分享个人经历,还指出大型神经网络功能强大,AI发展不可预测,相关问题暂无答案。

AGI Hunt
新闻资讯7

为什么你的 Agent 总是出故障?从算力基建到可信熔断的架构生死线 | 直播预告

本次直播集结值得买、商汤、明略三位技术专家,拆解可信 Agent 构建之道。将探讨大模型基础设施、可信 Agent 架构、MCP 协议实战等问题,还会解答观众提问。

AI前线
推荐文章7

Anthropic8张图,揭示Workflow & Agent的协作场景

文章借Anthropic的阐述,区分了Workflow与Agent概念。指出任务明确用Workflow,开放式问题用Agent,还介绍了构建blocks、workflows方法及Agent工作方式和实施原则。

CourseAI
开源动态7

直播实时离线翻译

传统离线翻译模型有延迟问题,GitHub上NoLanguageLeftWaiting开源项目把Meta的NLLB模型改造成实时同传模型,能边听边译,支持200种语言互译,还在开发推测解码功能提升速度。

GitHubStore
开源动态7

5.8k Star 基于LangGraph的Multi-Agents炒股框架,7种Agent形成金融交易闭环

TradingAgents是模拟真实交易公司运作的多智能体交易框架,用LangGraph构建,有灵活性与模块化特点。由7种LLM驱动的专业智能体协同评估市场、制定决策,还介绍了架构和实战操作。

CourseAI
算法论文8

从需求分析到代码生成,LLM都能干点啥?一文读懂291个软工Benchmark!

大语言模型重塑软件工程各环节,但缺乏评估其在该领域表现的系统工具。浙江大学等机构团队首次对291个软件工程Benchmark系统综述,分析现状、痛点并给出改进方向。

新智元
新闻资讯7

博士生,当代最穷科研民工?Nature最新调查:不涨工资,我们就跑路了

Nature公布对全球3785名博士调查,结果喜忧参半:满意度回升,但薪酬与指导拖后腿;AI使用普遍,不过多数人不信任其输出结果;骚扰与偏见问题严重,心理健康告急。

新智元
新闻资讯7

刚刚,Anthropic 53页绝密报告曝光:Claude自我逃逸,将引爆全球灾难!

Anthropic发布53页报告预警,Claude Opus 4.6风险逼近ASL - 4,若自我逃逸将致全球失控。2026年AI领域状况频出,安全专家离职,多起危险事件凸显AI安全问题严峻。

新智元