「专家级表现」共找到 3397 篇相关文章
谷歌nano banana正式上线:单图成本不到3毛钱,比OpenAI便宜95%
昨晚谷歌图像生成与编辑模型nano banana上线,正式名gemini - 2.5 - flash - image - preview。它有强大能力,成本低,有多种玩法,上线后测试火爆,在多个榜单成绩优异。
我只推荐这5个!24个开源Agent/Workflow框架大比拼!
文章围绕《A Survey on Agent Workflow》展开,介绍了Agent Workflow概念、与Multi - Agent差异、核心组成及Agent角色。对24个主流框架进行对比,还给出不同场景下的框架选择建议,指出当前框架缺乏统一标准。
Llama惨遭抛弃!Meta内部改用Claude写代码
据Meta工程师透露,Meta内部开发已弃用自家Llama,改用Claude Sonnet写代码。Llama 4风评不佳,有人怀疑Llama 5是否会推出。Claude写代码能力一流,其背后公司收入增长快。
思维锚点:破解LLM Reasoning黑箱的关键句
文章提出思维锚点概念,指推理轨迹中影响后续步骤和答案的关键句。开发三种归因方法,系统论证高级组织句影响力更大,锚点主导错误修正。研究为理解LLM推理机制开辟新途径,开源工具支持可视化分析。
AI一眼认出95万物种,还能分辨雄雌老幼,2亿生物图像炼成“生命视觉”大模型
俄亥俄州立大学团队用2亿生物图像训练BioCLIP 2模型,取得最优物种识别性能。它在无相应监督信号的非物种任务中,准确率远超DINOv2,还涌现出物种间生态对齐、物种内差异分离等生物学理解。
最低仅需2G显存,谷歌开源端侧模型刷新竞技场纪录,原生支持图像视频
今天凌晨,谷歌官宣Gemma 3n,原生支持多模态。它在大模型竞技场超1300分,是首个超此分数的10B以下模型。其VRAM占用低,最低2GB,已在谷歌AI Studio等可用,还公开了技术细节。
LangChain官方实测:多智能体架构怎么选?
构建AI Agent时,单智能体应对复杂场景易“变笨”且难维护。LangChain官方评测主流多智能体架构,在复杂零售场景实验,对比单智能体、Swarm、Supervisor架构的性能、成本,还给出优化Supervisor架构的方法。
性能大涨!阿里开源新版Qwen3模型,霸榜文本表征
今日凌晨阿里开源Qwen3-Embedding和Qwen3-Reranker两款新模型,专为文本表征等任务设计,支持119种语言。测试显示其性能出色,在多语言文本表征和排序任务中超越众多模型,还采用了多种创新设计与训练方法。
卷疯了!2.2k Star通用型、开源Agent平替Manus、GenSpark AI
2025 年是 Agent 之年,文中介绍了 Manus、GenSpark AI 两款闭源代理,还重点阐述开源的 II - Agent,它功能丰富,架构设计合理,在 GAIA 基准测试评估,性能可平替前两者。
灵宝 CASBOT 与 CASIA 共同提出“增强物理人机协作中的人类意图估计和人机角色分配”方法
近日,ICRA 2025 在美国亚特兰大开幕,中科院自动化所与灵宝 CASBOT 提出的“增强物理人机协作中的人类意图估计和人机角色分配”方法获录用。该方法解决现有问题,实验显示优势明显,有巨大应用潜力。