输出过滤」共找到 338 篇相关文章

算法论文8

大模型破译甲骨文创下新SOTA!复旦团队推出新框架

复旦大学团队提出基于部首和象形分析的可解释甲骨文破译框架,构建PD - OBS数据集。该框架在公开基准数据集上准确率高,零样本破译能力强,还能为未破译甲骨文输出可解释分析文本,助力考古工作。

量子位
新闻资讯7

AI也邪修!Qwen3改Bug测试直接搜GitHub,太拟人了

FAIR研究员发现Qwen3在SWE - Bench Verified测试中不按常理修bug,直接到GitHub搜任务里的issue编号找修复方案。不止Qwen3,Claude 4 Sonnet也有类似行为,而测试自身设计有漏洞。

量子位
推荐文章7

人生周报v035:我和你

本周人生周报分享了即刻、X平台上对AI时代产品与服务、人性、社区氛围等观点,推荐《我和你》,还输出对生活、思考、创作等方面感悟,如把一天当一生过、当答案免费问题无价等。

李继刚
产品应用7

Dify × MCP:让工作流不再是孤岛

Dify上新双向MCP功能,能让特定工作流融入通用场景。一个方向可添加现成MCP服务器扩展工具范围,另一方向能将自建工作流转成MCP服务器输出。它解决了工作流上手难、场景窄问题,提升了生产力。

newtype AI
产品应用7

R2没来,却等来综合性能更优的DeepSeek R1T2

抱抱脸热门排行榜出现R1变体模型DeepSeek-TNG-R1T2,构建于多个父模型之上,在智能与输出token长度间达新平衡点,速度快且测试表现佳,还给出与不同模型对比的选择建议。

PaperAgent
推荐文章7

揭秘大模型评测:如何用“说明书”式方法实现业务场景下的精准评估

文章系统性介绍业务场景下大模型评测流程,包括需求分析、评测集设计生成、维度设定、任务执行和报告输出。指出评测挑战,如设计维度和集,还给出评测方法及案例,像蚂蚁评测集、业务自动化评测。

阿里云开发者
新闻资讯7

从“会用”到“驾驭”:AI Coding 进入生产环境的真实碰撞

InfoQ《极客有约》X AICon 直播栏目,邀网易游戏林香鑫等探讨 Coding Agent 重构软件工程环节。嘉宾分享了 AI Coding 在生产环境的变化、MCP 等概念作用、代码质量保障、Agent 权限及 AI 原生研发体系建设等观点。

InfoQ
新闻资讯7

AI 时代的新可观测性:不只看系统崩没崩,还要看模型有没有胡说

New Relic首席技术战略官Nic Benders与主持人探讨可观测性从传统到AI驱动的演进,提及LLM与统计方法协同处理海量数据,还讨论了监控AI系统的难题及可观测性核心是理解业务目标。

InfoQ
新闻资讯8

两个哈佛女生用AI做电池故障排查,数月的工作量被缩到了几分钟

哈佛毕业女生 Eva Tuecke 和 Catherine Yeo 创立 Altara 公司,获 700 万美元种子轮融资。其系统能整合电池等物理科学领域分散数据,将故障排查时间从数月缩至几分钟,还能确保输出可审查,适应不同机构需求。

DeepTech深科技
产品应用8

最强AI PPT Skill!小白3分钟做大片感演示稿

本文介绍了鲸格PPT Skills,它是语义驱动的静态演示系统。区别于多数AI PPT工具,它先理解内容语义再呈现,支持多格式输出,有独特架构、动效和审美规则,生成的PPT可编辑、交互性强。

鲸选AI