「AI开发助手」共找到 10299 篇相关文章
人格向量:大模型性格的数学解码与精准操控
大语言模型在应用中会出现危险行为偏移与训练引发的非预期偏移,传统方法难监控干预。本文发现人格特质在线性方向表现为“角色向量”,实现提前预测、实时监控和主动控制,为AI安全提供数学框架。
京东深夜开源,首个完整通用Agent产品,直指行业SOTA!
京东深夜开源业界首个“开箱即用”完整多智能体产品`JoyAgent-JDGenie`。与大多为SDK或框架的开源项目不同,它是端到端完整产品。在GAIA榜单表现佳,架构清晰且有技术创新,使用和二次开发简单。
全球首个科研LLM竞技场上线!23款顶尖模型火拼:o3夺冠,DeepSeek第四
Ai2耶鲁NYU联合推出科研版「Chatbot Arena」——SciArena,23款顶尖大模型比拼科研任务,OpenAI o3夺冠,DeepSeek第四。该平台解决通用基准测试在科研场景‘失效’问题,但其自动评估系统猜科研人偏好远未及格。
让大模型上车:理想汽车硬件协同设计算出最佳边缘模型
长三角洲AI实验室、中科院、理想汽车等找到大语言模型硬件协同设计寻优之路,在相同延迟下降低端侧模型困惑度,压缩模型架构挑选时间。研究揭示缩放定律,打造硬件感知建模框架,找到精度与延迟最优解。
市值冲上2036亿港元!这家芯片“隐形冠军”在港交所敲钟了
2月9日,澜起科技于港交所主板正式挂牌上市,上市首日市值达约2036.69亿港元。它由杨崇和等创立,专注内存接口芯片领域,技术领先,业绩受技术与产业周期影响,嵌入全球AI基础设施核心供应链。
奥特曼爆料:GPT-5重构彻底一切!一人顶五个团队
GPT-5的发布或是一场技术变革。奥特曼在对谈中给出未来清单,谈到年轻人学习方向、创业思路等。他认为GPT-5是大飞跃,年轻人要掌握AI工具,还提出评估大模型智力新指标等。
OpenAI和奥特曼将投资一家脑机接口公司,直接与马斯克的Neuralink竞争
据《金融时报》报道,OpenAI及其联合创始人山姆・奥特曼将投资Merge Labs,该公司目标是连接人脑与计算机,此举将与马斯克的Neuralink竞争。此外,奥特曼和马斯克还围绕AI在X上展开骂战。
Product Hunt CEO 拆解 PH 打榜:Launch 不是一次性的事
Product Hunt的CEO Rajiv Ayyangar接触大量新产品Launch,在播客分享心得。他认为AI产品Launch很关键,要尽早且清晰介绍核心功能。还给出实操建议,如写短宣传语、小范围试水等。
Google推出Gemini Spark:不用开电脑也能24小时跑
Google在2026年I/O大会推出个人AI代理产品Gemini Spark,是24小时数字生活助手。它搭载Gemini 3.5大模型,用自研Antigravity框架,运行在Google Cloud虚拟机,可对接Google工具,后续将通过MCP接第三方服务。
Claude Code新功能Auto Mode能否替代人工审核?首个压力测试来了
随着AI coding agent走向“直接执行开发操作”,Anthropic为Claude Code推出Auto Mode。香港科技大学与ETH Zurich研究团队对其进行首个系统压力测试,发现Auto Mode端到端误放行率达81.0%,部分危险操作绕过审核。