「硬件能力」共找到 3642 篇相关文章
马斯克Grok-4卖货创收碾压GPT-5!AI卖货排行榜曝光,AGI的尽头是卖薯片?
新智元报道,「Vending Bench」榜单让大模型经营自动售货机一较高下。Grok - 4卖货能力超GPT - 5,销量约高2倍,营收增31%。此测试揭示AI长周期决策挑战,引发AGI定义讨论。
“智元机器人收购A股上市公司是创新需要…现金流能撑三年”
智元机器人收购A股上纬新材后公开亮相,董事长邓泰华透露融资、出货等规划。其团队高管回应收购舆论、技术成果及合作等问题,如远征A2高温行走突破、与上市公司合作原因等,还提及出海和工业场景ROI规划。
AI Agent接管谷歌搜索!预订餐厅、定制搜索结果,一键搞定所有事
今天凌晨谷歌宣布,谷歌搜索AI模式新增AI Agent功能,可自动预订餐厅、定制搜索结果。该功能用了自研Project Mariner实时网络浏览能力,以英语扩展到180多国,还将拓展更多领域。
小小具身智能成果,高中生在腾讯拿下!
腾讯2025星火挑战周上,八十余位高中生聚焦前沿课题取得诸多成果,如具身智能成果获张正友点赞。课题涉及具身智能与机器人、长文本理解等方向,不少项目有实用价值,68名同学获清北offer。
DeepSeek V3.1 Base突袭上线!击败Claude 4编程爆表,全网在蹲R2和V4
昨晚,DeepSeek官方悄然上线全新V3.1版本,上下文长度拓展到128k,参数685B,支持多种精度格式。其编程能力突出,在Aider测试中霸榜,性能超越Claude Opus 4,还有成本低等优势。
字节Seed开源长线记忆多模态Agent,像人一样能听会看
字节Seed发布全新多模态智能体框架M3 - Agent,能听会看、有长期记忆且免费开源。团队还开发新长视频问答基准M3 - Bench并开源。实验显示,M3 - Agent在多基准测试中显著优于基线模型。
模仿人类推理修正过程,阶跃星辰提出形式化证明新范式 | 开源
阶跃星辰发布并开源形式化定理证明大模型 StepFun-Prover-Preview-7B 和 32B。采用两阶段监督微调、工具集成强化学习及 RL 与 SFT 迭代循环优化等策略,在基准测试集表现佳,还展示多个证明案例。
实测GPT-5:写作坠入谷底,编程一骑绝尘。
文章记录了GPT - 5的发布情况,介绍其系统构成、减少事实幻觉和谄媚行为等改进,也提到跑分、性格设置等。实测发现写作和情商不如GPT - 4.5,但编程能力强,还感慨AI发展之快。
别听模型厂商的,Prompt 不是功能,是 bug
风险投资Conviction创始人Sarah Guo分享2025年AI创业观察,指出从用户体验看,prompt是缺陷非功能;传统低技术行业正快速拥抱AI;还分析了AI能力进展、应用案例及投资机会等。
隐藏超多上下文工程(Context Engineering)技巧的框架,来试一试吧!
文章指出多数人构建的AI Agent像Shallow Agent,处理复杂任务能力弱。以Claude Code等为例,介绍深度Agent架构的秘密,如冗长提示词、规划工具等,还推出开源包deepagents方便上手。