商汤万象开发者
商汤万象开发者 发表了博客
问题:调用主体不明 在工程框架里,有一类很隐蔽但很常见的问题:同一个方法,看起来一样,结果却完全不同。å 为什么?因为方法的语义,不只取决于“做了什么”,还取决于——谁在调用。 很多操作天然分两种: 类级操作:影响全局 实例级操作:只影响当前对象 但问题在于,这两种操作,写法往往是一样的,于是就很容易出现这种情况:本来只是想改当前对象,结果把全局改了;或者全局状态,被某个实例悄悄改掉。更麻烦的是,这类...
美团技术团队
美团技术团队 发表了博客
引言 --- 物理世界的信息由图像、声音、文字交织而成。今天的大模型,本质上仍然是**以语言为中心的建模系统**,语言作为人类智慧符号化表述,在"压缩即智能"的范式下表现出强大的能力。但通往真正的物理世界智能,也许语言并不是世界的边界。视觉、语音与文本等多模态信号,实际上是对现实物理对象的不同侧面投影。 ![](https://oscimg.oschina.net/oscnet//9a7083f3770ac68563e7dddbf688ad4e.png) 这就引出一个根本问题:**能...
OpenAgents
OpenAgents 发表了博客
OpenClaw火了。 3 个月内斩获 28 万 GitHub Star ,这个全能的AI助手帮你聊天、管日程、写代码···· 显而易见,AI 正从"聊天"走向"行动"。 但行动之后呢?随着养虾热潮深入,新的问题浮现:当多个智能体需要一起完成复杂任务时,谁来负责协调?如何让不同智能体一起工作? OpenAgents 给出了答案:Agent 网络。 OpenAgents是一个专注于多智能体协作的开源框架,支持跨框架协作,多个智能体可以在其中相互沟通协作、共享资源,...
美团技术团队
美团技术团队 发表了博客
近日,美团 LongCat 团队正式对外发布并开源 LongCat-Flash-Thinking-2601。作为已发布的 LongCat-Flash-Thinking 模型的升级版,LongCat-Flash-Thinking-2601 在 Agentic Search(智能体搜索)、Agentic Tool Use(智能体工具调用)、TIR(工具交互推理)等核心评测基准上,均达到开源模型 SOTA 水平。 ![](https://oscimg.oschina.net/oscnet//5e3596fd27bf221957293281fe0ebf6a.png) 该模型尤其在工具调用上表现出卓越的泛化...
美团技术团队
美团技术团队 发表了博客
[AAAI](https://aaai.org/) 是人工智能领域顶级的国际学术会议,本文精选了美团技术团队被收录的8篇学术论文(附下载链接),覆盖大模型推理、 退火策略、过程奖励模型、强化学习、视觉文本渲染等多个技术领域,希望这些论文能对大家有所帮助或启发。 ![](https://oscimg.oschina.net/oscnet/up-bfa53eac2485e32035c0be1186b661ead5b.jpg) 01 Promoting Efficient Reasoning with Verifiable Stepwise Reward -----------------...
twwch
twwch 发表了博客
**🤔 为什么造这个轮子?** 大家现在应该都习惯用 ChatGPT/Claude 写代码了,但在"画图"这件事上,体验还是很割裂: 1. **生成的是死图:** DALL-E 生成的流程图文字经常乱码,且没法二次编辑。 2. **Mermaid 虽好但有局限:** 简单的时序图还行,一旦要画复杂的系统架构图或拓扑图,手写语法非常痛苦。 3. **无法联动:** 我想从一张白板草图直接变成可编辑的代码,目前市面上很少有工具能流畅跑通这个流程。 所以我开发了 ...
RWKV元始智能
RWKV元始智能 发表了博客
2025 年 12 月 13 日,RWKV 在上海漕河泾举办了主题为《RWKV-8 与未来趋势》的 2025 RWKV DevDay。 十位来自 RWKV 开源社区的重磅嘉宾带来了深度分享,内容涵盖 [RWKV-8 的核心 ROSA 机制](https://www.rwkv.cn/news/read/20251029)、并发推理、端侧推理优化、评测方法,以及 RWKV 最新生态进展等多个维度。现场气氛热烈,观众与嘉宾进行了深入的互动与探讨。 ![](https://oscimg.oschina.net/oscnet/up-14db4ce17e64b8d30264e...
美团技术团队
美团技术团队 发表了博客
> AI生成代码质量难以把控!本文分享来自美团的技术实践,三大策略破解AI编程痛点。单测快速验证逻辑正确性,安全网保护存量代码演进,TDD模式精准传递需求。告别「看起来没问题」的错觉,构建AI时代的代码质量保障体系。 ![](https://oscimg.oschina.net/oscnet/up-34d8bd8f0e5e0ead6ddc90ff30c3fc60842.png) 一、引言 ---- 目前,国内外很多AI Coding助手能在几秒钟内生成完整代码块,大大提升了开发效率,但这种高速开发模式...
RWKV元始智能
RWKV元始智能 发表了博客
2025 年 11 月 30 日, **RWKV7-G0b 13.3B** 推理模型开源发布。它基于 RWKV7-G0a4 13.3B 继续训练高质量数据,显著提升各项能力。 > RWKV 模型名称的 **G1/G1a/G1a2/G0a3** 等字段是**训练数据的版本** ,数据质量 G#b \> G#a4 \> G#a3 \> G#a2 \> G#a \> G#,数据数量 G1 \> G0。简单规则:**同一参数选择最新的模型,效果最好**。 模型性能评估 ------ ![](https://oscimg.oschina.net/oscnet/up-f6f85cfbfc739b0b19472e92cf...
SelectDB
SelectDB 数据库管理员 发表了博客
随着人工智能技术在业务中的渗透,我们逐渐意识到:AI 不仅是提升效率的工具,更是重构数据处理与消费方式的核心驱动力。在这一背景下,我们思考:**能否构建一款「AI + Data」一站式融合的数据引擎?** 它不仅能够统一处理文本、音视频等非结构化数据与传统结构化数据,还能为算法工程师提供流畅的数据开发体验,实现数据处理与 AI 模型无缝衔接,并能确保数据处理负载与在线服务负载完全隔离。这是 2024 年末启动 DataMind 项...
美团技术团队
美团技术团队 发表了博客
一、推理模型 ⾯ 临的新挑战 -------------- 随着 OpenAI o1 、 DeepSeek-R1 等大型推理模型(LRMs)的问世, AI 推理能力迎来了「测试时扩展」的新阶段。这些模型通过长链思维(Long Chain-of-Thought, CoT)在数学推理、代码生成、智能体任务等领域展现出强大能力。 ![](https://oscimg.oschina.net/oscnet//387472474594be3f79fd9bdb78cd0c9d.png) 然而,现有评测体系存在一个关键盲区:主流基准测试(如 MATH500 、AIME)主...
肖滢
肖滢 发表了资讯
11月线下活动汇总
OpenAgents
OpenAgents 发表了博客
为推动多智能体技术及应用的发展,激励广大开发者探索与创新,OpenAgents 社区正式发起 Multi-Agent Hackathon 2025 !我们诚邀您利用 OpenAgents 这一强大的基础设施,构建能够相互发现、学习与协作的多智能体网络,共同描绘开放协作的未来图景。 无论您是AI领域的资深开发者,还是对智能体协作充满好奇的探索者,这里都有您一展身手的舞台。总预算15,000元人民币的奖金与荣誉,期待您的参与! 立即报名&查看大赛详情:https:/...
美团技术团队
美团技术团队 发表了博客
![](https://oscimg.oschina.net/oscnet/up-ef47b7a4c645291dda8349a282c2d90a944.png) 在本地生活服务领域,大模型技术落地正遭遇 "三重困境":通用能力与领域需求难以适配,复杂场景下服务可靠性与个性化无法兼顾,高昂的数据成本与漫长的训练周期进一步增加了开发难度。更关键的是,行业内缺乏可复用的业务适配框架与真实场景优化方案,导致技术落地效率较低。 如何打破僵局,实现 "体验与效率" 的极致平衡?成为了行业共同面...
OpenAgents
OpenAgents 发表了博客
我们对于 2022 年印象如此深刻,或许正是因为那一年的11月,ChatGPT 问世,让全世界看到了大语言模型(LLM)的潜力。 然而,很少有人知道,那年 8 月,当公众的注意力还被即将到来的 ChatGPT 所牵引时,AWS 内部已经诞生了首个基于 LLM 的智能体系统 Dialog2API。它绕过了传统的多智能体强化学习(MARL)框架,尝试让智能体通过自然语言进行理解与协作。 主导这一前瞻性探索的,正是Raphael Shu,彼时他正在 Amazon Bedrock Age...
RWKV元始智能
RWKV元始智能 发表了博客
欢迎大家收看《RWKV 社区最新动态》,本期内容收录了 RWKV 社区 2025 年 10 月的最新动态。 10 月动态省流版(TL;DR) ---------------- 1. RWKV 模型新闻动态 * RWKV7-G0a3 7.2B 发布 * RWKV8 ROSA 机制公布 2. RWKV 学术研究动态 * WKV-sharing embraced random shuffle RWKV high-order modeling for pan-sharpening(基于 RWKV 的图像全色锐化,发表于 **CCF A** 类会议 **NeurIPS 2025**) * RWKV3D: An RWKV-Based Model ...
美团技术团队
美团技术团队 发表了博客
由美团 LongCat 团队研发的 **VitaBench**(Versatile Interactive Tasks Benchmark)正式发布,这是当前高度贴近真实生活场景所面临复杂问题的大模型智能体评测基准。 ![](https://oscimg.oschina.net/oscnet//aeab524229d98e29c0f0f5cdce9c76af.jpg) VitaBench 以**外卖点餐、餐厅就餐、旅游出行**三大高频真实生活场景为典型载体,构建了包含 66 个工具的交互式评测环境,并进行了跨场景的综合任务设计,例如要求 agent 在一...
oschina
oschina 发表了资讯
11 月 2 日,为期两天的全球开源技术峰会 GOTC 2025 于北京圆满落幕。本届峰会由开源中国主办,以开源与人工智能的深度融合为核心主线,汇聚了全球顶尖专家、行业领袖与数千名开发者,共同描绘了一幅由开源驱动的 AI 未来蓝图。
没有更多内容
加载失败,请刷新页面
点击加载更多
加载中
下一页