• 首页
  • 消息
  • 我的主页
    • 团队地图
    • 职位列表
    • 报刊亭
    • 我的
立即登录
设置
隐私政策用户条款营业执照人力资源服务许可证浙B2-20260388浙ICP备2024101243号浙公网安备33011002018106号© 2024-2026 Bonjour! 数字名片. All rights reserved.
社区找工
消息我
☕ 可约 Coffee Chat

Jeremy Xu

AI Startup 产品合伙人 Ex:字节策略/头部SaaS AI产品负责人 喜欢思考ai产品与商业哲学,以及推荐算法不喜欢的内容。 喜欢在即刻输出,感兴趣的欢迎关注

  • 📍 中国·北京市·海淀区
  • 🧙 产品经理
  • 他
58关注51被关注51互相关注
Jeremy Xu⚒️ 创造、思考,或一切
如果语音交互是AI 迈向全民应用的标志,那么新交互范式的内容终端,是否会发生变化? web 2.0 时代:推荐是引擎,信息流是载体,滑动手势是触发器,推进了互联网全民应用化。 人与人的连接开始依赖于推荐系统做内容分发,替代了主动搜索这一交互形态。 而交互形态的改变催生了从 操作键盘控制屏幕 向 滑动手势 的范式革新。 此时信息流成为了载体,手机成为了新一代智能终端。 本质上,手是大脑的工具,键盘和鼠标是手的工具。而滑动手势更贴近于用户的自然行为,而主动性更强的推荐系统,更接近大脑处理信息的低耗能动机。 而在 AI 时代,agent让语音交互更强大,因为嘴同样是大脑的直接工具 但似乎我们还需要依赖手机的终端屏幕,承载内容。因为我们难以通过抽象的语言来处理所有复杂问题。 因为认知科学上,人的短时记忆只有6-9个字符,过程中,大脑还要将注意力分配给思考过程。 所以一个完整的屏幕 实际上是缓存了我们的所需要的信息,并且把部分信息图像化,辅助用户认知外界信息。 在我们没有智能手机和电脑时,我们是用笔记本和白板来记录缓存信息的。 但是现在很多智能硬件并不能完整承载这一过程, 因为缺少了信息传输过程中的辅助载体。
Jeremy Xu⚒️ 创造、思考,或一切
企业上下文中,有个隐性知识经常被忽略,叫【组织上下文】,核心关注人在组织中的动机和行为。 这个很好理解,很多互联网产品 明知道数据和接口打通,组织合并,产品就能更上一个台阶。但组织内部的博弈 导致计划不能成型。 再比如企业经营层面的决策方向,会受到人的角色和立场观念影响,对业务的解释自然会面向自己有利的角度。 所以很多的企业问题 是由于组织局部的理性,带来组织全局非理性,这些方面 ai 短期是不容易解决的,因为ai容易理解事,但是不容易搞定人。
Jeremy Xu⚒️ 创造、思考,或一切
我觉得现在的 部分ai应用和模型 低价逻辑,如果当做是一种投资,显然不make sense。因为面向供给侧的生产力要素,规模和网络效应带来的复利效应并不明显,切换成本几乎为0,低价竞争最后大家都赚不到钱。 我觉得造成这个现象的原因,可能是因为市场认知和技术成熟度还不够,现在一个sota模型每个月带来的开销基本接近一个实习生。 但大多数的用户的认知和信任成本,还没有感知到sota是可以替代或超越一个人力的作用。所以从这个角度看,低价会是跨不过去的过渡阶段。
Jeremy Xu⚒️ 创造、思考,或一切
键盘和鼠标是手的工具,而是手和嘴是大脑的工具。所以语音交互是更接近自然的交互形态。 但屏幕不会被取代,因为它同样是大脑的工具。 因为人的短时记忆容量只有6-8个字节,阅读时还会会伴随思考耗能。 所以屏幕是一个记录外部信息的实体容器,在大脑传输带宽有限的情况下,承担了把信息先缓存起来的作用。 现实中的图文和长文本太多了,语音不太可能解决所有问题。
Jeremy Xu⚒️ 创造、思考,或一切
假如一个知识或职业社交平台,不被允许在个人主页写职位简介会怎样?人们对内容质量的判断会变强还是减弱? 现在传统的内容社交平台,本质上掺杂了过多物理世界外显的身份。导致一个社交平台上,一个写xx大厂xx高管和一个什么都不写的人,在社交媒体上同一个内容,获得的社交资本远不一样。 某个大佬开个玩笑,评论区就很热闹。认真发内容的人无人问津,大家都在向上社交。低资本的人,对每个内容认真回复,高资本的人看都不看。 那么低资本的人为了获取注意力,只能写八卦,制造情绪,因为让人动脑思考的东西本身就反人性,大佬和普通人都一样。 那么随着平台的发展,高质量内容会消失。不过平台获得了流量,有了更多商业化的机会。优质内容会越来越少。 那如果我们人为不将外显的身份带入平台,而是让具备通识学科,逻辑,并让ai来理解和评价内容呢? 如果一个新的平台,能否会给一个没有显赫履历的普通人/用户,一个好的激励方式,让他们被看见呢?这是否就会成为打破主流平台垄断的机会呢?
Jeremy Xu⚒️ 创造、思考,或一切
提炼Codex 负责人Tibo 在播客访谈中的几个关键洞察: 1. 对Skill 和 Memory 等工程方法研究只是agent的过渡形态,未来的agent 应该自动深刻理解你的目标,你的团队以及你的工作环境,而且是跨场景跨平台的理解。 2. 语音输入功能的渗透速度很快,说明语音交互可能的是未来人与agent交互的核心范式。 3. 个人电脑是为人类的打字速度,思考速度而设计的,但模型未来可以同时处理上百个应用,以及执行任务,那么个人电脑的cpu,网络将成为瓶颈,agent走向云端是必然趋势。 4. 模型的对齐和安全越来越重要。模型的递归自进化,正在越来越多的应用到自家的模型研发中,人类的对齐和审查已经逐渐跟不上ai的研发速度,治理漏洞和安全会是接下来的重要命题。
Jeremy Xu💨 NowBuilding
长程任务模式下,可供用户消费的“最佳内容载体”或许是 一种类“周报”的任务看板? 而当下agent推理过程的展现形态也可能不是长程任务下的最优解? 当任务执行变得越来越长,用户进入界面的频次更少,且动机更倾向于内容消费,更少的完成功能操作。 而内容消费的动机更多是在做过程监控与干预。 那么适配于此类用户动机的应该是一种画布,用于观测多个任务的执行状况。 因此,我觉得 agent的推理和执行过程 应该是一种摘要并嵌入到卡片中,而非信息流或是当前某一节点的动作状态。 因为我们每次偶尔进入界面的时候,看到的是任务的切片快照,但需要建立跑了三天的任务,究竟跑了什么,结果是什么。 物理世界的组织关系下,管理者与下属是通过周报来记录过程,通过消费周报内容代替下属的工作行为切片。 那么我们与agent交互时沟通的载体,是否也会以同样的形式出现? 也许不同的是,当用户每次进入的时候,每个看板会自动根据任务情况渲染完整执行进度情况?
Jeremy Xu⚒️ 创造、思考,或一切
ai 办公产品宣传的“让打工人提前下班”,其实不符合常理,除非打工人变成了“灵活用工人员”。 假如你在公司要待满 10 小时,即使你用 ai 产品提效了,你不会主动和老板说:我干完了再加一点活,而是假装表演工作直到老板发现,或安排别的事做,那提效的意义不大。提前下班还还会被老板认为不努力工作。 那如果你现在是灵活用工人员了,工作目标就是交付当前这份工作,那提效动机就很强烈了。因为你会想着赶紧交付这份工作,同时再挣下一份钱。即使没人找,剩下的时间就可以光明正大的休息了。 那么假如 ai 办公产品需要付费,你很容易计算:我付了这笔钱能多获得多少收入。 所以从另一个角度来说,灵活用工的规模变大,会促进 ai 办公产品的付费。 只不过前提是:这些人不是”被灵活用工“,而是真的在工作。
Jeremy Xu⚒️ 创造、思考,或一切
所谓产品体验taste,我觉得并不是依赖个人主观的玄学。而是 存在一个最优解,让大部分用户看到后都觉得产品体验好,它有时依赖于的确直觉,有时候反而是保留用户旧体验。 比如主流的文档工具通过大量的用户访谈和实践。 所以当AI输出大段文本时,我们一直觉得展现形态不够好。所以我们提出了假设,当内容过长时,用户的视觉最优解已经被主流文档产品定义过,于是研究了大量的文档结构布局,精细到了每个字色字重,标题,段落的间距。模拟和设计自己产品中多行文本的形态,结果整体效果提升一大块。 这不是说要去抄袭,锤子手机当年的音乐播放器app上面画的是一个唱片机,并会随着音乐的播放进行物理仿真,这本就是一个先入为主的最佳实践。 综上,产品taste不来自于拍脑袋的创新
Jeremy Xu⚒️ 创造、思考,或一切
我觉得判断AI是否真的有主动意识的一个标志是:会不会感知环境的变化后,输出的稳定性会受到影响,比如: 人在被老板骂和夸赞以后的区别; 上真实考场和模拟考试的区别; 平时跑步,和后面有一只要吃你的狮子的区别; 这看起来是一种负向行为,但人的本能是基于环境影响情绪进而调整注意力,推动了更多潜能的激发与创造。,AI同理。

Jeremy Xu