向阳乔木

@vista8

喜欢摇滚乐、爱钓鱼的PM


  1. #1

    这个名叫Bento的开源HTML PPT项目不错啊,动效很炫酷。 只用一个HTML文件实现整个PPT的核心: 所有文本都能编辑+全屏播放PPT+多人协作等。 最棒的地方:文档都是明文JSON,非常适合交给AI来修改迭代。 开源地址见评论区,视频是PPT动效演示

  2. #2

    每天学一个硬核AI知识点:Multi-Head Attention(多头注意力)

  3. #3

    如何写好文章,是个需要持续练习精进的事: 1. 一篇文章,只解决一个问题。 2. 开头先给结果、冲突或问题,背景往后放。 3. 每段只推进一个意思,观点后跟例子。 4. 把抽象词换成具体的人、动作、数字和场景。 5. 删掉不影响理解的词句,全文朗读修改。

  4. #4

    第三次GEO公开课预告: 1. 公开课信息 主题:GEO信源偏好与策略 时间:7月25日周六,晚上8点-晚上10点 微信参会,视频号:“通往AGI之路” 飞书参会,会议地址:https://t.co/sbvAdm4W2y 2. 公开课大纲 1、为什么要搞懂信源,以及信源资源为什么那么重要 2、信源偏好差异是如何产生的

  5. #5

    有朋友今天参加飞书的活动吗? 感觉挺热闹。

  6. #6

    黄佬来 X 有点晚,六月份注册,今天发第一条帖。 账号是 @JensenHuang

  7. #7

    哈哈哈,洞悉人性,转好友杨攀发的图。

  8. #8

    Codex live完全操控电脑,陪着一起看YouTube视频。 能看见界面,持续实时语音对话,有点酷啊。 开启方法: 1. 升级Codex到最新版,打开后自动有引导。 2. 或打开设置->语音-Voice Chat , 设置快键键,打开Screen context

  9. #9

    真正的 AI Copilot,哈哈哈。

  10. #10

    美国很多AI创业公司呼吁不能禁中国模型。 禁令唯一能保护的是美国前沿模型的价格。 文章见评论

  11. #11

    一个大模型的说法不一定可信,需要其他模型帮忙评估。 安装这个Skill,在Codex中调用Grok和Kimi。 npx skills add joeseesun/qiaomu-model-cli 开源地址见评论,可以增加更多模型

  12. #12

    每天学一个AI硬核知识:Tokenizer 看完这个,就知道为啥大模型数不对数。

  13. #13

    如果你用Hyperframe、remotion、manim生成的视频不好。 建议换成Kimi K3或Claude Fable5模型,因为这些库都依赖 HTML 生成的页面。 当下,大模型前端审美前两名就是这两个模型。

  14. #14

    今天有朋友问,有没有稳定的下载Youtube视频的Skill? 其实都基于yt-dlp,问题是这个库要跟 Youtube对抗,得经常更新,所以写了一个Skill解决这个问题。 支持Youtube short和视频多种分辨率下载。 如果想支持搜索查看频道,可申请youtube API加进去。 安装指令:npx skills add

  15. #15

    经常能发现一些优秀的视频号内容,但下载很麻烦。 直到发现了一个开源库和工具 https://t.co/cq2vYNBA5n 顺手用这个库写了一个视频号下载Skill 不需要安装任何客户端,只需要说:“帮我下载这个视频号:【URL,URL获取方法->分享->复制链接】” Skill安装地址: npx skills add

  16. #16

    每天学一个AI关键词:embedding 词向量是大模型的基础。 国王-男人+女人 = 王后

  17. #17

    感觉百度的技术底子还是很硬的。 最近这个Unlimited OCR,竟然连杨立昆(Yann LeCun)都关注到了! Unlimited OCR 提出了 Reference Sliding Window Attention (R-SWA)机制,不用传统的“逐页解析+结果拼接”方法,通过借鉴人类阅读和抄长文档的工作方式,把解码阶段 KV Cache

  18. #18

    把pocket3充满电,准备去钓鱼。

  19. #19

    MoE 是 Mixture of Experts(中文意为混合专家模型)的简写。 这是一种特殊的神经网络架构,现在最好的模型基本都使用了这种构架。 比如Fable5 ,比如GPT 5.6 sol等,一起学习什么是MoE。