Home
Language
English
Türkçe
Bahasa Indonesia
About
Privacy Policy
Terms of Service
Pricing
Sign In
Download All
Share
Jerry Fang
@Jerry_fsy
智能驾驶5年 | DevOps高级工程师 已落地2个生产级 AI Agent(持续迭代) 公开学习 & 分享 Agent / Inference / Infra
Shanghai
Joined December 2023
201
Following
172
Followers
214
Posts
Pinned Tweet
Jerry Fang
@Jerry_fsy
4 days ago
做AI Agent已经半年了,从最初的懵懂到现在可以交付生产级的Agent。在这个过程中,对Agent的理解逐渐加深。 现在回看,对Agent理解的一个转折点是在微信公众号上看了不少“三元同学”写的文章,逐渐对上下文等概念有了清晰的理解。后来,买了她在Sitor上面的课程,系统学习了Agent。在这些基础打牢后,现在吸收理解包括AI Inference,Agent评测这些知识就更容易了,也是体会一把知识的飞轮。 如果大家对AI Agent感兴趣,可以在公众号上关注“三元同学”,下面附一些我感觉不错的文章: 1.https://t.co/lyQvMMSkCO 2. https://t.co/mbDgtYDhMQ 3. https://t.co/UJDZD9VPdr 对AI感兴趣的朋友可以多交流交流。
See More
Jerry Fang
@Jerry_fsy
19 minutes ago
@yifanxu_ephai
@xudaoai
今天用DimAgent + DeepSeek V4.1分析,感觉效果不错的,速度快,效果也还可以
Jerry Fang
@Jerry_fsy
about 1 hour ago
@imwritingbugs
@vxkbo
GPT有10x了吗
Jerry Fang
@Jerry_fsy
about 1 hour ago
@yifanxu_ephai
Agent系统追溯Agent之前回答的和专家认为的正确答案之间的偏差,想追溯的话,也需要一个这样的workspace。
Jerry Fang
@Jerry_fsy
about 2 hours ago
今天还发现你说的workspace非常重要的两个原因,1.在LLM-as-Judge做评测的时候,eval可以看到workspace的环境,可以减少一些eval认为被评测的agent看着瞎猜,实际是根据workspace做的合理推断的情况;2.在https://t.co/nfNRNyndkH 中提到Meta推荐的Agent自我进化,涉及到专家纠正完错误后,Agent追溯原因。
美研芒格君
@Kay2289123
9 days ago
最近有很多关于 RSI(Recursive Self-Improvement,递归自我改进)的讨论,也让大家开始担心,AI 会不会不断升级自己,最后超出人的控制 我周末集中看了一批 RSI 2026 年的论文和公开项目,想把几个问题讲清楚:现在到底发展到了哪一步,业界 popular 的讨论是什么,以及我们普通人能怎么用。最后我会给大家一个可以用来直接给 AI 实现初步 RSI 的 Prompt 这次按方向来聊,论文和项目放在对应段落,大家可以收藏下来慢慢看 1/ 先分清楚,大家说的“自我改进”,有三件不同的事 第一件,AI 根据反馈,把当前任务再做一遍。 第二件,它把有效经验、工具或工作流程留下来,下一次任务也能用上。 第三件,它进一步改进“下一轮怎么学习、怎么做实验、怎么选方案”这套方法。 越往后,接手的研发决策越多。9 月 10 日发表的的《The Last AI Built by Humans》把这些自主范围拆成了执行、策略、经验获取、环境适应和元改进几层,适合当阅读地图 https://t.co/aOWmBcFure 2/ 今年一条很密集方向研究线,是让 AI 改自己的 Harness Harness 可以理解为模型周围那套实际干活的系统:读哪些文件、给模型看什么上下文、怎么调用工具、失败后怎么恢复、什么时候算完成。 今年 3 月的 Meta-Harness,6 月首发、8 月更新的 Self-Harness,以及 7 月底的 DarwinX (Salesforce),都在研究怎样把这套系统交给自动实验来优化 3/ 另一条已经出现企业内部应用的路线,是把人的纠错变成持久经验 今年 1 月的 MemRL,把经验和“这条经验实际有多管用”一起保存。下次先找相关经验,再根据使用效果挑选,而不只是找文字最相似的记录 https://t.co/kJ8zPuFy4G 到了 9 月 2 日,Meta 公开了一个更贴近日常工作的内部案例:专家纠正 Agent 后,系统会判断错误来自知识缺口还是处理流程,把纠错转成文件修改,重放原来的问题、跑回归测试,再交专家审核。 通过后,这次失败还会进入以后的测试集。这是 Meta 在特定专业领域的内部实践 https://t.co/YRgKSDa7So 对我们普通用户来说,这一条就很有用了, 人的一次纠错,开始有机会变成后续任务都能使用的改进 回到关键问题,我觉得今年这些工作的共同价值,是让我们开始认真维护一个会积累经验的系统。所以我们现在可以怎么用? 篇幅有限,我把一个我们都能用上的效仿 RSI 的基础 prompt 放在评论区里, 我最近也在观察,每次任务留下什么,每次纠错改到哪里,下一次能否因此做得更好,这些都已经可以在自己的工作里动手验证了。 为了防杠,我得说明一下:这三个方向只是工程向的,硅谷大佬们担心的更多是研究向的内容。 这些内容比较硬核,研究向 RSI我会在后面帖子里单独去聊
See More
Jerry Fang
@Jerry_fsy
about 15 hours ago
@tylerzhu465061
请问大佬之前就是做供应链相关的吗
Jerry Fang
@Jerry_fsy
about 15 hours ago
@rwayne
降智有点严重,但是今天发现把自动压缩改到160K,好像智力正常点,大家可以试试
Jerry Fang
@Jerry_fsy
about 16 hours ago
@chasen_liao
@coder_left
打算这周试试,部署开源模型试一试
Jerry Fang
@Jerry_fsy
about 16 hours ago
@klarkxy01
@chasen_liao
理解理解
Jerry Fang
@Jerry_fsy
about 16 hours ago
@chasen_liao
@chuhaiqu
@WeiYipei
感觉软件出海才是王道,toB比toC 好
Jerry Fang
@Jerry_fsy
about 16 hours ago
@klarkxy01
@chasen_liao
是不是等效于用新开的线程去总结旧的线程?
Jerry Fang
@Jerry_fsy
about 23 hours ago
@yifanxu_ephai
加油,一起成长
Jerry Fang
@Jerry_fsy
about 24 hours ago
@chasen_liao
我也是在学习和构建吧ing
Jerry Fang
@Jerry_fsy
about 24 hours ago
今天刚和
@chasen_liao
大佬讨论用jev做agent评测可能不错:便宜,快,效果稳定
Harrison Chase
@hwchase17
1 day ago
"jev as a judge" cheap and fast semantic verifiers! great for evals - especially online evals where you want to grade LOTS of traces
Jerry Fang
@Jerry_fsy
1 day ago
@tylerzhu465061
加强GEO,让ChatGPT更多推荐吧
Jerry Fang
@Jerry_fsy
1 day ago
@GoSailGlobal
打算把这类模型试试用于agent评测中的LLM-as-Judge,听说评价稳定性比较高
Jerry Fang
@Jerry_fsy
1 day ago
@chasen_liao
@grok
貌似可以
Jerry Fang
@Jerry_fsy
1 day ago
@chasen_liao
@grok
Jev适合做agent评测的LLM-as-Judge吗?
Jerry Fang
@Jerry_fsy
1 day ago
@chasen_liao
"分类、打分、筛选、检查回复是否答题,这些任务交给 Jev。",想问一下,Jev适合做agent评测的LLM-as-Judge吗?
Jerry Fang
@Jerry_fsy
1 day ago
我也要增强自己的推文组织能力。 年少不知语言的重要性,现在补上
Marc Lou
@marclou
1 day ago
@martindonadieu
I never said you're an idiot! But I did say you could get more attention if you structured your thoughts better. And I don't think the poll answers will get you acurate data :)
Jerry_fsy
retweeted
雨夹雪❄️
@mizorewww
2 days ago
介绍比Jev快50倍,在你设备上跑的laya-mlx! 只在你的设备上占用最高1G内存 Laya是一个开源的类似于Jev的,基于文本输出概率的分类系统 我将其移植到MLX,并且做了一些性能优化! 视频中就是这个模型在我的本地M3Max上玩贪吃蛇 这个模型能够以每秒决策60次的速度玩贪吃蛇! https://t.co/31KGUiNunb
mizorewww's tweet video.
Last Seen Users on Sotwe
HOMINATION
Murat yozgatli
Seen from
Turkey
PORN HD NO SENSOR
Seen from
Singapore
Brian Angel Judson
Seen from
United States
Dorian
Seen from
Germany
น้อนFolkควย56 เงี่ยนฟุดดๆ
Seen from
Thailand
M&S SexStory
Thỏ_vắt_sữa
Seen from
Vietnam
Manuk Enak
Seen from
Singapore
gokhantest
Seen from
India
Trends for you
1
Giants
Under 10K tweets
2
Jameis
Under 10K tweets
3
Davante Adams
Under 10K tweets
4
Trump TV
Under 10K tweets
5
#WWERaw
Under 10K tweets
6
Mamdani
Under 10K tweets
7
Nolan Wells
Under 10K tweets
8
Clavicular
Under 10K tweets
9
#JacksonWangXRocNation
Under 10K tweets
10
Skattebo
Under 10K tweets
Most Popular Users
1
Elon Musk
@elonmusk
241.7M followers
2
Barack Obama
@barackobama
119M followers
3
Cristiano Ronaldo
@cristiano
114.3M followers
4
Donald J. Trump
@realdonaldtrump
111.9M followers
5
Narendra Modi
@narendramodi
107.2M followers
6
Rihanna
@rihanna
98.7M followers
7
NASA
@nasa
92.4M followers
8
Justin Bieber
@justinbieber
91.8M followers
9
KATY PERRY
@katyperry
90M followers
10
Taylor Swift
@taylorswift13
83.9M followers
11
Lady Gaga
@ladygaga
75.4M followers
12
Virat Kohli
@imvkohli
73.3M followers
13
Kim Kardashian
@kimkardashian
70.9M followers
14
YouTube
@youtube
68.8M followers
15
Neymar Jr
@neymarjr
66.3M followers
16
Bill Gates
@billgates
65.1M followers
17
Selena Gomez
@selenagomez
63M followers
18
The Ellen Show
@theellenshow
62.3M followers
19
CNN
@cnn
61.8M followers
20
X
@x
60.7M followers
Olivia
Online
✨
⭐
💫