V2EX = way to explore
V2EX 是一个关于分享和探索的地方
Sign Up Now
For Existing Member  Sign In
V2EX  ›  leihaibo1992  ›  全部回复第 1 页 / 共 5 页
回复总数  85
1  2  3  4  5  
我是自己做的 harness, 我是觉得模型必然会有犯错的时候,所以 harness 层一定要有兜底的能力,上面有人提到的删除一定要审批也是不符合人性的,我的解决方案是 agent 执行的 rm 指令一律被替换为进回收站,你总有机会从回收站找回你的文件。

https://v2ex.com/t/1232728
@jujusharp 好吧,确实是我考虑不周
@jujusharp 它的架构,它的特性聊的人已经太多了,不差我这一个。
“一切都是 xxx ,太叼啦, agent 执行 trace 真牛逼啊,agent 预设太新颖啦, 100%缓存利用率太震撼啦,速度真快呀,眼睛都看不清了” 我听的耳朵都起茧了
@nevin47 论文比代码还长
@ndxxx 看这段描述,我只能得出他们的模型拉了这个结论
@sentinelK 确实,一个产品的号召力足够大时,生态能够快速繁荣起来。不过话说回来,openclaw 刚出来时也是如日中天,现在不也一地鸡毛。现在趁热度,捧臭脚的太多了,过一段时间再看看。
@germain 另外,我是觉得社交软件的粘性和工具软件的粘性天壤之别,没啥可比性
@germain 哥,咱能分享下实际体验和真实看法吗,我挺想知道的,顺便混点铜币
@ATKLLL 顺便脑科也挂个号,免得跑两趟
@ATKLLL 看下眼科
8 月 13 日
回复了 qemu32 创建的主题 生活 感觉自己被这个社会判了死刑。
楼上说的对,一直待在家不是个事,出去干点体力活对身心有好处
8 月 13 日
回复了 kpprotector 创建的主题 程序员 大家常用的模型-Agent 组合是什么?
我自己做的 octo-agent ,加 deepseek-v4-flash 和 qwen3.7-plus
@freemoon 😄😄,没想那么多
@getadoggie #12 感谢你反馈,可以帮忙提 issue 吗,另外,可以加群交流
@techphoebe LLM 都做过严格的对齐训练,它不会恶意去破坏你的系统,但是它毕竟是个概率模型,所以它会犯傻。我们要做的就是在它犯傻的时候帮它一把,这就足够解决 99%的问题了。
@passive 哈哈,一下就被你找到了,是的,这个办法可以。Octo 只能防 agent 犯傻,但防不住用户自己使坏。
肯定有人会说,那么多大厂都下场做了,个人做这个没有意义,我就说两点:
1. 我不认为大厂做的就比我好,这是个品味问题,很难调和
2. 自己开发的 agent ,相加什么功能就加,不用求人。比如我现在主用 deepseek-v4-flash ,我想给它加个识图功能,我自己立刻就能做。

除了这两点,自己动手从零做一个 agent, 这件事本身就是意义
来个测试码我试试
8 月 4 日
回复了 programApe 创建的主题 职场话题 怎么转变程序员思维?
@zhangxiaoming 太他妈对了
我觉得没必要迷信大厂,每个人都可以开发适合自己的 agent, agent 没啥门槛,本质是工程问题和品位问题,论工程能力,我不觉得自己比谁差,论品位,只有自己才造成来的东西才符合自己的品位
https://github.com/open-octo/octo-agent
1  2  3  4  5  
About   ·   Help   ·   Advertise   ·   Blog   ·   API   ·   FAQ   ·   Privacy   ·   Solana   ·   2886 Online   Highest 6679   ·     Select Language
创意工作者们的社区
World is powered by solitude
VERSION: 3.9.8.5 · 22ms · UTC 14:15 · PVG 22:15 · LAX 07:15 · JFK 10:15
♥ Do have faith in what you're doing.