跳到正文

#现象/趋势

今日 4 条
今天10月2日周五
  1. AI Snake Oil22

    AI 安全运动该走大帐篷还是小帐篷路线?

    AI 安全讨论长期被两种叙事占据:要么存在性风险真实且迫近,要么相关警告是虚伪的炒作或监管俘获。文章提出被忽视的第三种可能——警告是真诚的但判断有误,并主张 AI 是既有系统性风险的放大器,而非独立的对齐问题。作者以疫情防范投入不足和网络安全缺乏系统性风险建模为例,指出决策者对社会抵御 AI 风险的投资严重不足。

10月1日周四
  1. One Useful Thing60

    Ethan Mollick 反思智能体管理:从单点到群体自组织

    Ethan Mollick 在 One Useful Thing 撰文承认自己此前对智能体管理的判断有误,认为让智能体协同工作并不需要像管理公司那样精心设计。他提到 OpenAI 用数千个智能体组成的 swarm 在 88 小时内处理 Navier-Stokes 问题,其间传递约 270 万条消息;他本人用 Codex 时,简单描述三个团队角色后模型自行扩展出十三个智能体。

9月29日周二
9月28日周一
9月23日周三
9月22日周二
  1. MIT Technology Review · AI48

    别被这个夏天的 AI 炒作骗了

    针对今夏一系列 AI 炒作事件,DAIR 执行总监 Timnit Gebru 指出,Anthropic 宣称 Claude Mythos 找漏洞能力超多数安全专家、OpenAI 与 Hugging Face 遭黑客攻击、以及两家公司相继宣称数学突破,经专家审视后均与宣传不符。她认为"超级智能"叙事源于超人类主义等意识形态,而非扎实的科学工程实践,并呼吁政策制定者咨询独立专家、不要依赖新闻稿。

9月21日周一
  1. Simon Willison62

    voxium 描述大公司全员用 Claude Code 生成代码的现状

    Simon Willison 引用 voxium 的一段描述:作者入职一家大公司半个月,发现规格、代码、测试、PRD、工单及其处理、报告等全部由 Claude Code 生成,团队里没人喜欢这样,但被要求尽可能多地产出。高层多次表示推代码不是瓶颈,那为什么还慢;人们每天工作 12 到 13 小时只是为了按回车,从 L1 到 L7 的工程师都在做同样的事,没人读任何东西。

9月19日周六
9月16日周三
8月31日周一
7月14日周二
7月7日周二
7月1日周三
6月11日周四
  1. AI Snake Oil62

    为什么 AI 没有、也不会取代软件工程师

    AI Snake Oil 作者 Arvind Narayanan 撰文认为,AI 尚未也不会取代软件工程师。文章指出多起所谓 AI 裁员实为“AI washing”,纽约州 WARN 法案新增 AI 披露选项后首年 160 多家公司无一家勾选;并提出“决定-执行-交付”三明治模型,AI 只压缩了中间的执行层,而决定做什么与对交付负责这两端难以自动化。

5月27日周三
  1. One Useful Thing38

    选择保持人类:AI 写作与学习中的认知投降风险

    沃顿商学院等团队的两项研究显示,土耳其约千名高中生用 ChatGPT 做数学作业成绩更好,但考试时反而不如无 AI 的同学;而台北十所高中近千名学生在五个月 Python 课程中使用 AI 个性化出题,期末无 AI 考试高出 0.15 个标准差,约相当于 6 至 9 个月额外学习。Gemini、ChatGPT、Claude 均已提供引导式学习模式,但入口不直观,且无法阻止想作弊的人。

5月23日周六