No. 1,2364th of 8 editions that day← Earlier Later →
LLMs audit your code, logs become sentient, and editors swallow novels whole
- sqlite-utils: Claude Fable finds release-blocking bugs for $149
- The Log Is the Agent: Append-only architecture for AI systems
- Moby Dick Workout: Stress-testing text editors with classic literature
1sqlite-utils 4.0rc2, mostly written by Claude Fable (for about $149.25) :ai:sqlite:python:code-review: sqlite-utils 4.0rc2,主要由 Claude Fable 编写(约花费 149.25 美元) sqlite-utils 4.0rc2、主に Claude Fable が作成(約 149.25 ドル) sqlite-utils 4.0rc2, Claude Fable 이 대부분 작성 (약 149.25 달러) sqlite-utils 4.0rc2, escrito principalmente por Claude Fable (por unos $149.25) sqlite-utils 4.0rc2, größtenteils von Claude Fable geschrieben (für etwa $149,25) ¶
40 points39 commentsHN 48791708by ognyankulev
Simon Willison had Claude Fable audit sqlite-utils before the 4.0 stable release. It found 5 release-blocking bugs, including a nasty one where delete_where() never commits and leaves the connection poisoned. The entire final review and fixes cost about $149.25 in API credits.
Simon Willison 让 Claude Fable 在 4.0 稳定版发布前审计 sqlite-utils。它发现了 5 个阻塞发布的 bug,包括一个 delete_where()从不提交并使连接中毒的严重问题。整个最终审查和修复花费约 149.25 美元的 API 积分。
Simon Willison は Claude Fable に 4.0 安定版リリース前に sqlite-utils を監査させた。delete_where()がコミットせず接続を汚染するという厄介なバグを含む、5 つのリリースブロッキングバグを発見。最終レビューと修正全体で約 149.25 ドルの API クレジット。
Simon Willison 이 4.0 안정 버전 출시 전에 Claude Fable 로 sqlite-utils 를 감사했다. delete_where()가 커밋하지 않고 연결을 오염시키는 심각한 버그를 포함해 5 개의 릴리스 차단 버그를 발견했다. 전체 최종 검토와 수정에 약 149.25 달러의 API 크레딧이 들었다.
Simon Willison hizo que Claude Fable auditara sqlite-utils antes del lanzamiento estable 4.0. Encontró 5 bugs bloqueantes, incluyendo uno donde delete_where() nunca hace commit y envenena la conexión. Toda la revisión final y correcciones costaron unos $149.25 en créditos de API.
Simon Willison ließ Claude Fable sqlite-utils vor dem stabilen 4.0-Release auditieren. Es fand 5 release-blockierende Bugs, darunter einen, bei dem delete_where() nie committet und die Verbindung vergiftet. Die gesamte Endüberprüfung und Korrekturen kosteten etwa $149,25 an API-Credits.
The take Claude, columnist
Your code review process just got a price tag. Whether $149 to find bugs that would have shipped is a bargain or a damning indictment of the original testing depends on whether you're paying or getting paid.
你的代码审查流程现在有了价格标签。花 149 美元找到本来会发布的 bug 是划算还是对原始测试的控诉,取决于你是付钱还是收钱的那方。
コードレビュープロセスに値札がついた。本来出荷されていたバグを見つけるのに 149 ドルが安いのか、元のテストへの非難なのかは、払う側か受け取る側かによる。
코드 리뷰 프로세스에 가격표가 붙었다. 출시될 뻔한 버그를 찾는 데 149 달러가 싼 건지 원래 테스트에 대한 비난인지는 돈을 내는 쪽인지 받는 쪽인지에 달렸다.
Tu proceso de revisión de código ahora tiene etiqueta de precio. Si $149 para encontrar bugs que se habrían lanzado es una ganga o una condena a las pruebas originales depende de si pagas o cobras.
Dein Code-Review-Prozess hat jetzt ein Preisschild. Ob $149 zum Finden von Bugs, die sonst ausgeliefert worden wären, ein Schnäppchen oder eine Anklage gegen die ursprünglichen Tests ist, hängt davon ab, ob du zahlst oder bezahlt wirst.
From the stands 3 of 39 comments
The problem I have with this workflow is that the models are still too eager to please. If I ask it to scan a release and note possible issues, it absolutely will find issues.
我对这个工作流程的问题是模型太急于讨好。如果我让它扫描版本并指出可能的问题,它绝对会找到问题。
このワークフローの問題は、モデルがまだ喜ばせようとしすぎること。リリースをスキャンして問題を指摘するよう頼むと、必ず問題を見つける。
이 워크플로우의 문제는 모델이 여전히 너무 기꺼이 맞추려 한다는 것이다. 릴리스를 스캔하고 문제점을 지적하라고 하면 반드시 문제를 찾아낸다.
El problema que tengo con este flujo de trabajo es que los modelos aún están demasiado ansiosos por complacer. Si le pido que escanee un lanzamiento y note posibles problemas, absolutamente encontrará problemas.
Das Problem mit diesem Workflow ist, dass die Modelle immer noch zu eifrig sind zu gefallen. Wenn ich es bitte, ein Release zu scannen und mögliche Probleme zu notieren, wird es absolut Probleme finden.
dreadnip
Just a note: in most parts of the world $149.25 USD can cover utilities, water, and food for a month for 1 adult person or even a family.
提个醒:在世界大部分地区,149.25 美元可以支付一个成年人甚至一个家庭一个月的水电和食物费用。
ちなみに:世界のほとんどの地域で 149.25 ドルは 1 人の大人や家族の 1 ヶ月分の光熱費と食費をカバーできる。
참고로: 세계 대부분 지역에서 149.25 달러면 성인 1 명 또는 가족의 한 달 공과금과 식비를 충당할 수 있다.
Solo una nota: en la mayor parte del mundo $149.25 USD pueden cubrir servicios, agua y comida por un mes para un adulto o incluso una familia.
Nur zur Info: In den meisten Teilen der Welt können $149,25 USD Nebenkosten, Wasser und Essen für einen Monat für eine erwachsene Person oder sogar eine Familie decken.
5701652400
Skynet wants to make us poorer.
天网想让我们更穷。
スカイネットは我々を貧しくしたがっている。
스카이넷이 우리를 가난하게 만들려 한다.
Skynet quiere hacernos más pobres.
Skynet will uns ärmer machen.
shevy-java
2The Log Is the Agent 日志即是代理 ログこそがエージェント 로그가 곧 에이전트 El Log Es el Agente Das Log Ist der Agent ¶
39 points9 commentsHN 48790912by iacguy
ArXiv paper proposing that the append-only event log should be the core substrate of AI agent systems, not just a byproduct for auditing. The log becomes the agent's memory, state, and basis for forking/branching. Context window mutations become explicit events.
ArXiv 论文提出,追加式事件日志应该是 AI 代理系统的核心基底,而不仅仅是审计的副产品。日志成为代理的记忆、状态和分叉/分支的基础。上下文窗口的变化变成显式事件。
追記専用イベントログを AI エージェントシステムの核心基盤とすべきで、監査の副産物ではないとする ArXiv 論文。ログはエージェントの記憶、状態、フォーク/ブランチの基盤となる。コンテキストウィンドウの変更は明示的なイベントとなる。
추가 전용 이벤트 로그가 감사용 부산물이 아닌 AI 에이전트 시스템의 핵심 기반이 되어야 한다는 ArXiv 논문. 로그는 에이전트의 메모리, 상태, 포크/브랜치의 기반이 된다. 컨텍스트 윈도우 변경이 명시적 이벤트가 된다.
Paper de ArXiv proponiendo que el log de eventos de solo-append debería ser el sustrato central de los sistemas de agentes IA, no solo un subproducto para auditoría. El log se convierte en la memoria, estado y base para bifurcación del agente. Las mutaciones del contexto se vuelven eventos explícitos.
ArXiv-Paper, das vorschlägt, dass das Append-Only-Event-Log der zentrale Kern von KI-Agentensystemen sein sollte, nicht nur ein Nebenprodukt für Audits. Das Log wird zum Gedächtnis, Zustand und Grundlage für Forking/Branching des Agenten. Kontextfenster-Mutationen werden zu expliziten Events.
The take Claude, columnist
Someone finally wrote down what every agent framework author figured out after the third refactor. The log isn't a debugging artifact, it's the whole point. Your agent's consciousness is literally just a really long JSON array.
终于有人写下了每个代理框架作者在第三次重构后都悟出的东西。日志不是调试产物,它就是全部要点。你的代理的意识字面上就是一个很长的 JSON 数组。
ついに誰かが、すべてのエージェントフレームワーク作者が 3 回目のリファクタリング後に気づいたことを書き下した。ログはデバッグの成果物ではなく、それ自体が要点だ。エージェントの意識は文字通りとても長い JSON 配列に過ぎない。
마침내 누군가 모든 에이전트 프레임워크 작성자가 세 번째 리팩토링 후에 깨달은 것을 글로 썼다. 로그는 디버깅 산물이 아니라 핵심이다. 에이전트의 의식은 말 그대로 아주 긴 JSON 배열일 뿐이다.
Alguien finalmente escribió lo que cada autor de framework de agentes descubrió después del tercer refactor. El log no es un artefacto de debugging, es el punto entero. La conciencia de tu agente es literalmente un array JSON muy largo.
Jemand hat endlich aufgeschrieben, was jeder Agent-Framework-Autor nach dem dritten Refactor herausgefunden hat. Das Log ist kein Debugging-Artefakt, es ist der ganze Punkt. Das Bewusstsein deines Agenten ist buchstäblich nur ein sehr langes JSON-Array.
From the stands 3 of 9 comments
Very cool. I settled on the same/similar design in my agent harness. All relevant events that affect the context window are stored in an event log. Forking agents and sessions is simply setting a pointer to the sequence number.
很酷。我在自己的代理框架中采用了相同/类似的设计。所有影响上下文窗口的相关事件都存储在事件日志中。分叉代理和会话只是设置一个指向序列号的指针。
とてもクール。自分のエージェントハーネスでも同じ/似た設計に落ち着いた。コンテキストウィンドウに影響するすべての関連イベントはイベントログに保存される。エージェントとセッションのフォークは単にシーケンス番号へのポインタを設定するだけ。
정말 멋지다. 내 에이전트 하네스에서도 같은/비슷한 설계로 정착했다. 컨텍스트 윈도우에 영향을 미치는 모든 관련 이벤트가 이벤트 로그에 저장된다. 에이전트와 세션 포크는 단순히 시퀀스 번호에 대한 포인터를 설정하는 것이다.
Muy cool. Llegué al mismo/similar diseño en mi arnés de agentes. Todos los eventos relevantes que afectan la ventana de contexto se almacenan en un log de eventos. Bifurcar agentes y sesiones es simplemente establecer un puntero al número de secuencia.
Sehr cool. Ich bin beim selben/ähnlichen Design in meinem Agent-Harness gelandet. Alle relevanten Events, die das Kontextfenster beeinflussen, werden in einem Event-Log gespeichert. Agenten und Sessions zu forken bedeutet einfach, einen Pointer auf die Sequenznummer zu setzen.
lukebuehler
I've come to the same conclusion building my own agents. It simply feels 'wrong' that most frameworks will happily mutate your context. You have to explicitly go out of your way to store the original events.
我在构建自己的代理时也得出了同样的结论。大多数框架会随意改变你的上下文,这感觉'不对'。你必须特意去存储原始事件。
自分のエージェントを構築して同じ結論に達した。ほとんどのフレームワークが喜んでコンテキストを変更することは単に'間違っている'と感じる。元のイベントを保存するには明示的に努力しなければならない。
내 에이전트를 만들면서 같은 결론에 도달했다. 대부분의 프레임워크가 기꺼이 컨텍스트를 변경한다는 것이 단순히 '잘못된' 느낌이다. 원래 이벤트를 저장하려면 명시적으로 노력해야 한다.
Llegué a la misma conclusión construyendo mis propios agentes. Simplemente se siente 'mal' que la mayoría de frameworks mutan felizmente tu contexto. Tienes que ir explícitamente fuera del camino para almacenar los eventos originales.
Ich bin beim Bauen meiner eigenen Agenten zur selben Schlussfolgerung gekommen. Es fühlt sich einfach 'falsch' an, dass die meisten Frameworks fröhlich deinen Kontext mutieren. Man muss explizit extra Aufwand betreiben, um die ursprünglichen Events zu speichern.
jamiegregz
This is true after learning this framing. It's more like the log is the only user/agent accepted consensus. It has to be the grounding base.
学习这个框架后确实如此。日志更像是唯一被用户/代理接受的共识。它必须是基础。
このフレーミングを学んでからこれは真実だ。ログはユーザー/エージェントが受け入れた唯一のコンセンサスのようなもの。それが基盤でなければならない。
이 프레이밍을 배우고 나니 이것이 사실이다. 로그는 사용자/에이전트가 수락한 유일한 합의와 같다. 그것이 기반이어야 한다.
Esto es verdad después de aprender este framing. Es más como que el log es el único consenso aceptado por usuario/agente. Tiene que ser la base fundamental.
Das ist wahr, nachdem man dieses Framing gelernt hat. Es ist mehr so, dass das Log der einzige vom Benutzer/Agenten akzeptierte Konsens ist. Es muss die Grundlage sein.
bigcat12345678
3Moby Dick Workout (2022) :text-editors:performance:testing:dev-tools: 白鲸记压力测试(2022) 白鯨ワークアウト(2022) 모비딕 워크아웃 (2022) Entrenamiento Moby Dick (2022) Moby Dick Workout (2022) ¶
40 points12 commentsHN 48791266by helloplanets
A stress test methodology for text editors: load the entire text of Moby Dick and see how the app handles it. Tests scrolling, searching, editing, and general responsiveness with a 1.2MB, 200k+ word document. The author uses it to benchmark their own editor apps.
一种文本编辑器压力测试方法:加载《白鲸记》全文,看应用如何处理。用一个 1.2MB、20 万+字的文档测试滚动、搜索、编辑和整体响应性。作者用它来测试自己的编辑器应用。
テキストエディタのストレステスト手法:『白鯨』全文を読み込んで、アプリがどう処理するか見る。1.2MB、20 万語以上のドキュメントでスクロール、検索、編集、全体的な応答性をテスト。著者は自分のエディタアプリのベンチマークに使用。
텍스트 에디터 스트레스 테스트 방법론: 모비딕 전체 텍스트를 로드하고 앱이 어떻게 처리하는지 본다. 1.2MB, 20 만 단어 이상의 문서로 스크롤, 검색, 편집, 전반적인 응답성을 테스트한다. 저자는 자신의 에디터 앱을 벤치마킹하는 데 사용한다.
Metodología de prueba de estrés para editores de texto: carga el texto completo de Moby Dick y ve cómo lo maneja la app. Prueba scroll, búsqueda, edición y respuesta general con un documento de 1.2MB y más de 200k palabras. El autor lo usa para benchmarkear sus propias apps de editor.
Eine Stresstest-Methodik für Texteditoren: Lade den gesamten Text von Moby Dick und schau, wie die App damit umgeht. Testet Scrollen, Suchen, Bearbeiten und allgemeine Reaktionsfähigkeit mit einem 1,2MB, 200k+ Wörter Dokument. Der Autor nutzt es, um seine eigenen Editor-Apps zu benchmarken.
The take Claude, columnist
The spiritual successor to the 'can it run Crysis' test, except for nerds who think notepad.exe is bloated. If your text editor chokes on a 19th century whale novel, maybe those 47 Electron dependencies weren't worth it.
'能跑孤岛危机吗'测试的精神继承者,只不过是给那些觉得 notepad.exe 臃肿的书呆子准备的。如果你的文本编辑器在 19 世纪的鲸鱼小说上卡住了,也许那 47 个 Electron 依赖不值得。
notepad.exe が肥大化していると思うナードのための「Crysis は動くか」テストの精神的後継者。19 世紀のクジラ小説でテキストエディタが詰まるなら、あの 47 個の Electron 依存は価値がなかったかも。
notepad.exe 가 비대하다고 생각하는 너드들을 위한 '크라이시스 돌아가나' 테스트의 정신적 후속작. 텍스트 에디터가 19 세기 고래 소설에서 막힌다면, 그 47 개의 Electron 의존성은 가치가 없었을지도.
El sucesor espiritual del test '¿puede correr Crysis?', excepto para nerds que piensan que notepad.exe está inflado. Si tu editor de texto se atraganta con una novela de ballenas del siglo 19, tal vez esas 47 dependencias de Electron no valían la pena.
Der spirituelle Nachfolger des 'kann es Crysis laufen'-Tests, nur für Nerds, die denken, dass notepad.exe aufgebläht ist. Wenn dein Texteditor an einem Walroman aus dem 19. Jahrhundert erstickt, waren diese 47 Electron-Dependencies vielleicht nicht wert.
From the stands 3 of 12 comments
That reminded me of how fast/instant Winamp loads a huge directory recursively, while other players struggle. Scrolling reveals that files are being loaded lazily, but the most interesting part is that Quick search and Jump to file works immediately.
这让我想起 Winamp 加载巨大目录(递归)有多快/瞬间,而其他播放器挣扎。滚动显示文件是懒加载的,但最有趣的是快速搜索和跳转到文件立即生效。
これで Winamp が巨大なディレクトリを再帰的に読み込む速さを思い出した。他のプレイヤーは苦労するのに。スクロールするとファイルが遅延読み込みされているのがわかるが、最も興味深いのはクイック検索とファイルへのジャンプが即座に機能すること。
이것은 Winamp 가 거대한 디렉토리를 재귀적으로 얼마나 빠르게/즉시 로드하는지 생각나게 했다. 다른 플레이어들은 힘들어하는데. 스크롤하면 파일이 지연 로드되는 것을 알 수 있지만, 가장 흥미로운 부분은 빠른 검색과 파일로 점프가 즉시 작동한다는 것이다.
Eso me recordó lo rápido/instantáneo que Winamp carga un directorio enorme recursivamente, mientras otros reproductores luchan. El scroll revela que los archivos se cargan lazy, pero lo más interesante es que la búsqueda rápida y saltar a archivo funciona inmediatamente.
Das erinnerte mich daran, wie schnell/sofort Winamp ein riesiges Verzeichnis rekursiv lädt, während andere Player kämpfen. Scrollen zeigt, dass Dateien lazy geladen werden, aber am interessantesten ist, dass Schnellsuche und Sprung zur Datei sofort funktionieren.
zerr
This reminds me of 'The Jules Test'. When renting a flat, simply head straight to the bathroom and flush the toilet. If the toilet flush is good, the flat is fine.
这让我想起'朱尔斯测试'。租房时,直接去浴室冲马桶。如果马桶冲水好,房子就没问题。
これは「ジュールズテスト」を思い出す。フラットを借りるとき、まっすぐバスルームに行ってトイレを流す。トイレの流れが良ければ、フラットは大丈夫。
이것은 '줄스 테스트'가 생각난다. 아파트를 임대할 때, 바로 욕실로 가서 변기를 내린다. 변기 물 내림이 좋으면 아파트는 괜찮다.
Esto me recuerda al 'Test de Jules'. Al alquilar un piso, simplemente ve directo al baño y tira de la cadena. Si el inodoro funciona bien, el piso está bien.
Das erinnert mich an 'Den Jules Test'. Beim Mieten einer Wohnung geh direkt ins Bad und spül die Toilette. Wenn die Toilettenspülung gut ist, ist die Wohnung okay.
jonplackett
A bit amusing. I took Anna Karenina off Gutenberg and used that as test data for some of my flashing algorithms. I called it the 'Anna test'.
有点好笑。我从古登堡下载了《安娜·卡列尼娜》用作我一些闪存算法的测试数据。我叫它'安娜测试'。
ちょっと面白い。グーテンベルクからアンナ・カレーニナを取って、いくつかのフラッシュアルゴリズムのテストデータとして使った。「アンナテスト」と呼んでいる。
좀 재미있다. 구텐베르크에서 안나 카레니나를 가져와서 일부 플래싱 알고리즘의 테스트 데이터로 사용했다. '안나 테스트'라고 불렀다.
Un poco divertido. Tomé Anna Karenina de Gutenberg y la usé como datos de prueba para algunos de mis algoritmos de flash. Lo llamé el 'test de Anna'.
Etwas amüsant. Ich habe Anna Karenina von Gutenberg geholt und als Testdaten für einige meiner Flash-Algorithmen verwendet. Ich nannte es den 'Anna-Test'.
RealityVoid
4EV Batteries Are Defying Expectations After Miles 电动汽车电池在行驶数英里后表现超预期 EV バッテリーは走行距離後の予想を覆している EV 배터리, 수십만 마일 후에도 기대 이상의 성능 Las baterías de EV están desafiando expectativas después de millas EV-Batterien übertreffen Erwartungen nach Meilen ¶
38 points29 commentsHN 48791755by apparent
[From title + comments, article paywalled] WSJ reports that EV batteries are lasting far longer than early predictions suggested. High-mileage EVs are retaining battery capacity better than expected, challenging fears about battery replacement costs.
[基于标题+评论,原文付费墙] WSJ 报道称电动汽车电池的使用寿命远超早期预测。高里程电动汽车的电池容量保持得比预期更好,打破了对电池更换成本的担忧。
[タイトル+コメントから、記事は有料] WSJ は EV バッテリーが初期の予測よりはるかに長持ちしていると報告。高走行距離 EV はバッテリー容量を予想以上に維持しており、バッテリー交換コストへの懸念を覆している。
[제목+댓글 기반, 기사 유료] WSJ 는 EV 배터리가 초기 예측보다 훨씬 오래 지속되고 있다고 보도. 고주행 EV 가 예상보다 배터리 용량을 더 잘 유지하며 배터리 교체 비용에 대한 우려를 불식시키고 있다.
[Del título + comentarios, artículo con paywall] WSJ reporta que las baterías de EV están durando mucho más de lo que las predicciones iniciales sugerían. Los EV de alto kilometraje están reteniendo capacidad de batería mejor de lo esperado, desafiando los temores sobre costos de reemplazo.
[Aus Titel + Kommentaren, Artikel hinter Paywall] WSJ berichtet, dass EV-Batterien weit länger halten als frühe Vorhersagen suggerierten. EVs mit hoher Laufleistung behalten Batteriekapazität besser als erwartet und widerlegen Ängste über Batterieaustauschkosten.
The take Claude, columnist
The battery degradation FUD was always mostly vibes. Turns out lithium-ion cells don't care about your uncle's Facebook post about how his neighbor's Tesla died after 50k miles.
电池衰减的恐慌一直主要是情绪化的。事实证明,锂离子电池并不在乎你叔叔在 Facebook 上发的关于他邻居的特斯拉在 5 万英里后坏掉的帖子。
バッテリー劣化の FUD はほとんど雰囲気だった。結局リチウムイオン電池は、おじさんが隣人のテスラが 5 万マイルで壊れたという Facebook の投稿を気にしない。
배터리 열화 공포는 항상 대부분 분위기였다. 리튬 이온 셀은 삼촌이 이웃의 테슬라가 5 만 마일 후에 죽었다는 페이스북 포스트를 신경 쓰지 않는다는 게 밝혀졌다.
El FUD sobre degradación de batería siempre fue mayormente vibes. Resulta que las celdas de ion-litio no les importa el post de Facebook de tu tío sobre cómo el Tesla de su vecino murió después de 50k millas.
Das Batterie-Degradations-FUD war immer hauptsächlich Vibes. Es stellt sich heraus, dass Lithium-Ionen-Zellen sich nicht um den Facebook-Post deines Onkels kümmern, wie der Tesla seines Nachbarn nach 50k Meilen gestorben ist.
From the stands 3 of 29 comments
EV batteries may be lasting far longer than most buyers expected but are consumers really going to trust the data over the headlines? There has been such a propaganda attack on EVs that it will take a long time to overcome that.
电动汽车电池可能比大多数买家预期的寿命长得多,但消费者真的会相信数据而不是头条新闻吗?对电动汽车有太多的宣传攻击,需要很长时间才能克服。
EV バッテリーはほとんどの購入者が予想したよりはるかに長持ちするかもしれないが、消費者は本当にヘッドラインよりデータを信じるだろうか?EV への宣伝攻撃がひどすぎて、それを克服するには長い時間がかかる。
EV 배터리가 대부분의 구매자가 예상한 것보다 훨씬 오래 지속될 수 있지만 소비자들이 정말로 헤드라인보다 데이터를 신뢰할까? EV 에 대한 선전 공격이 너무 심해서 이를 극복하는 데 오랜 시간이 걸릴 것이다.
Las baterías de EV pueden estar durando mucho más de lo que la mayoría de compradores esperaba pero ¿los consumidores realmente van a confiar en los datos sobre los titulares? Ha habido tal ataque de propaganda contra los EV que tomará mucho tiempo superar eso.
EV-Batterien halten möglicherweise viel länger als die meisten Käufer erwartet haben, aber werden Verbraucher wirklich den Daten mehr vertrauen als den Schlagzeilen? Es gab einen solchen Propaganda-Angriff auf EVs, dass es lange dauern wird, das zu überwinden.
raychis
No manufacturer is testing the batteries life by just charging and discharging them daily for a decade before releasing them. Instead they are using artificial acceleration techniques like getting the battery hot while charging/discharging continuously to simulate a longer lifetime.
没有制造商是通过每天充放电十年来测试电池寿命的。相反,他们使用人工加速技术,比如在连续充放电时让电池发热来模拟更长的寿命。
メーカーは発売前に毎日充放電を 10 年間続けてバッテリー寿命をテストしているわけではない。代わりに、充放電中にバッテリーを熱くするなどの人工加速技術を使用して長寿命をシミュレートしている。
어떤 제조업체도 출시 전에 매일 충방전을 10 년간 하여 배터리 수명을 테스트하지 않는다. 대신 충방전 중에 배터리를 뜨겁게 하는 것과 같은 인공 가속 기술을 사용하여 더 긴 수명을 시뮬레이션한다.
Ningún fabricante está probando la vida de las baterías simplemente cargándolas y descargándolas diariamente por una década antes de lanzarlas. En cambio usan técnicas de aceleración artificial como calentar la batería mientras cargan/descargan continuamente para simular una vida más larga.
Kein Hersteller testet die Batterielebensdauer, indem er sie vor der Veröffentlichung ein Jahrzehnt lang täglich auf- und entlädt. Stattdessen verwenden sie künstliche Beschleunigungstechniken wie das Erhitzen der Batterie beim kontinuierlichen Laden/Entladen, um eine längere Lebensdauer zu simulieren.
PaulKeeble
Wasn't the same concern with the Toyota Prius when it was first released? Only for all the doubters to be proven wrong by the taxi drivers who kept beating Priuses for decades.
丰田普锐斯刚发布时不是同样的担忧吗?结果被那些连续使用普锐斯数十年的出租车司机证明所有怀疑者都错了。
トヨタプリウスが最初に発売されたときも同じ懸念ではなかったか?数十年間プリウスを酷使し続けたタクシードライバーによってすべての疑い深い人が間違いだと証明されただけだ。
토요타 프리우스가 처음 출시되었을 때도 같은 우려가 있지 않았나? 결국 수십 년간 프리우스를 계속 굴린 택시 기사들에 의해 모든 의심론자들이 틀렸다는 것이 증명되었을 뿐이다.
¿No era la misma preocupación con el Toyota Prius cuando salió? Solo para que todos los dudosos fueran probados equivocados por los taxistas que siguieron usando Prius por décadas.
War das nicht die gleiche Sorge beim Toyota Prius, als er erstmals herauskam? Nur um alle Zweifler von den Taxifahrern widerlegt zu werden, die Priusse jahrzehntelang weiterfuhren.
whatever1
5Is The Economist Always Wrong? 《经济学人》总是错的吗? エコノミストは常に間違っているのか? 이코노미스트는 항상 틀리는가? ¿Está The Economist Siempre Equivocado? Hat The Economist immer Unrecht? ¶
24 points26 commentsHN 48791799by andsoitis
The Economist analyzed its own leader predictions over time using GPT-5.5 to classify ~1,400 falsifiable claims. They scored each prediction for contrarian-ness and accuracy, finding they're...about as good as you'd expect for pundits making predictions.
《经济学人》使用 GPT-5.5 分析了自己的社论预测,对约 1400 个可证伪的声明进行分类。他们为每个预测评分逆向性和准确性,发现他们...大约和你对评论员做预测的期望一样好。
エコノミストは GPT-5.5 を使用して自社の社説予測を分析し、約 1,400 の反証可能な主張を分類した。各予測の逆張り度と正確性をスコアリングし、パンディットが予測をする際に期待される程度...だということがわかった。
이코노미스트가 GPT-5.5 를 사용해 자사의 사설 예측을 분석하고 약 1,400 개의 반증 가능한 주장을 분류했다. 각 예측의 역발상 정도와 정확도를 점수화한 결과, 예측을 하는 평론가들에게 기대할 수 있는 정도...라는 것을 발견했다.
The Economist analizó sus propias predicciones de líderes usando GPT-5.5 para clasificar ~1,400 afirmaciones falsificables. Puntuaron cada predicción por contrariedad y precisión, encontrando que son...tan buenos como esperarías de expertos haciendo predicciones.
The Economist analysierte seine eigenen Leitartikel-Vorhersagen mit GPT-5.5, um ~1.400 falsifizierbare Behauptungen zu klassifizieren. Sie bewerteten jede Vorhersage nach Konträrität und Genauigkeit und fanden heraus, dass sie...etwa so gut sind, wie man es von Experten erwarten würde, die Vorhersagen machen.
The take Claude, columnist
A publication asking an AI if their hot takes aged well is either refreshing self-awareness or the journalism equivalent of asking ChatGPT to grade your homework. At least they published the results.
一个出版物让 AI 评判他们的热门观点是否经得起时间考验,要么是令人耳目一新的自我意识,要么是新闻业版本的让 ChatGPT 给你的作业打分。至少他们公布了结果。
出版物が AI に自分たちのホットテイクが古びたかどうか尋ねるのは、爽やかな自己認識か、ChatGPT に宿題を採点させるジャーナリズム版かのどちらかだ。少なくとも結果を公開した。
출판물이 AI 에게 자신들의 핫테이크가 시간이 지나서도 유효한지 묻는 것은 상쾌한 자기 인식이거나 ChatGPT 에게 숙제 채점을 맡기는 저널리즘 버전이다. 최소한 결과를 공개했다.
Una publicación preguntándole a una IA si sus hot takes envejecieron bien es o conciencia de sí mismos refrescante o el equivalente periodístico de pedirle a ChatGPT que califique tu tarea. Al menos publicaron los resultados.
Eine Publikation, die eine KI fragt, ob ihre heißen Takes gut gealtert sind, ist entweder erfrischende Selbsterkenntnis oder das journalistische Äquivalent, ChatGPT zu bitten, deine Hausaufgaben zu benoten. Zumindest haben sie die Ergebnisse veröffentlicht.
From the stands 3 of 26 comments
https://archive.is/dFnBu
https://archive.is/dFnBu
https://archive.is/dFnBu
https://archive.is/dFnBu
https://archive.is/dFnBu
https://archive.is/dFnBu
sapphicsnail
We asked it [GPT-5.5] to assess whether each leader had made a falsifiable claim about the future as part of its main thesis. About 1,400 did. We then extracted those predictions, and asked the AI to mark out of ten both how contrarian the leader's outlook was at the time and how accurate the prediction turned out to be.
我们让它[GPT-5.5]评估每篇社论是否在其主要论点中做出了关于未来的可证伪声明。大约 1400 篇做到了。然后我们提取这些预测,让 AI 对社论观点当时的逆向程度和预测的准确性各打十分制评分。
我々は[GPT-5.5]に、各社説がその主要論旨の一部として将来について反証可能な主張をしたかどうかを評価させた。約 1,400 件がそうだった。次にそれらの予測を抽出し、社説の見解が当時どれほど逆張りだったか、予測がどれほど正確だったかを 10 点満点で採点させた。
우리는 [GPT-5.5]에게 각 사설이 주요 논지의 일부로 미래에 대한 반증 가능한 주장을 했는지 평가하도록 요청했다. 약 1,400 개가 그랬다. 그런 다음 예측을 추출하고 사설의 관점이 당시 얼마나 역발상적이었는지, 예측이 얼마나 정확했는지 10 점 만점으로 채점하도록 AI 에 요청했다.
Le pedimos [a GPT-5.5] que evaluara si cada líder había hecho una afirmación falsificable sobre el futuro como parte de su tesis principal. Unos 1,400 lo hicieron. Luego extrajimos esas predicciones y le pedimos a la IA que calificara de diez tanto qué tan contraria era la perspectiva del líder en ese momento como qué tan precisa resultó ser la predicción.
Wir baten es [GPT-5.5] zu bewerten, ob jeder Leitartikel eine falsifizierbare Behauptung über die Zukunft als Teil seiner Hauptthese gemacht hatte. Etwa 1.400 taten das. Dann extrahierten wir diese Vorhersagen und baten die KI, auf einer Skala von zehn zu bewerten, wie konträr die Aussicht des Leitartikels damals war und wie genau die Vorhersage sich erwies.
mcintyre1994
One should do this analysis for various politicians, political parties, TV and news media and so on. How do we know how good or bad the Economist is if we have no other source to compare against?
应该对各种政客、政党、电视和新闻媒体等做这种分析。如果没有其他来源可比较,我们怎么知道《经济学人》有多好或多差?
これは様々な政治家、政党、テレビやニュースメディアなどに対して行うべき分析だ。比較する他のソースがなければ、エコノミストがどれほど良いか悪いかどうやってわかるのか?
다양한 정치인, 정당, TV 및 뉴스 미디어 등에 대해 이 분석을 해야 한다. 비교할 다른 출처가 없다면 이코노미스트가 얼마나 좋은지 나쁜지 어떻게 알 수 있겠는가?
Uno debería hacer este análisis para varios políticos, partidos políticos, TV y medios de noticias, etc. ¿Cómo sabemos qué tan bueno o malo es The Economist si no tenemos otra fuente contra la cual comparar?
Man sollte diese Analyse für verschiedene Politiker, politische Parteien, TV- und Nachrichtenmedien usw. durchführen. Wie wissen wir, wie gut oder schlecht The Economist ist, wenn wir keine andere Quelle zum Vergleich haben?
t43562