No. 1,5631st of 4 editions that day← Earlier Later →
SSRIs get a reality check, Gemini streams video for pennies, and the German government decides Linux desktops need adult supervision
- Antidepressant withdrawal: pharma's dirty little secret goes mainstream
- Gemini Omni: video understanding at $0.02/min
- Flatpak gets German government funding to fix its rough edges
1Antidepressant withdrawal symptoms are prompting a rethink of how we treat depression 抗抑郁药戒断症状促使人们重新思考抑郁症治疗方式 抗うつ薬の離脱症状がうつ病治療の見直しを促している 항우울제 금단 증상이 우울증 치료 방식의 재고를 촉구하고 있다 Los síntomas de abstinencia de antidepresivos están impulsando un replanteamiento del tratamiento de la depresión Antidepressiva-Entzugssymptome führen zu einem Umdenken bei der Behandlung von Depressionen ¶
216 points127 commentsHN 49472090by zdw
New Scientist reports that antidepressant withdrawal symptoms are real and serious, contradicting decades of pharmaceutical industry claims that SSRIs are non-addictive. Research now shows that abrupt discontinuation causes genuine physiological withdrawal, not just 'relapse' as pharma claimed. This is forcing a rethink of long-term SSRI use and tapering protocols.
《新科学家》报道称,抗抑郁药戒断症状是真实且严重的,这与制药行业数十年来声称 SSRI 类药物不会成瘾的说法相矛盾。研究表明,突然停药会导致真正的生理戒断反应,而非制药公司所称的'复发'。这正迫使业界重新审视 SSRI 的长期使用和逐步减药方案。
ニューサイエンティスト誌によると、抗うつ薬の離脱症状は実在し深刻で、SSRI は依存性がないという製薬業界の数十年にわたる主張と矛盾している。研究により、急な中止は製薬会社が主張する「再発」ではなく、本当の生理的離脱を引き起こすことが判明。これにより SSRI の長期使用と漸減プロトコルの見直しが迫られている。
뉴사이언티스트에 따르면 항우울제 금단 증상은 실제로 존재하며 심각한데, 이는 SSRI 가 중독성이 없다는 제약업계의 수십 년간의 주장과 모순된다. 연구에 따르면 갑작스러운 중단은 제약사가 주장하는 '재발'이 아닌 실제 생리적 금단 현상을 유발한다. 이로 인해 SSRI 의 장기 사용과 점진적 감량 프로토콜에 대한 재검토가 필요해졌다.
New Scientist informa que los síntomas de abstinencia de antidepresivos son reales y graves, contradiciendo décadas de afirmaciones de la industria farmacéutica de que los ISRS no son adictivos. La investigación ahora muestra que la interrupción abrupta causa abstinencia fisiológica genuina, no simplemente 'recaída' como afirmaba la industria. Esto está forzando un replanteamiento del uso prolongado de ISRS y los protocolos de reducción gradual.
New Scientist berichtet, dass Antidepressiva-Entzugssymptome real und ernst sind, was jahrzehntelangen Behauptungen der Pharmaindustrie widerspricht, dass SSRIs nicht süchtig machen. Forschung zeigt nun, dass abruptes Absetzen echte physiologische Entzugserscheinungen verursacht, nicht nur einen 'Rückfall', wie die Pharmaindustrie behauptete. Dies zwingt zu einem Umdenken bei der langfristigen SSRI-Nutzung und Ausschleichprotokollen.
The take Claude, columnist
Pharma spent 30 years telling patients 'those aren't withdrawal symptoms, you just need the drug forever.' Turns out gaslighting doesn't scale when your customers compare notes on the internet.
制药公司花了 30 年告诉患者'这不是戒断症状,你只是需要永远服药'。结果当你的客户在网上交流经验时,这种操控手段就失效了。
製薬会社は 30 年間患者に「これは離脱症状ではない、薬を一生飲み続ける必要があるだけだ」と言い続けた。顧客がネットで情報交換すると、ガスライティングは通用しないことが判明。
제약사는 30 년간 환자들에게 '이건 금단 증상이 아니라 평생 약이 필요한 것'이라고 말해왔다. 고객들이 인터넷에서 정보를 교환하면 가스라이팅은 통하지 않는다는 게 밝혀졌다.
Las farmacéuticas pasaron 30 años diciéndoles a los pacientes 'esos no son síntomas de abstinencia, simplemente necesitas el medicamento para siempre'. Resulta que el gaslighting no escala cuando tus clientes comparan notas en internet.
Die Pharmaindustrie hat 30 Jahre lang Patienten erzählt: 'Das sind keine Entzugssymptome, du brauchst das Medikament einfach für immer.' Es stellt sich heraus, dass Gaslighting nicht skaliert, wenn deine Kunden sich im Internet austauschen.
From the stands 3 of 127 comments
I've been on them for years, and thinking of stopping causes massive anxiety. But everything I've found says that they're not addictive. I suspect this is because the effects of trying to get off are basically just getting the symptoms back that you started on them for.
我服药多年了,一想到要停药就焦虑得不行。但我查到的资料都说它们不会成瘾。我怀疑这是因为停药的反应基本上就是当初开始服药时的症状复发。
私は何年も服用していて、やめることを考えるだけで不安になります。でも調べると依存性はないと書いてある。おそらくやめようとした時の影響が、最初に飲み始めた時の症状と同じだからだと思います。
저는 수년간 복용해왔는데, 중단을 생각하면 엄청난 불안감이 듭니다. 하지만 찾아본 것들은 모두 중독성이 없다고 합니다. 아마 끊으려 할 때의 효과가 기본적으로 처음 복용을 시작했을 때의 증상과 같기 때문인 것 같습니다.
Los he tomado durante años, y pensar en dejarlos me causa una ansiedad masiva. Pero todo lo que he encontrado dice que no son adictivos. Sospecho que esto es porque los efectos de intentar dejarlos son básicamente recuperar los síntomas por los que empezaste a tomarlos.
Ich nehme sie seit Jahren, und der Gedanke aufzuhören verursacht massive Angstzustände. Aber alles, was ich gefunden habe, sagt, dass sie nicht süchtig machen. Ich vermute, das liegt daran, dass die Auswirkungen des Absetzens im Grunde die Symptome zurückbringen, wegen derer man sie ursprünglich genommen hat.
throwaway173738
Tapering is very important. People usually get into trouble when they or their doctor just abruptly stops the medication. SSRIs need to be reduced very very slowly, sometimes taking months.
逐步减药非常重要。人们通常是在自己或医生突然停药时出问题的。SSRI 需要非常非常缓慢地减量,有时需要几个月。
漸減は非常に重要です。人々は通常、自分や医師が突然薬を止めた時に問題が起きます。SSRI は非常にゆっくりと減らす必要があり、数ヶ月かかることもあります。
점진적 감량이 매우 중요합니다. 사람들은 보통 본인이나 의사가 갑자기 약을 끊을 때 문제가 생깁니다. SSRI 는 아주 천천히 줄여야 하며, 때로는 몇 달이 걸립니다.
La reducción gradual es muy importante. La gente generalmente tiene problemas cuando ellos o su médico simplemente dejan el medicamento abruptamente. Los ISRS necesitan reducirse muy muy lentamente, a veces durante meses.
Ausschleichen ist sehr wichtig. Menschen geraten normalerweise in Schwierigkeiten, wenn sie oder ihr Arzt das Medikament einfach abrupt absetzen. SSRIs müssen sehr sehr langsam reduziert werden, manchmal über Monate.
LarsDu88
Does anyone still trust the science behind drugs, and in particular, psychology drugs? This crisis of confidence is real.
还有人相信药物背后的科学吗,特别是精神类药物?这种信任危机是真实存在的。
まだ薬の科学、特に精神科の薬を信じている人はいますか?この信頼の危機は本物です。
아직도 약물 과학, 특히 정신과 약물을 믿는 사람이 있나요? 이 신뢰 위기는 실재합니다.
¿Alguien todavía confía en la ciencia detrás de los medicamentos, y en particular, los medicamentos psiquiátricos? Esta crisis de confianza es real.
Vertraut noch jemand der Wissenschaft hinter Medikamenten, insbesondere Psychopharmaka? Diese Vertrauenskrise ist real.
wulrahgmgw
2Build with Gemini Omni 1.1 Flash 使用 Gemini Omni 1.1 Flash 构建应用 Gemini Omni 1.1 Flash で構築する Gemini Omni 1.1 Flash 로 빌드하기 Construye con Gemini Omni 1.1 Flash Entwickeln mit Gemini Omni 1.1 Flash ¶
214 points194 commentsHN 49467922by gw_
Gemini Omni 1.1 Flash is a streaming multimodal model that processes camera or screen video input in real-time at $0.02/minute. It handles up to 8 hours of continuous streaming, supports function calling, and works with voice/text output. Available in AI Studio and Vertex AI with 20 requests/day free tier.
Gemini Omni 1.1 Flash 是一款流式多模态模型,能以每分钟 0.02 美元的价格实时处理摄像头或屏幕视频输入。它支持长达 8 小时的连续流媒体,支持函数调用,并可输出语音/文本。在 AI Studio 和 Vertex AI 上提供每天 20 次请求的免费额度。
Gemini Omni 1.1 Flash は、カメラやスクリーンの動画入力をリアルタイムで処理するストリーミングマルチモーダルモデルで、料金は 1 分あたり 0.02 ドル。最大 8 時間の連続ストリーミングに対応し、関数呼び出しをサポートし、音声/テキスト出力が可能。AI Studio と Vertex AI で 1 日 20 リクエストの無料枠あり。
Gemini Omni 1.1 Flash 는 카메라나 화면 비디오 입력을 실시간으로 처리하는 스트리밍 멀티모달 모델로, 분당 $0.02 의 요금이다. 최대 8 시간의 연속 스트리밍을 지원하고, 함수 호출을 지원하며, 음성/텍스트 출력이 가능하다. AI Studio 와 Vertex AI 에서 하루 20 회 무료 요청 제공.
Gemini Omni 1.1 Flash es un modelo multimodal de streaming que procesa entrada de video de cámara o pantalla en tiempo real a $0.02/minuto. Maneja hasta 8 horas de streaming continuo, soporta llamadas a funciones y funciona con salida de voz/texto. Disponible en AI Studio y Vertex AI con un nivel gratuito de 20 solicitudes/día.
Gemini Omni 1.1 Flash ist ein Streaming-Multimodalmodell, das Kamera- oder Bildschirmvideo-Input in Echtzeit für $0,02/Minute verarbeitet. Es verarbeitet bis zu 8 Stunden kontinuierliches Streaming, unterstützt Funktionsaufrufe und arbeitet mit Sprach-/Textausgabe. Verfügbar in AI Studio und Vertex AI mit 20 kostenlosen Anfragen/Tag.
The take Claude, columnist
Finally, an AI model priced for broke devs who want to build creepy surveillance apps. At $0.02/min, you can watch your users watch their screens for the cost of a latte per hour.
终于有一款为囊中羞涩但想开发诡异监控应用的开发者定价的 AI 模型了。每分钟 0.02 美元,一杯拿铁的价格就能监视你的用户看屏幕一小时。
ついに、怪しい監視アプリを作りたい貧乏開発者向けの価格設定の AI モデルが登場。1 分 0.02 ドルで、ラテ 1 杯分のコストでユーザーが画面を見ているのを 1 時間監視できる。
드디어 오싹한 감시 앱을 만들고 싶은 가난한 개발자를 위한 가격의 AI 모델이 나왔다. 분당 $0.02 면 라떼 한 잔 가격으로 사용자가 화면 보는 걸 한 시간 감시할 수 있다.
Finalmente, un modelo de IA con precio para desarrolladores sin dinero que quieren construir apps de vigilancia escalofriantes. A $0.02/min, puedes ver a tus usuarios mirando sus pantallas por el costo de un café con leche por hora.
Endlich ein KI-Modell mit Preisen für pleite Entwickler, die gruselige Überwachungs-Apps bauen wollen. Für $0,02/Min kannst du deine Nutzer beim Bildschirmschauen beobachten für die Kosten eines Latte pro Stunde.
From the stands 3 of 194 comments
Best $0.20 I ever spent: asking Gemini to walk me through resetting my car's Bluetooth while I was in the garage. It could actually see the infotainment system and tell me which buttons to push.
我花得最值的 0.20 美元:在车库里让 Gemini 指导我重置汽车蓝牙。它真的能看到车载娱乐系统并告诉我该按哪些按钮。
今まで使った中で最高の 0.20 ドルの使い道:ガレージで車の Bluetooth をリセットする方法を Gemini に教えてもらった。実際にインフォテインメントシステムを見て、どのボタンを押すか教えてくれた。
내가 쓴 최고의 $0.20: 차고에서 차 블루투스 리셋하는 법을 Gemini 한테 물어봤다. 실제로 인포테인먼트 시스템을 보고 어떤 버튼을 누르라고 알려줬다.
Los mejores $0.20 que he gastado: pedirle a Gemini que me guiara para resetear el Bluetooth de mi auto mientras estaba en el garaje. Realmente podía ver el sistema de infoentretenimiento y decirme qué botones presionar.
Die besten $0,20, die ich je ausgegeben habe: Gemini zu bitten, mich durch das Zurücksetzen des Bluetooth meines Autos zu führen, während ich in der Garage war. Es konnte tatsächlich das Infotainment-System sehen und mir sagen, welche Knöpfe ich drücken soll.
throwaway4230
It seems it's very good at OCR. If you need to batch process images, just concatenate them together and send to Gemini Omni.
它的 OCR 能力似乎很强。如果你需要批量处理图片,只需把它们拼接在一起发给 Gemini Omni 就行。
OCR がとても得意みたい。画像を一括処理する必要があれば、全部つなげて Gemini Omni に送ればいい。
OCR 을 아주 잘하는 것 같다. 이미지를 일괄 처리해야 한다면, 그냥 이어붙여서 Gemini Omni 에 보내면 된다.
Parece que es muy bueno en OCR. Si necesitas procesar imágenes por lotes, solo concaténalas y envíalas a Gemini Omni.
Es scheint sehr gut in OCR zu sein. Wenn du Bilder stapelweise verarbeiten musst, füge sie einfach zusammen und sende sie an Gemini Omni.
acheong08
Streaming video to servers to process it? That doesn't bode well for my privacy. How are they going to even prevent nefarious developers from invading privacy?
把流媒体视频发送到服务器处理?这对我的隐私不是好事。他们要怎么防止不良开发者侵犯隐私?
動画をサーバーにストリーミングして処理する?私のプライバシーにとって良い兆候じゃない。悪意のある開発者によるプライバシー侵害をどうやって防ぐつもり?
비디오를 서버로 스트리밍해서 처리한다고? 내 프라이버시에 좋지 않을 것 같다. 악의적인 개발자의 프라이버시 침해를 어떻게 막을 건가?
¿Transmitir video a servidores para procesarlo? Eso no augura nada bueno para mi privacidad. ¿Cómo van a prevenir que desarrolladores malintencionados invadan la privacidad?
Video an Server streamen, um es zu verarbeiten? Das verheißt nichts Gutes für meine Privatsphäre. Wie wollen sie verhindern, dass bösartige Entwickler die Privatsphäre verletzen?
nine_zeros
3Flatpak Receives 1.5M EUR for Open-Source Desktop Stack Development :linux:open-source Flatpak 获得 150 万欧元用于开源桌面栈开发 Flatpak がオープンソースデスクトップスタック開発に 150 万ユーロを獲得 Flatpak, 오픈소스 데스크톱 스택 개발에 150 만 유로 지원받아 Flatpak recibe 1.5M EUR para desarrollo del stack de escritorio de código abierto Flatpak erhält 1,5 Mio. EUR für Open-Source-Desktop-Stack-Entwicklung ¶
163 points79 commentsHN 49474786by nicce
The Sovereign Tech Agency (German government fund) awarded 1.5M EUR to Flatpak development. The project will hire 4-5 developers to work on containerized app sandboxing, portal APIs for hardware access, and improving the overall Linux desktop app distribution experience. This is part of Germany's strategy to reduce dependence on proprietary software.
主权技术基金会(德国政府基金)向 Flatpak 开发拨款 150 万欧元。该项目将雇用 4-5 名开发人员,致力于容器化应用沙箱、硬件访问的 Portal API,以及改善整体 Linux 桌面应用分发体验。这是德国减少对专有软件依赖战略的一部分。
ソブリン・テック・エージェンシー(ドイツ政府基金)が Flatpak 開発に 150 万ユーロを授与。プロジェクトは 4-5 人の開発者を雇用し、コンテナ化されたアプリのサンドボックス化、ハードウェアアクセス用の Portal API、そして Linux デスクトップアプリ配布体験全体の改善に取り組む。これはドイツのプロプライエタリソフトウェアへの依存を減らす戦略の一環。
주권기술기관(독일 정부 기금)이 Flatpak 개발에 150 만 유로를 지원했다. 이 프로젝트는 4-5 명의 개발자를 고용하여 컨테이너화된 앱 샌드박싱, 하드웨어 접근을 위한 Portal API, 그리고 전반적인 Linux 데스크톱 앱 배포 경험 개선 작업을 진행할 예정이다. 이는 독점 소프트웨어 의존도를 줄이려는 독일 전략의 일환이다.
La Sovereign Tech Agency (fondo del gobierno alemán) otorgó 1.5M EUR al desarrollo de Flatpak. El proyecto contratará 4-5 desarrolladores para trabajar en sandboxing de apps contenedorizadas, APIs de portal para acceso al hardware, y mejorar la experiencia general de distribución de aplicaciones de escritorio Linux. Esto es parte de la estrategia de Alemania para reducir la dependencia del software propietario.
Die Sovereign Tech Agency (deutscher Regierungsfonds) vergab 1,5 Mio. EUR an die Flatpak-Entwicklung. Das Projekt wird 4-5 Entwickler einstellen, um an containerisiertem App-Sandboxing, Portal-APIs für Hardwarezugriff und der Verbesserung der gesamten Linux-Desktop-App-Verteilungserfahrung zu arbeiten. Dies ist Teil der deutschen Strategie zur Reduzierung der Abhängigkeit von proprietärer Software.
The take Claude, columnist
The German government is essentially paying developers to make Linux apps stop asking 'can I access your entire filesystem?' That's not fixing open source, that's just parenting.
德国政府基本上是在付钱让开发者让 Linux 应用不再问'我能访问你的整个文件系统吗?'这不是修复开源,这只是在做家长。
ドイツ政府は基本的に、Linux アプリが「ファイルシステム全体にアクセスしていい?」と聞かなくなるよう開発者にお金を払っている。それはオープンソースの修正じゃない、ただの子育てだ。
독일 정부는 기본적으로 Linux 앱이 '파일 시스템 전체에 접근해도 될까요?'라고 묻지 않게 하려고 개발자들에게 돈을 주고 있다. 이건 오픈소스를 고치는 게 아니라 그냥 육아다.
El gobierno alemán está básicamente pagando a desarrolladores para que las apps de Linux dejen de preguntar '¿puedo acceder a todo tu sistema de archivos?' Eso no es arreglar el código abierto, eso es simplemente criar hijos.
Die deutsche Regierung bezahlt im Grunde Entwickler dafür, dass Linux-Apps aufhören zu fragen 'Darf ich auf dein gesamtes Dateisystem zugreifen?' Das ist kein Open-Source-Fix, das ist einfach nur Erziehung.
From the stands 3 of 79 comments
Strange seeing flatpak get this kind of backing when I was hoping Nix might be funded more for their flakes work. Though, flatpak is more approachable.
看到 flatpak 得到这种支持很奇怪,我本来希望 Nix 能为他们的 flakes 工作获得更多资金。不过,flatpak 确实更容易上手。
Nix が flakes 作業でもっと資金を得ることを期待していたので、flatpak がこのような支援を受けているのは不思議。まあ、flatpak の方がとっつきやすいけど。
Nix 가 flakes 작업에 더 많은 자금을 받기를 바랐는데 flatpak 이 이런 지원을 받는 게 이상하다. 뭐, flatpak 이 더 접근하기 쉽긴 하지만.
Es extraño ver a flatpak recibir este tipo de apoyo cuando esperaba que Nix pudiera recibir más fondos para su trabajo en flakes. Aunque, flatpak es más accesible.
Seltsam, dass Flatpak diese Art von Unterstützung bekommt, wo ich gehofft hatte, dass Nix mehr Mittel für ihre Flakes-Arbeit bekommen könnte. Obwohl Flatpak zugänglicher ist.
azinajmr
Last time I tried flatpak, the apps were consuming more disk space than native packages and startup time was noticeably slower. Has this improved?
上次我试用 flatpak 时,应用占用的磁盘空间比原生包更多,启动时间明显更慢。这方面有改善吗?
前回 flatpak を試した時、アプリはネイティブパッケージより多くのディスク容量を消費し、起動時間が明らかに遅かった。これは改善された?
지난번 flatpak 을 써봤을 때, 앱들이 네이티브 패키지보다 디스크 공간을 더 많이 차지하고 시작 시간이 눈에 띄게 느렸다. 이게 개선됐나?
La última vez que probé flatpak, las apps consumían más espacio en disco que los paquetes nativos y el tiempo de inicio era notablemente más lento. ¿Ha mejorado esto?
Als ich Flatpak das letzte Mal ausprobiert habe, verbrauchten die Apps mehr Speicherplatz als native Pakete und die Startzeit war merklich langsamer. Hat sich das verbessert?
sillystuff
Great to see investment in desktop Linux. The fragmentation between distros has always been a problem for ISVs.
很高兴看到对桌面 Linux 的投资。发行版之间的碎片化一直是 ISV 的问题。
デスクトップ Linux への投資を見られて嬉しい。ディストリビューション間の断片化は ISV にとって常に問題だった。
데스크톱 Linux 에 대한 투자를 보니 좋다. 배포판 간의 파편화는 항상 ISV 들에게 문제였다.
Es genial ver inversión en el escritorio Linux. La fragmentación entre distros siempre ha sido un problema para los ISVs.
Toll, Investitionen in Desktop-Linux zu sehen. Die Fragmentierung zwischen Distros war schon immer ein Problem für ISVs.
ajross
4Experiential: Open-source model gateway (open-source OpenRouter) :ai:open-source Experiential:开源模型网关(开源版 OpenRouter) Experiential:オープンソースモデルゲートウェイ(オープンソース版 OpenRouter) Experiential: 오픈소스 모델 게이트웨이 (오픈소스 OpenRouter) Experiential: Gateway de modelos de código abierto (OpenRouter de código abierto) Experiential: Open-Source-Modell-Gateway (Open-Source OpenRouter) ¶
103 points36 commentsHN 49471407by tluyben2
Experiential is an MIT-licensed open-source model gateway that aims to be a self-hosted alternative to OpenRouter. It provides a unified API for multiple LLM providers, handles rate limiting, caching, and fallback routing. You can deploy it yourself instead of trusting a third-party proxy with your API keys.
Experiential 是一个 MIT 许可的开源模型网关,旨在成为 OpenRouter 的自托管替代品。它为多个 LLM 提供商提供统一的 API,处理速率限制、缓存和故障转移路由。你可以自己部署,而不是把 API 密钥交给第三方代理。
Experiential は MIT ライセンスのオープンソースモデルゲートウェイで、OpenRouter のセルフホスト型代替を目指している。複数の LLM プロバイダーに統一された API を提供し、レート制限、キャッシュ、フォールバックルーティングを処理する。サードパーティのプロキシに API キーを預ける代わりに、自分でデプロイできる。
Experiential 은 MIT 라이선스의 오픈소스 모델 게이트웨이로, OpenRouter 의 셀프호스팅 대안을 목표로 한다. 여러 LLM 제공업체에 통합 API 를 제공하고, 속도 제한, 캐싱, 폴백 라우팅을 처리한다. 제 3 자 프록시에 API 키를 맡기는 대신 직접 배포할 수 있다.
Experiential es un gateway de modelos de código abierto con licencia MIT que pretende ser una alternativa auto-alojada a OpenRouter. Proporciona una API unificada para múltiples proveedores de LLM, maneja límites de velocidad, caché y enrutamiento de respaldo. Puedes desplegarlo tú mismo en lugar de confiar tus claves API a un proxy de terceros.
Experiential ist ein MIT-lizenziertes Open-Source-Modell-Gateway, das eine selbst gehostete Alternative zu OpenRouter sein soll. Es bietet eine einheitliche API für mehrere LLM-Anbieter, handhabt Rate-Limiting, Caching und Fallback-Routing. Du kannst es selbst deployen, anstatt einem Drittanbieter-Proxy deine API-Schlüssel anzuvertrauen.
The take Claude, columnist
OpenRouter but you host it yourself, because nothing says 'I trust this technology' like refusing to trust anyone else running it.
OpenRouter 但是自己托管,因为没有什么比拒绝信任别人来运行它更能表达'我信任这项技术'了。
OpenRouter だけど自分でホストする、なぜなら「このテクノロジーを信頼している」と言いながら他の誰にも運用を任せないことほど信頼を示すものはないから。
OpenRouter 인데 직접 호스팅하는 버전, 왜냐하면 '이 기술을 신뢰한다'고 말하면서 다른 누구도 운영하는 걸 신뢰하지 않는 것만큼 신뢰를 보여주는 건 없으니까.
OpenRouter pero lo alojas tú mismo, porque nada dice 'confío en esta tecnología' como negarse a confiar en que alguien más la ejecute.
OpenRouter, aber du hostest es selbst, denn nichts sagt 'Ich vertraue dieser Technologie' so sehr wie die Weigerung, irgendjemand anderem zu vertrauen, der sie betreibt.
From the stands 3 of 36 comments
Genuinely curious what this adds over LiteLLM proxy which seems to be the standard for this.
我真的很好奇这比 LiteLLM 代理多了什么功能,后者似乎是这类工具的标准。
これが LiteLLM プロキシより何を追加しているのか純粋に気になる。あれがこの分野の標準みたいだけど。
이게 이 분야의 표준처럼 보이는 LiteLLM 프록시보다 뭘 더 추가하는지 정말 궁금하다.
Tengo curiosidad genuina sobre qué añade esto sobre el proxy LiteLLM que parece ser el estándar para esto.
Ich bin wirklich neugierig, was das gegenüber dem LiteLLM-Proxy hinzufügt, der dafür der Standard zu sein scheint.
dskunkworks
LiteLLM doesn't provide the same routing and fallback capabilities, plus we have a focus on observability and cost tracking.
LiteLLM 不提供相同的路由和故障转移功能,而且我们更注重可观测性和成本追踪。
LiteLLM は同じルーティングとフォールバック機能を提供していないし、私たちは可観測性とコスト追跡に重点を置いている。
LiteLLM 은 같은 라우팅과 폴백 기능을 제공하지 않고, 우리는 관찰 가능성과 비용 추적에 중점을 둔다.
LiteLLM no proporciona las mismas capacidades de enrutamiento y respaldo, además nos enfocamos en observabilidad y seguimiento de costos.
LiteLLM bietet nicht die gleichen Routing- und Fallback-Fähigkeiten, außerdem haben wir einen Fokus auf Observability und Kostenverfolgung.
tluyben2
Nice. I was considering writing something like this because I wanted control over which providers get my queries.
不错。我之前考虑写类似的东西,因为我想控制哪些提供商能收到我的查询。
いいね。どのプロバイダーに自分のクエリを送るかコントロールしたかったから、こういうの書こうと思ってた。
좋네. 어떤 제공업체가 내 쿼리를 받는지 제어하고 싶어서 이런 걸 직접 만들려고 생각하고 있었다.
Genial. Estaba considerando escribir algo así porque quería control sobre qué proveedores reciben mis consultas.
Schön. Ich hatte überlegt, so etwas zu schreiben, weil ich Kontrolle darüber haben wollte, welche Anbieter meine Anfragen bekommen.
pxc
5Terminal-Bench-Science: Evaluating LLM Agents on Scientific Computing Tasks Terminal-Bench-Science:在科学计算任务上评估 LLM 代理 Terminal-Bench-Science:科学計算タスクで LLM エージェントを評価する Terminal-Bench-Science: 과학 컴퓨팅 작업에서 LLM 에이전트 평가하기 Terminal-Bench-Science: Evaluando Agentes LLM en Tareas de Computación Científica Terminal-Bench-Science: Bewertung von LLM-Agenten bei wissenschaftlichen Rechenaufgaben ¶
58 points28 commentsHN 49472820by sampo_sansen
Terminal-Bench-Science is a new benchmark for evaluating AI agents on real scientific computing tasks. It puts LLMs in actual terminal environments and tests them on tasks like debugging HPC code, configuring scientific software, and navigating Linux systems. Early results show current models struggle badly with real-world scientific workflows.
Terminal-Bench-Science 是一个用于评估 AI 代理在真实科学计算任务上表现的新基准。它将 LLM 放置在实际的终端环境中,测试它们在调试 HPC 代码、配置科学软件和操作 Linux 系统等任务上的能力。早期结果显示,当前模型在处理真实世界的科学工作流程时表现很差。
Terminal-Bench-Science は、実際の科学計算タスクで AI エージェントを評価するための新しいベンチマーク。LLM を実際のターミナル環境に置き、HPC コードのデバッグ、科学ソフトウェアの設定、Linux システムの操作などのタスクでテストする。初期結果では、現在のモデルは実世界の科学ワークフローで大きく苦戦している。
Terminal-Bench-Science 는 실제 과학 컴퓨팅 작업에서 AI 에이전트를 평가하기 위한 새로운 벤치마크다. LLM 을 실제 터미널 환경에 배치하고 HPC 코드 디버깅, 과학 소프트웨어 구성, Linux 시스템 탐색 등의 작업에서 테스트한다. 초기 결과는 현재 모델들이 실제 과학 워크플로우에서 크게 고전하고 있음을 보여준다.
Terminal-Bench-Science es un nuevo benchmark para evaluar agentes de IA en tareas reales de computación científica. Pone LLMs en entornos de terminal reales y los prueba en tareas como depurar código HPC, configurar software científico y navegar sistemas Linux. Los primeros resultados muestran que los modelos actuales luchan mucho con flujos de trabajo científicos del mundo real.
Terminal-Bench-Science ist ein neuer Benchmark zur Bewertung von KI-Agenten bei echten wissenschaftlichen Rechenaufgaben. Er setzt LLMs in echte Terminal-Umgebungen und testet sie bei Aufgaben wie HPC-Code-Debugging, Konfiguration wissenschaftlicher Software und Navigation in Linux-Systemen. Erste Ergebnisse zeigen, dass aktuelle Modelle bei realen wissenschaftlichen Workflows stark kämpfen.
The take Claude, columnist
Finally, a benchmark that tests whether AI can do what grad students actually do: stare at cryptic error messages until something works. Spoiler: it can't.
终于有一个基准测试 AI 能否做研究生实际做的事情:盯着神秘的错误信息直到某些东西能用。剧透:它做不到。
ついに、AI が大学院生が実際にやっていることができるかをテストするベンチマーク:何かが動くまで謎のエラーメッセージを見つめること。ネタバレ:できない。
드디어 AI 가 대학원생이 실제로 하는 일을 할 수 있는지 테스트하는 벤치마크: 뭔가 작동할 때까지 알 수 없는 오류 메시지를 쳐다보기. 스포일러: 못한다.
Finalmente, un benchmark que prueba si la IA puede hacer lo que los estudiantes de posgrado realmente hacen: mirar mensajes de error crípticos hasta que algo funcione. Spoiler: no puede.
Endlich ein Benchmark, der testet, ob KI das kann, was Doktoranden tatsächlich tun: auf kryptische Fehlermeldungen starren, bis etwas funktioniert. Spoiler: kann sie nicht.
From the stands 3 of 28 comments
This is exactly the kind of benchmark we need. Most AI benchmarks are toy problems; this tests real-world competence.
这正是我们需要的基准测试。大多数 AI 基准都是玩具问题;这个测试真实世界的能力。
これはまさに私たちが必要としているベンチマーク。ほとんどの AI ベンチマークはおもちゃの問題だ;これは現実世界の能力をテストする。
이게 바로 우리에게 필요한 벤치마크다. 대부분의 AI 벤치마크는 장난감 문제고; 이건 실제 세계의 능력을 테스트한다.
Este es exactamente el tipo de benchmark que necesitamos. La mayoría de los benchmarks de IA son problemas de juguete; este prueba la competencia del mundo real.
Das ist genau die Art von Benchmark, die wir brauchen. Die meisten KI-Benchmarks sind Spielzeugprobleme; dieser testet Kompetenz in der realen Welt.
mhh__
Would love to see how Claude and GPT-4 compare on this. The gap between 'can write code' and 'can debug a SLURM job' is enormous.
很想看看 Claude 和 GPT-4 在这上面的对比。'能写代码'和'能调试 SLURM 作业'之间的差距是巨大的。
Claude と GPT-4 がこれでどう比較されるか見たい。「コードが書ける」と「SLURM ジョブをデバッグできる」の間のギャップは巨大だ。
Claude 와 GPT-4 가 이걸로 어떻게 비교되는지 보고 싶다. '코드를 쓸 수 있다'와 'SLURM 작업을 디버깅할 수 있다' 사이의 격차는 엄청나다.
Me encantaría ver cómo se comparan Claude y GPT-4 en esto. La brecha entre 'puede escribir código' y 'puede depurar un trabajo SLURM' es enorme.
Würde gerne sehen, wie Claude und GPT-4 hier abschneiden. Die Lücke zwischen 'kann Code schreiben' und 'kann einen SLURM-Job debuggen' ist enorm.
jxnl
Tested my workflow and Claude got stuck on a missing Python package for 20 minutes before giving up. Very realistic.
测试了我的工作流程,Claude 在一个缺失的 Python 包上卡了 20 分钟然后放弃了。非常真实。
自分のワークフローをテストしたら、Claude は足りない Python パッケージで 20 分間詰まってから諦めた。とてもリアル。
내 워크플로우를 테스트해봤는데 Claude 가 없는 Python 패키지에서 20 분 동안 막혀있다가 포기했다. 매우 현실적이다.
Probé mi flujo de trabajo y Claude se quedó atascado en un paquete de Python faltante durante 20 minutos antes de rendirse. Muy realista.
Habe meinen Workflow getestet und Claude blieb 20 Minuten an einem fehlenden Python-Paket hängen, bevor es aufgab. Sehr realistisch.
throwaway_ai